Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новостей · все источники

MarkTechPost

IFM выпустил K2 Horizon: шесть моделей по лицензии Apache 2.0 — от 0,9 млрд до 375 млрд

Большинство релизов открытых моделей включают одну контрольную точку и таблицу с результатами бенчмарков. На прошлой неделе Institute of Foundation Models (IFM) представил нечто более масштабное. IFM — лаборатория передовых моделей, созданная MBZUAI в мае 2025 года. K2 Horizon — набор из шести…

MarkTechPost

H Company представила NeoMME: семейство одно-башенных мультимодальных энкодеров на 260 и 800 млн параметров, обходящихся без визуальной башни и каузального декодера

Рассматриваем NeoMME — семейство двунаправленных энкодеров на 260 и 800 млн параметров от H Company. В отличие от ретриверов в стиле ColPali, оно обрабатывает многоязычные текстовые токены и необработанные патчи изображений 32×32 в одном Transformer, без предобученной визуальной башни и без каузального…

MarkTechPost

Meta FAIR представляет модели предпочтений для ИИ-исследований (RPMs): ранжирование ML-экспериментов до расходования GPU-часов

Агенты ИИ-исследований могут предлагать гораздо больше экспериментов, чем могут позволить себе провести. Meta FAIR, Oxford и UCL представляют модели предпочтений для ИИ-исследований — замороженные судьи на базе LLM, которые ранжируют 15 ещё не проведённых кандидатов и запускают только один. На AIRS-Bench, …

MarkTechPost

Исследователи UC Berkeley выпустили CUA-Lite — открытую платформу, объединяющую песочницы, данные, оценивание и RL для агентов, работающих с компьютером

Для обучения и бенчмаркинга агента, работающего с компьютером, нужны четыре вещи — агенты, среды, трейсы и фреймворк для их оценки и обучения, — однако сегодня все четыре поставляются в несовместимых форматах. CUA-Lite, созданная командой под руководством UC Berkeley, объединяет их за…

MarkTechPost

Perplexity подробно описывает свой стек эмбеддингов на GPU: как Ivy, Tulip и ROSE обслуживают pplx-embed

Качество поиска в продукте для поиска на базе ИИ ограничено двумя факторами: насколько хороша модель эмбеддингов и насколько дёшево её можно запускать на индексе. На этой неделе команда Perplexity Engineering опубликовала Fast Embeddings on GPUs — разбор внутреннего устройства…

MarkTechPost

GitHub представляет Project HydraFusion: оркестрация нескольких моделей во время выполнения, создающая отдельный рабочий процесс для каждой задачи кодирования в Copilot CLI

Мы рассматриваем Project HydraFusion — исследовательскую предварительную версию GitHub, которая трактует выбор рабочего процесса как задачу оптимизации, а не как выбор модели. Мы разбираем три шаблона выполнения, между которыми система маршрутизирует задачи: Single, Cascade с порогом качества и Critique…

MarkTechPost

Nous Research добавила настройку локальных моделей в один клик в Hermes Desktop

Nous Research свела настройку локальной модели к одному клику в Hermes Desktop. Приложение считывает характеристики вашего оборудования, проверяет каталог на совместимость с вашим GPU, выбирает сборку наивысшего качества, которая подходит, загружает её и настраивает llama.cpp — с жёстким…

MarkTechPost

Adaption Labs представляет «Invent a Dataset»: обучающие данные генерируются из описания задачи, а не из исходного корпуса

Adaption Labs выпустила Invent a Dataset, который генерирует структурированный набор данных, готовый для обучения, на основе описания поведения, которому вы хотите обучить модель. Нет исходного корпуса, разработки схемы или руководства по разметке. Один datasets.invent…

MarkTechPost

NVIDIA выпускает Personal AI Router (PAIR): виртуальный маршрутизатор инференса с открытым исходным кодом, распределяющий локальные запросы к ИИ между узлами RTX, DGX Spark и Mac

Мы рассматриваем NVIDIA Personal AI Router (PAIR) — виртуальный маршрутизатор инференса с открытым исходным кодом, который распределяет локальные запросы к ИИ между уже подключёнными к домашней сети компьютерами. Мы рассказываем, как PAIR проксирует существующие конечные точки Ollama и LM Studio, чтобы агент…

MarkTechPost

WeatherNext 3 от Google DeepMind обучается на наблюдениях метеостанций, чтобы выдавать глобальные прогнозы с разрешением 5 км, обновляемые каждый час

WeatherNext 3 обрабатывает актуальные мозаики геостационарных спутников, обновляется ежечасно и выдает прогнозы с разрешением 5 км в Search, Gemini и Maps.

MarkTechPost

OpenAI выпустила GPT-6 Astra: модель для работы с компьютером с контекстом в 1,05 млн токенов, доступная после «критического» киберпорога

OpenAI выпустила GPT-6 Astra 3 сентября 2026 года, позиционировав её как флагманскую модель для работы с компьютером, а не как чат-модель. Компания сообщает о результате 72,6% в OSWorld V2-Offline, заменяет сжатие контекста в Codex на заметки с возможностью поиска и предлагает контекст в 1,05 млн токенов по цене $10/$50 за миллион…