Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новостей · все источники

MarkTechPost

Jina AI выпустила jina-ocr-v1: парсер документов с 3,4 млрд параметров и архитектурой MoE, со встроенным спекулятивным декодированием для бюджетных GPU

Jina AI выпустила jina-ocr-v1 — визуальный парсер документов, преобразующий PDF-файлы, сканы, таблицы, диаграммы и счета в Markdown. Модель содержит 3,4 млрд параметров, из которых около 570 млн активны для каждого токена, и создана на основе DeepSeek-OCR. Встроенное спекулятивное декодирование FastMTP…

MarkTechPost

PrismML выпустила Ternary Bonsai 2 27B: модель Apache 2.0 размером 5,9 ГБ сохраняет 98,2% производительности Qwen3.8 27B

PrismML выпустила Ternary Bonsai 2 27B — версию Qwen3.8 27B с тернарными весами. Языковая модель занимает 5,93 ГБ против 53,80 ГБ в формате FP16. По данным PrismML, она сохраняет 98,2% среднего результата исходной модели в 20 бенчмарках. Модель…

MarkTechPost

Alibaba Qwen представила Qwen3.8-Omni-Flash: омнимодальную модель с контекстом в 1 млн токенов для агентного понимания аудио и видео и работы с инструментами

Qwen3.8-Omni-Flash от Alibaba понимает аудио и видео, планирует задачи, вызывает инструменты и использует примерно на 45,7% меньше токенов в OmniVideoBench.

MarkTechPost

Salesforce Agentforce: преодоление разрыва в корпоративном ИИ — от «вайб-кодинга» до проверенной боем оркестрации

Создать прототип с ИИ легко, но эксплуатация автономных агентов в масштабе требует инструментов промышленного уровня. Salesforce Agentforce преодолевает разрыв между «вайб-кодингом» и надёжностью корпоративного уровня, объединяя синтетическое стресс-тестирование, оптимизацию в реальном времени, динамические агентные интерфейсы и детерминированные защитные механизмы — как доказано…

MarkTechPost

Microsoft открыла исходный код TauGrid: Kubernetes-нативный стек для ИИ-нагрузок на GPU

Инженерная команда Microsoft, отвечающая за AKS, открыла исходный код TauGrid 28 августа 2026 года, объединив CLI tau, систему очередей Kueue, оркестрацию KubeRay, мониторинг состояния GPU-узлов и наблюдаемость в одной установке Helm. Решение распространяется по лицензии MIT и уже может быть развернуто в любом кластере Kubernetes 1.30+…

MarkTechPost

Anthropic запускает Projects в Claude Code в бета-версии: параллельные облачные сессии, которые продолжают работать после закрытия ноутбука

Anthropic переработала Projects в Claude Code. Старый проект представлял собой папку: несколько файлов и один чат. Новый — это единый продолжающийся разговор, в котором Claude выступает координатором. Вы описываете работу, а Claude решает, что станет отдельной веткой…

MarkTechPost

OpenAI выпустила структуру раскрытия случаев рассогласования моделей с 3 направлениями проверки и 6 отчетами об инцидентах из обучения с RL

OpenAI может раскрывать случаи рассогласования до появления исправлений. В ее первых 6 отчетах есть сфабрикованные данные и утекшие ключи API.

MarkTechPost

Google Research представила Retrieve-for-Train (R4T): диффузионный ретривер, скомпилированный с помощью RL, для ускорения разветвления запросов в 12–20 раз

Google Research представила Retrieve-for-Train (R4T) — фреймворк для поиска, возвращающий согласованные и разнообразные наборы результатов. Он один раз обучает с помощью RL языковую модель для разветвления, используя награды за обоснованность, разнообразие и соответствие. Затем модель синтезирует обучающие данные для 53,9M-параметричной…

MarkTechPost

Nunchux AI представила VC-Attention: низкоразрядное ядро внимания без обучения, ускоряющее видео Diffusion Transformers

Nunchux AI выпустила VC-Attention — низкоразрядное ядро внимания без обучения, созданное для видео Diffusion Transformers (DiTs). Оно одновременно решает 2 проблемы: ошибку квантования значений и медленный этап softmax. Почему внимание — узкое место в видео Видео DiTs разворачивают…

MarkTechPost

Исследователи из Stanford представили Paper2Agent: превращение научных статей в ИИ-агентов, воспроизводящих результаты и работающих с новыми данными

Paper2Agent, опубликованный в Nature, превращает научные статьи в валидированные MCP-инструменты и набирает 91,2% при ответах на 300 вопросов по 74 статьям.

MarkTechPost

Knowledgator выпускает GLiFormer: энкодер с 575 млн параметров, достигающий 91,10 F1 при извлечении вложенного JSON без генерации токенов

GLiFormer Large набирает 91,10 F1 при работе с вложенным JSON, почти как GPT-5.6-luna с результатом 91,96, при этом привязывая каждое значение к фрагментам исходного текста.