Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новостей · все источники

MarkTechPost

Руководство по кодированию для MSEB от Google Research: написание звуковых энкодеров в соответствии с требованиями бенчмарка и их оценка для классификации, кластеризации, поиска и сегментации

Подробный учебник по программированию для Massive Sound Embedding Benchmark (MSEB) от Google Research, демонстрирующий реализацию пользовательских звуковых энкодеров, запуск оценщиков классификации, кластеризации, поиска и сегментации, а также анализ результатов бенчмарка в нескольких задачах.

MarkTechPost

Sarvam AI выпускает Saaras V4: модель преобразования речи в текст для всех 22 индийских языков и глобального английского

Saaras V4 от Sarvam AI — модель преобразования речи в текст, охватывающая все 22 индийских языка и глобальный английский. Она сочетает аудиоэнкодер с гибридным декодером с пространством состояний на 3 млрд параметров. Добавлена поддержка подсказок с ключевыми терминами — до 50 терминов, 5 режимов вывода от…

MarkTechPost

Supersonic Labs выпустила Julia 1: открытую модель принятия решений со 144,3 млн параметров, работающую на CPU

Supersonic Labs выпустила Julia 1 — модель принятия решений со 144,3 млн параметров на базе mmBERT-small. Она принимает контекст, вопрос и от 2 до 20 вариантов, после чего возвращает один вариант с вероятностями. Модель работает на CPU и распространяется по лицензии Apache 2.0.…

MarkTechPost

Exa запускает Agent Ultra: API для глубоких исследований с роем субагентов, созданное для исчерпывающего составления списков

Exa выпустила Agent Ultra — режим с максимальным уровнем усилий в своем Exa Agent API. Он координирует субагентов в тысячах источников для составления списков и обогащения данных о сущностях. Exa сообщает, что превосходит Opus 5.5, GPT-6 Astra и Perplexity Agent по 4…

MarkTechPost

Сквозной бенчмарк мультимодальной аугментации данных и устойчивости к состязательным атакам с AugLy для изображений, текста, аудио и PyTorch

Узнайте, как построить комплексный рабочий процесс мультимодальной аугментации и оценки устойчивости к состязательным атакам с использованием AugLy для наборов данных с изображениями, текстом, аудио и PyTorch.

MarkTechPost

Liquid AI выпустила LFM2.5-VL-3B-DSpark: спекулятивное декодирование для зрительно-языковых моделей с ускорением до 3,13 раза

Liquid AI выпустила LFM2.5-VL-3B-DSpark — черновую модель с 279,5 млн параметров, которая добавляет спекулятивное декодирование к её зрительно-языковой модели LFM2.5-VL-3B. Она обеспечивает до 3,13 раза более быстрое декодирование на Apple M5 Max и до 2,66 раза на H100 при идентичном выводе в режиме жадного декодирования. Поддержка…

MarkTechPost

Aikido Security выпускает Altar-1: модель безопасности с открытыми весами, уменьшенная из GLM-5.3 до 328 ГБ

Aikido Security выпустила Altar-1 — свою первую модель безопасности с открытыми весами. Это сжатая версия GLM-5.3 от Z.AI, созданная для работы внутри инфраструктуры, контролируемой заказчиком. Altar-1 используется в Aikido Machine — автономном устройстве компании для пентестинга в локальных и изолированных сетях.…

MarkTechPost

Perplexity обучает своего компьютерного агента на реальных ошибках с самодистилляцией под управлением подсказок

Perplexity Research опубликовала новое исследование по посттренировочному обучению. В нём модель обучают внутри Perplexity Computer на реальных пользовательских сессиях, включая неудачные. Метод сочетает дообучение с выборкой отклонённых ответов и самодистилляцию под управлением подсказок. В реальном A/B-тесте сбои вызовов инструментов снизились с 2,24%…

MarkTechPost

Fastino выпустила GLiNER2.5-Decide: модель принятия решений с открытыми весами и 340 млн параметров, работающая на CPU

Fastino Labs выпустила GLiNER2.5-Decide — модель принятия решений с открытыми весами и 340 млн параметров. Она принимает текст и схему типизированных вопросов и возвращает структурированные ответы. Каждый ответ сопровождается распределением вероятностей, оценкой уверенности и метаданными о выполнимости ограничений. Модель предназначена для частого…

MarkTechPost

Black Forest Labs выпустила FLUX 3 Action: 7B-модель действий в мире с открытыми весами, превзошедшая RoboLab-120

Black Forest Labs (BFL), лаборатория, стоящая за моделями изображений FLUX, выпустила FLUX 3 Action. Это 7B-модель действий в мире (WAM) с открытыми весами для управления роботами. Модель считывает кадры с камеры, состояние робота и текстовую инструкцию. Она…

MarkTechPost

BottleCap AI выпустила ThinkingCap-Qwen3.8-27B: на 37,2% меньше токенов рассуждений при снижении точности на 0,86 п.п.

BottleCap AI выпустила ThinkingCap-Qwen3.8-27B — дообученную версию Qwen3.8-27B, которая использует на 37,2% меньше токенов рассуждений в 12 бенчмарках. Макроточность изменилась с 86,65% до 85,79%, а AA-LCR в условиях длинного контекста улучшился на 2,25 п.п. Модель является прямой заменой во vLLM и…

MarkTechPost

Contrastive-LM выпустила CLM-8B: открытую модель System One, оценивающую действия агентов до 9 раз быстрее, чем Jev

Contrastive-LM выпустила CLM-8B — открытую модель System One, которая оценивает действия-кандидаты относительно состояния, а не генерирует текст. Она добавляет 2 небольшие проекционные головы к замороженному энкодеру Qwen3-8B и обучает их с помощью контрастивной целевой функции InfoNCE. В…