Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новини · всички източници

MarkTechPost

Ръководство за кодиране на MSEB на Google Research: създаване на звукови енкодери според изискванията на бенчмарка и оценяването им за класификация, клъстеризация, извличане и сегментация

Подробен урок по програмиране за Massive Sound Embedding Benchmark (MSEB) на Google Research, който показва как да се реализират персонализирани звукови енкодери, да се стартират оценители за класификация, клъстеризация, извличане и сегментация и да се анализира представянето на бенчмарка по множество задачи.

MarkTechPost

Sarvam AI пуска Saaras V4: модел за преобразуване на реч в текст за всичките 22 индийски езика и глобален английски

Saaras V4 на Sarvam AI е модел за преобразуване на реч в текст, обхващащ всичките 22 индийски езика и глобален английски. Той съчетава аудио енкодер с хибриден декодер с пространство на състоянията с 3 млрд. параметъра. Добавя подаване на ключови термини за до 50 термина, 5 режима на изход от…

MarkTechPost

Supersonic Labs пусна Julia 1: отворен модел за вземане на решения със 144,3 млн. параметъра, който работи на CPU

Supersonic Labs пусна Julia 1 — модел за вземане на решения със 144,3 млн. параметъра, изграден върху mmBERT-small. Той приема контекст, въпрос и от 2 до 20 опции, след което връща един избор с вероятности. Моделът работи на CPU и се разпространява под лиценза Apache 2.0.…

MarkTechPost

Exa стартира Agent Ultra: API за задълбочено проучване с рояк от подагенти, създаден за изчерпателно съставяне на списъци

Exa пусна Agent Ultra — режима с най-високо ниво на усилия в своя Exa Agent API. Той координира подагенти в хиляди източници за съставяне на списъци и обогатяване на информацията за обекти. Exa съобщава, че превъзхожда Opus 5.5, GPT-6 Astra и Perplexity Agent по 4…

MarkTechPost

Бенчмарк от край до край за мултимодална аугментация на данни и устойчивост срещу атаки с AugLy за изображения, текст, аудио и PyTorch

Научете как да изградите цялостен работен процес за мултимодална аугментация и устойчивост срещу атаки с AugLy за набори от данни с изображения, текст, аудио и PyTorch.

MarkTechPost

Liquid AI представи LFM2.5-VL-3B-DSpark: спекулативно декодиране за визионно-езикови модели с до 3,13 пъти по-бързо декодиране

Liquid AI представи LFM2.5-VL-3B-DSpark — чернови модел с 279,5 млн. параметъра, който добавя спекулативно декодиране към нейния визионно-езиков модел LFM2.5-VL-3B. Той осигурява до 3,13 пъти по-бързо декодиране на Apple M5 Max и 2,66 пъти на H100, с идентичен резултат при жадно декодиране. Поддръжка…

MarkTechPost

Aikido Security пуска Altar-1: модел за сигурност с отворени тегла, олекотен от GLM-5.3 до 328 GB

Aikido Security пусна Altar-1, първия си модел за сигурност с отворени тегла. Той е компресирана версия на GLM-5.3 на Z.AI, създадена да работи в инфраструктура, контролирана от клиента. Altar-1 захранва Aikido Machine — автономното устройство на компанията за пентестове в локални и изолирани мрежи без достъп до интернет.…

MarkTechPost

Perplexity обучава своя компютърен агент на реални грешки със самодистилация, насочвана от подсказки

Perplexity Research публикува ново изследване за дообучаване. То обучава модел в Perplexity Computer върху реални потребителски сесии, включително неуспешни. Методът комбинира фина настройка чрез извадка от отхвърляния със самодистилация, насочвана от подсказки. При реален A/B тест неуспешните извиквания на инструменти спаднаха от 2,24%…

MarkTechPost

Fastino пусна GLiNER2.5-Decide: модел за вземане на решения с отворени тегла и 340 млн. параметъра, който работи на CPU

Fastino Labs пусна GLiNER2.5-Decide — модел за вземане на решения с отворени тегла и 340 млн. параметъра. Той приема текст и схема от типизирани въпроси и връща структурирани отговори. Всеки отговор включва вероятностно разпределение, оценка на увереността и метаданни за изпълнимост на ограниченията. Моделът е насочен към честото…

MarkTechPost

Black Forest Labs пуска FLUX 3 Action: 7B модел за действия в света с отворени тегла, който надминава RoboLab-120

Black Forest Labs (BFL), лабораторията зад моделите за изображения FLUX, пусна FLUX 3 Action. Това е 7B модел за действия в света (WAM) с отворени тегла за управление на роботи. Моделът чете кадри от камера, състоянието на робота и текстова инструкция. Той…

MarkTechPost

BottleCap AI пусна ThinkingCap-Qwen3.8-27B: с 37,2% по-малко токени за разсъждение при цена от 0,86 пр.п. в точността

BottleCap AI пусна ThinkingCap-Qwen3.8-27B — дообучена версия на Qwen3.8-27B, която използва с 37,2% по-малко токени за разсъждение в 12 бенчмарка. Макро точността се променя от 86,65% на 85,79%, а AA-LCR при дълъг контекст се подобрява с 2,25 пр.п. Моделът е директно заменяем във vLLM и…

MarkTechPost

Contrastive-LM пусна CLM-8B: отворен модел System One, който оценява действията на агенти до 9 пъти по-бързо от Jev

Contrastive-LM пусна CLM-8B — отворен модел System One, който оценява кандидат-действия спрямо състояние, вместо да генерира текст. Той добавя 2 малки проекционни глави към замразен енкодер Qwen3-8B и ги обучава с контрастивна цел InfoNCE. В…