Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новин · усі джерела

MarkTechPost

Посібник із кодування для MSEB від Google Research: створення звукових енкодерів відповідно до вимог бенчмарку та їх оцінювання для класифікації, кластеризації, пошуку й сегментації

Вичерпний навчальний посібник із програмування для Massive Sound Embedding Benchmark (MSEB) від Google Research, що демонструє реалізацію користувацьких звукових енкодерів, запуск оцінювачів класифікації, кластеризації, пошуку й сегментації, а також аналіз результатів бенчмарку в кількох завданнях.

MarkTechPost

Sarvam AI випускає Saaras V4: модель перетворення мовлення на текст для всіх 22 індійських мов і глобальної англійської

Saaras V4 від Sarvam AI — модель перетворення мовлення на текст, що охоплює всі 22 індійські мови та глобальну англійську. Вона поєднує аудіоенкодер із гібридним декодером із простором станів на 3 млрд параметрів. Додано підказки з ключовими термінами — до 50 термінів, 5 режимів виведення від…

MarkTechPost

Supersonic Labs випустила Julia 1: відкриту модель ухвалення рішень зі 144,3 млн параметрів, що працює на CPU

Supersonic Labs випустила Julia 1 — модель ухвалення рішень зі 144,3 млн параметрів, побудовану на основі mmBERT-small. Вона приймає контекст, запитання та від 2 до 20 варіантів, а потім повертає один вибір із імовірностями. Модель працює на CPU і поширюється за ліцензією Apache 2.0.…

MarkTechPost

Exa запускає Agent Ultra: API для глибоких досліджень із роєм субагентів, створене для вичерпного складання списків

Exa випустила Agent Ultra — режим із найвищим рівнем зусиль у своєму Exa Agent API. Він координує субагентів у тисячах джерел для складання списків і збагачення даних про сутності. Exa повідомляє, що перевершує Opus 5.5, GPT-6 Astra та Perplexity Agent за 4…

MarkTechPost

Наскрізний бенчмарк мультимодальної аугментації даних і стійкості до змагальних атак з AugLy для зображень, тексту, аудіо та PyTorch

Дізнайтеся, як побудувати комплексний робочий процес мультимодальної аугментації та оцінювання стійкості до змагальних атак за допомогою AugLy для наборів даних із зображеннями, текстом, аудіо та PyTorch.

MarkTechPost

Liquid AI випустила LFM2.5-VL-3B-DSpark: спекулятивне декодування для візуально-мовних моделей із прискоренням до 3,13 раза

Liquid AI випустила LFM2.5-VL-3B-DSpark — чернеткову модель із 279,5 млн параметрів, яка додає спекулятивне декодування до її візуально-мовної моделі LFM2.5-VL-3B. Вона забезпечує до 3,13 раза швидше декодування на Apple M5 Max і до 2,66 раза на H100 за ідентичного результату в режимі жадібного декодування. Підтримка…

MarkTechPost

Aikido Security випускає Altar-1: модель безпеки з відкритими вагами, зменшена з GLM-5.3 до 328 ГБ

Aikido Security випустила Altar-1 — свою першу модель безпеки з відкритими вагами. Це стиснена версія GLM-5.3 від Z.AI, створена для роботи в інфраструктурі, контрольованій клієнтом. Altar-1 працює в Aikido Machine — автономному пристрої компанії для пентестингу в локальних та ізольованих мережах.…

MarkTechPost

Perplexity навчає свого комп’ютерного агента на реальних помилках за допомогою самодистиляції під керуванням підказок

Perplexity Research опублікувала нове дослідження з донавчання. У ньому модель навчають усередині Perplexity Computer на реальних користувацьких сесіях, зокрема невдалих. Метод поєднує тонке налаштування з вибіркою відхилень і самодистиляцію під керуванням підказок. У реальному A/B-тесті кількість невдалих викликів інструментів зменшилася з 2,24%…

MarkTechPost

Fastino випустила GLiNER2.5-Decide: модель ухвалення рішень із відкритими вагами та 340 млн параметрів, що працює на CPU

Fastino Labs випустила GLiNER2.5-Decide — модель ухвалення рішень із відкритими вагами та 340 млн параметрів. Вона приймає текст і схему типізованих запитань та повертає структуровані відповіді. Кожна відповідь супроводжується розподілом імовірностей, оцінкою впевненості й метаданими щодо здійсненності обмежень. Модель орієнтована на часте…

MarkTechPost

Black Forest Labs випустила FLUX 3 Action: 7B-модель дій у світі з відкритими вагами, що перевершує RoboLab-120

Black Forest Labs (BFL), лабораторія, що створила моделі зображень FLUX, випустила FLUX 3 Action. Це 7B-модель дій у світі (WAM) з відкритими вагами для керування роботами. Модель зчитує кадри з камери, стан робота й текстову інструкцію. Вона…

MarkTechPost

BottleCap AI випустила ThinkingCap-Qwen3.8-27B: на 37,2% менше токенів міркування ціною зниження точності на 0,86 в.п.

BottleCap AI випустила ThinkingCap-Qwen3.8-27B — донавчену версію Qwen3.8-27B, яка використовує на 37,2% менше токенів міркування у 12 бенчмарках. Макроточність змінилася з 86,65% до 85,79%, а AA-LCR у довгому контексті покращився на 2,25 в.п. Модель є прямою заміною у vLLM і…

MarkTechPost

Contrastive-LM випустила CLM-8B: відкриту модель System One, що оцінює дії агентів до 9 разів швидше за Jev

Contrastive-LM випустила CLM-8B — відкриту модель System One, яка оцінює дії-кандидати щодо стану, а не генерує текст. Вона додає 2 невеликі проекційні голови до замороженого енкодера Qwen3-8B і навчає їх за допомогою контрастивної цільової функції InfoNCE. У…