Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новини · всички източници

MarkTechPost

Ръководство за програмиране на TypeSafe AI Jev: типизирани решения, калибрирана увереност и спекулативно разклоняване със System One модел

Този урок предоставя пълно ръководство за програмиране на Jev от TypeSafe AI — модел System One, предназначен за нетекстови структурирани преценки. Той обхваща инсталирането на официалния Python SDK, използването на примитивни типове въпроси (Choice, Score, Noul), реализирането на спекулативно разклоняване, маршрутизиране, управлявано от увереността, и…

MarkTechPost

Google пуска Gemini 3.8 Flash TTS и Flash-Lite TTS с дизайн на гласове чрез подкани

Google пусна Gemini 3.8 Flash TTS и Flash-Lite TTS — 2 нови модела за преобразуване на текст в реч, които вече са достъпни чрез Gemini API и Google AI Studio. Flash TTS създава нови гласове по подкани на естествен език на над 100 езика. Моделът заема №1 в…

MarkTechPost

NVIDIA пусна Nemotron 3 Diarization: модел с отворени тегла и 100 млн. параметъра, който проследява 8 говорители в реално време

NVIDIA пусна Nemotron 3 Diarization — модел за диаризация на говорители с отворени тегла в Hugging Face. Той отговаря на един въпрос за всеки разговор: кой кога е говорил. Моделът с 100 млн. параметъра проследява до 8 говорители, включително при припокриване на гласове. Една контролна точка обработва и двете…

MarkTechPost

Nokia публикува с отворен код AnyJev: слой без обучение, който превръща всеки отворен LLM в калибриран модел за вземане на решения

Екипът за приложни изследвания на Nokia публикува с отворен код AnyJev, Python библиотека, която превръща отворен LLM в модел за вземане на решения. Тя не изисква обучение. Насочена е към честа производствена задача: избор на един отговор от фиксиран набор, вместо писане на…

MarkTechPost

Kyutai пуска Voice of Reason: речево-нативен модел, който решава устни математически задачи с обучение чрез подсилване

Kyutai пусна Voice of Reason — 2 модела с отворени тегла за преобразуване на реч в реч, изградени върху GLM-4-Voice-9B. Надзираното дообучаване и обучението чрез подсилване повишават точността при устно зададени задачи GSM8K от 27,3% на 77,1%. Няма стъпка за транскрипция и в процеса не участва текстов LLM. И двата чекпойнта…

MarkTechPost

SpeakON започва доставки на AI гласов бутон MagSafe със собствен микрофон

Гласовото въвеждане на телефони е решено от години. Нерешен остава изходът. Говорите в повечето инструменти за диктовка и получавате обратно точно това, което сте казали — включително паразитни думи и недовършени фрази — в бележка, която после…

MarkTechPost

SpeakON пуска AI гласов бутон с MagSafe и собствен микрофон: превръща гласа ви в изпипана комуникация и действия в приложенията

Гласовото въвеждане в телефоните е решено от години. Нерешен остава резултатът. Кажете нещо в повечето инструменти за диктовка и ще получите точно това, което сте казали — включително паразитни думи и недовършени фрази — в бележка, която после…

MarkTechPost

Anthropic пуска Claude Opus 5.5: производителност на ниво Fable 5.1 при 40% по-ниски разходи за работа от Opus 5

Anthropic пусна Claude Opus 5.5 — първия модел от новото семейство Claude 5.5. Екипът заявява, че той се представя на нивото на Claude Fable 5.1 при повечето задачи. Работата му струва и 40% по-малко в сравнение с Opus 5…

MarkTechPost

NVIDIA представя SoL-Pi: цикли за автоматизирани изследвания намаляват токенния трафик на кодиращите агенти с до 49%

Изследователи на NVIDIA публикуваха SoL-Pi — 4 механизма за обвивка на отворения кодиращ агент Pi, открити от ИИ, който е изпълнявал цикли за автоматизирани изследвания в 535 среди. При EdgeBench SoL-Pi намалява токенния трафик с 44,7% до 49,0%, а разходите за API — с приблизително 33%,…

MarkTechPost

SpaceXAI пуска Grok 4.7: По-голям базов модел на същата цена от $2/$6 като Grok 4.6

SpaceXAI пусна Grok 4.7, новия си водещ модел за програмиране, агентни задачи и работа със знания. Grok 4.7 е изграден върху по-голям базов модел и по-дълъг процес на обучение с подсилване. Той се предлага на същата цена и със същата скорост…

MarkTechPost

Екипът AWS Strands Agents представи Strands Harness: отворена платформа за агенти с 28% по-нисък разход на токени при сравнима точност

Много разработчици установяват, че дадена идея за агент работи в Claude Code или Codex, но среща трудности, когато я изградят наново със собствен цикъл. Екипът Strands Agents на AWS се стреми да запълни тази празнина със Strands Harness — напълно сглобена, универсална…