Sakhanda Wire
NVDA $236.97 +2.64% MSFT $518.11 +1.04% GOOGL $344.80 +1.94% META $734.52 +1.18% AMZN $252.55 +1.74%

MarkTechPost

208 новини · всички източници

MarkTechPost

Anthropic внедрява Claude Mythos 5 в Claude Security: корпоративните екипи получават водещо сканиране за уязвимости без пряк достъп до модела

Anthropic премести най-способния си модел за киберсигурност в продукт, който екипите по сигурността могат да активират сами. Сканиранията в Claude Security вече работят с Claude Mythos 5, който е в публична бета за клиентите на Claude Enterprise без отделен добавъчен пакет за модела. Сканирането се свързва…

MarkTechPost

Представяме S1-mini: 462 MB нормализатор на текст с отворени тегла от Superwhisper, който превръща суровите ASR транскрипции в чист писмен текст

S1-mini е нормализатор с отворени тегла с размер 462 MB, който работи след ASR, премахва паразитните думи и разрешава самокорекциите локално.

MarkTechPost

Запознайте се с UPDF: лека алтернатива на Adobe, създадена за ерата на агентния ИИ

PDF файловете се четат лесно, но се променят трудно. ИИ вече може да обобщи 90-страничен договор за секунди, но все още не може да пренапише изходния файл чисто. UPDF е създаден за втората част: директно редактиране, конвертиране в 14 формата, OCR на 38 езика,…

MarkTechPost

Liquid AI пуска чернови модели LFM2.5-DSpark, които осигуряват до 3,18 пъти по-бързо декодиране без промяна на изхода на модела

Три чернови модела с около 300 млн. параметъра въвеждат спекулативното декодиране в LFM2.5, осигурявайки до 3,18 пъти по-бързо декодиране при идентичен жаден изход.

MarkTechPost

Одит на пристрастията в предпочитанията и дообучаване на езикови модели с Direct Preference Optimization върху Anthropic HH-RLHF с TRL и LoRA

Този урок представя цялостен работен процес за дообучаване на езикови модели с Direct Preference Optimization (DPO). Демонстрираме как да одитираме набора от данни Anthropic HH-RLHF за структурни и базирани на дължината пристрастия, да реализираме надежден обучителен конвейер с TRL и LoRA и да оценим…

MarkTechPost

NVIDIA пусна TensorRT Model Connect в публичен предварителен преглед: от Hugging Face чекпойнт до нативен C++ инференс с две команди

NVIDIA пусна TensorRT Model Connect (TRTMC) в публичен предварителен преглед — проект под Apache-2.0, който превръща поддържан Hugging Face или локален чекпойнт в цялостен TensorRT инференс с две команди, без междинен ONNX експорт. Компилацията генерира версиониран .bundle…

MarkTechPost

Представяме SAM (Sovereign Agent Mesh): P2P мрежа без конфигурация и с нулево доверие за AI агенти

Google пусна SAM (Sovereign Agent Mesh) като софтуер с отворен код по Apache-2.0 — и той няма нищо общо със Segment Anything. SAM е P2P оверлей без конфигурация и с нулево доверие, който позволява на автономни агенти да откриват и извикват MCP инструментите си един на друг в облака, в локални среди,…

MarkTechPost

Cartesia пусна Sonic-3.6: стрийминг TTS модел, която вече оглавява и двете речеви арени на Artificial Analysis

Cartesia пусна Sonic-3.6, стрийминг модел за преобразуване на текст в реч, изграден върху модели на пространството на състоянията, а не върху трансформъри. Той вече заема №1 и в двете класации за реч на Artificial Analysis — 1 283 Elo в Provider Voice и 1 123 в Controlled Voice, класацията, която…

MarkTechPost

Nous Research пусна Bot Mode за Hermes Agent, превръщайки профилите на агентите в списък от именувани ботове

Nous Research пусна Bot Mode за Hermes Agent, своя агент с отворен код под MIT лиценз. Bot Mode заменя списъка с единични агентски сесии със списък от именувани ботове. Всеки бот е реален Hermes профил със собствен чат, памет, умения,…

MarkTechPost

ByteDance Seed и Tsinghua AIR представиха CUDA Agent: широкомащабна агентна RL система за генериране на CUDA ядра

ByteDance Seed и Tsinghua AIR пуснаха CUDA Agent — агентна система за обучение с подкрепление, която обучава голям езиков модел да пише GPU ядра, превъзхождащи компилатора. Целта ѝ е тесен, но упорит разрив: авангардните модели вече генерират…

MarkTechPost

MiniMax пуска MiniMax-Music3: музикален модел с отворени тегла, генериращ завършени петминутни песни от текст на песен и структурирано описание

MiniMax пусна MiniMax-Music3 — текстово-музикален модел с отворени тегла. При зададени текст на песен със секционни тагове и структурирано описание той генерира завършена песен с продължителност до пет минути на един проход като 32 kHz, 16-битов стерео WAV файл. Ето архитектурата,…

MarkTechPost

Разработване на цялостен конвейер за интелигентна обработка на документи с docTR за OCR, анализ на оформлението, KIE, бенчмаркинг и PDF файлове с възможност за търсене

Разработете цялостен конвейер за интелигентна обработка на документи с docTR, интегриращ OCR, анализ на оформлението и KIE за извличане, ориентирано към продукционна среда, и създаване на PDF файлове с възможност за търсене.