Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новини · всички източници

MarkTechPost

Изследовател от Princeton предлага Recurrent Looped Transformer (RLT), който пренася състоянието на декодера през всеки токен, фиксирайки 96 блока на токен с неограничена времева дълбочина

Техническият доклад на Yifan Zhang за Recurrent Looped Transformer (RLT) предлага каузален енкодер, съчетан с рекурентен декодер, който пренася крайното си скрито състояние и кеша на плъзгащия се прозорец за вниманието на всеки слой през всеки токен от промпта и отговора, без нулиране при обслужването…

MarkTechPost

AWS представя Pizza Bot: входяща кутия с отворен код за фонови AI агенти

Pizza Bot е входяща кутия с отворен код и възможност за самостоятелно хостване за AI агенти, изградена върху DeepAgents и LangGraph. Тя съчетава постоянно състояние на задачите, MCP интеграции, конфигурируеми одобрения и планирани работни процеси чрез множество доставчици на модели.

MarkTechPost

Контекстно инженерство в обвивката: 4 механизма, които предотвратяват препълването на контекста и загубата на целта при задачи с дълъг хоризонт

Повърхностният агент е LLM, който извиква инструменти в цикъл, и при дълги задачи се проваля по 2 начина: препълване на контекста и загуба на целта. Тази статия разкрива слоя на обвивката, който отстранява и двата проблема, с реалните прагове, внедрени от…

MarkTechPost

Реализация на работни процеси за машинно обучение с NVIDIA cuML, RAPIDS, GPU бенчмаркинг, обяснимост, клъстеризация и инференс на модели

Този практически урок демонстрира как да изграждате и ускорявате работни процеси за машинно обучение с помощта на NVIDIA cuML и RAPIDS. Той обхваща настройването на GPU среда, ускоряване на scikit-learn без код с cuml.accel, бенчмаркинг на производителността при ключови алгоритми за машинно обучение, manifold learning с UMAP и HDBSCAN, дървовидни модели…

MarkTechPost

Cognition представи SWE-2: дообученa модел за писане на код, базирана на Kimi K3, която се изравнява с Fable 5.1 във FrontierCode при 64% по-ниска цена

Cognition, компанията зад кодиращия агент Devin, представи SWE-2 — най-мощния си модел за писане на код досега. SWE-2 е дообучен с подсилващо обучение върху Kimi K3 — отворения модел на Moonshot AI с 2,8 трлн. параметъра. Cognition съобщава резултат от 50,0% във FrontierCode…

MarkTechPost

Езиковият модел на плодовата мушица (FLM) окабелява пълния конектом на плодовата мушица във фиксиран 1,2-милиарден LLM, а собствените му контролни експерименти показват, че окабеляването не помага

Езиковият модел на плодовата мушица (FLM) подава токенни вграждания към всичките 166 700 запазени неврона и 25,6 милиона връзки на конектома на плодова мушица MaleCNS, след което добавя малка научавана корекция към замразената базова LFM2.5-1.2B-Instruct архитектура. Обучават се само 278 528 параметъра. Съпътстващият…

MarkTechPost

Могат ли LLM да проектират собствен агентски хънес? HarnessDev на ByteDance Seed показва, че само 34 от 64 промени се обобщават

ByteDance Seed, SUTD, Georgia Tech, M-A-P и TokenWave.AI представят HarnessDev — бенчмарк, който оценява изпълнимия хънес, създаден от модела, а не отговора, който той връща. Започвайки от основа с резултат 0, 6 LLM модела-създатели изграждат хънеси в 5…

MarkTechPost

Anthropic добавя оценки на плъгини към Claude Code: 6 типа оценяване, базова линия без плъгин и CI проверка за уменията

Anthropic публикува нов работен процес за оценяване на плъгини за Claude Code. Командата claude plugin eval изпълнява плъгин с реалистични подкани, оценява резултата, генериран от Claude, и го сравнява с изпълнение, при което плъгинът не е зареден. Тя…

MarkTechPost

Cohere представи North Small Translate: преводачески MoE модел с 218 млрд. параметъра, който постига 83,6 на WMT26 за 50 езика

Cohere представи North Small Translate — модел с отворени тегла и архитектура Mixture-of-Experts, предназначен за машинен превод на 50 езика. Той използва 25 млрд. от общо 218 млрд. параметъра на токен и постига 83,6 в оценяването на Cohere по WMT26. Теглата са безплатни за некомерсиална употреба, с…

MarkTechPost

Sakana AI пуска Fugu Max и Fugu Ultra v2 за по-евтина и по-мощна оркестрация на множество агенти

Sakana AI пусна Fugu Max и Fugu Ultra v2 — два модела, изградени върху една и съща обучена архитектура за оркестрация. Fugu Max насочва задачите към леки отворени и специализирани модели, включително NVIDIA Nemotron, на цена от $2/$6 за 1 млн. токена. Fugu Ultra v2…

MarkTechPost

Google Research представи ToolGrad: рамка с подход „отговорът на първо място“ постига 99,8% успеваемост при генериране на данни за използване на инструменти

Google Research представи ToolGrad — рамка от ACL 2026 Findings, която обръща генерирането на набори от данни за използване на инструменти: първо изгражда проверена API верига, а след това пише съответстващата потребителска заявка. Напътствана от текстови „градиенти“ в цикъл от 4 модула — предложи–изпълни–избери–обнови, ToolGrad достига до…

MarkTechPost

Запознайте се с Redis LangCache: управляван семантичен кеш, който намалява разходите за LLM API с до 90% и връща попаденията в кеша до 15 пъти по-бързо

Производствените LLM приложения рядко получават въпрос, който никой не е задавал преди. Асистентите за поддръжка и RAG конвейерите обработват едни и същи намерения хиляди пъти дневно, формулирани по различен начин, а повечето стекове третират всяка формулировка като нова, изцяло таксувана заявка.…