Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новин · усі джерела

MarkTechPost

Дослідник із Princeton пропонує Recurrent Looped Transformer (RLT), який переносить стан декодера через кожен токен, фіксуючи 96 блоків на токен із необмеженою часовою глибиною

У технічному звіті Yifan Zhang про Recurrent Looped Transformer (RLT) пропонується каузальний енкодер у парі з рекурентним декодером, який переносить свій фінальний прихований стан і пошаровий кеш уваги зі ковзним вікном через кожен токен промпту та відповіді, без скидання під час обслуговування…

MarkTechPost

AWS представляє Pizza Bot: open source-інбокс для фонових ШІ-агентів

Pizza Bot — це open source-інбокс із самостійним розгортанням для ШІ-агентів, створений на базі DeepAgents і LangGraph. Він поєднує постійний стан завдань, інтеграції MCP, налаштовані підтвердження та заплановані робочі процеси для кількох провайдерів моделей.

MarkTechPost

Контекстна інженерія всередині оболонки: 4 механізми, що запобігають переповненню контексту та втраті мети в завданнях із довгим горизонтом

Поверхневий агент — це LLM, що викликає інструменти в циклі, і в довгих завданнях він зазнає невдачі з 2 причин: переповнення контексту та втрата мети. У цій статті розкривається шар оболонки, який усуває обидві проблеми, із фактичними порогами, упровадженими…

MarkTechPost

Реалізація робочих процесів машинного навчання з NVIDIA cuML, RAPIDS, бенчмаркінгом GPU, пояснюваністю, кластеризацією та інференсом моделей

Цей практичний посібник демонструє, як створювати й прискорювати робочі процеси машинного навчання за допомогою NVIDIA cuML і RAPIDS. Він охоплює налаштування середовища GPU, прискорення scikit-learn без написання коду за допомогою cuml.accel, бенчмаркінг продуктивності ключових алгоритмів машинного навчання, manifold learning із UMAP і HDBSCAN, деревоподібні моделі…

MarkTechPost

Cognition представила SWE-2: донавчену на базі Kimi K3 модель для написання коду, що відповідає Fable 5.1 у FrontierCode за вартості на 64% нижчої

Cognition, компанія, що створила кодингового агента Devin, представила SWE-2 — свою найпотужнішу на сьогодні модель для написання коду. SWE-2 донавчено за допомогою навчання з підкріпленням на базі Kimi K3 — відкритої моделі Moonshot AI із 2,8 трлн параметрів. Cognition повідомляє про результат 50,0% у FrontierCode…

MarkTechPost

Мовна модель мухи (FLM) підключає повну конектому плодової мушки до замороженої LLM на 1,2 млрд параметрів, а власні контрольні експерименти показують, що така схема не допомагає

Мовна модель мухи (FLM) подає токенні ембеддинги на всі 166 700 збережених нейронів і 25,6 млн зв’язків конектоми плодової мушки MaleCNS, а потім додає невелику навчену поправку до замороженої базової моделі LFM2.5-1.2B-Instruct. Навчаються лише 278 528 параметрів. Доданий…

MarkTechPost

Чи можуть LLM проєктувати власний агентський х harness? HarnessDev від ByteDance Seed показує: узагальнюються лише 34 із 64 змін

ByteDance Seed, SUTD, Georgia Tech, M-A-P і TokenWave.AI представляють HarnessDev — бенчмарк, який оцінює працездатний х harness, створений моделлю, а не відповідь, яку вона повертає. Починаючи з основи з результатом 0, 6 LLM-моделей-розробників будують х harness-и у 5…

MarkTechPost

Anthropic додала оцінювання плагінів до Claude Code: 6 типів оцінювання, базовий варіант без плагіна та CI-перевірка для навичок

Anthropic опублікувала новий робочий процес оцінювання плагінів для Claude Code. Команда claude plugin eval запускає плагін із реалістичними запитами, оцінює результат, створений Claude, і порівнює його із запуском, у якому плагін не завантажено. Вона…

MarkTechPost

Cohere випустила North Small Translate: модель перекладу MoE на 218 млрд параметрів, що набирає 83,6 на WMT26 для 50 мов

Cohere випустила North Small Translate — модель із відкритими вагами та архітектурою Mixture-of-Experts, призначену для машинного перекладу 50 мовами. Вона використовує 25 млрд із 218 млрд параметрів на токен і набирає 83,6 бала в оцінюванні Cohere за WMT26. Ваги можна безкоштовно використовувати в некомерційних цілях, водночас…

MarkTechPost

Sakana AI запускає Fugu Max і Fugu Ultra v2 для дешевшої та потужнішої оркестрації мультиагентних систем

Sakana AI випустила Fugu Max і Fugu Ultra v2 — дві моделі, побудовані на одній і тій самій навченій архітектурі оркестрації. Fugu Max спрямовує завдання до компактних відкритих і спеціалізованих моделей, зокрема NVIDIA Nemotron, за ціною $2/$6 за 1 млн токенів. Fugu Ultra v2…

MarkTechPost

Google Research представила ToolGrad: фреймворк із підходом «спочатку відповідь» досягає показника проходження 99,8% під час генерації даних для використання інструментів

Google Research представила ToolGrad — фреймворк із ACL 2026 Findings, який інвертує генерацію наборів даних для використання інструментів: спочатку він будує перевірений ланцюжок API, а потім пише відповідний запит користувача. Керуючись текстовими «градієнтами» в циклі з 4 модулів — запропонувати–виконати–вибрати–оновити, ToolGrad досягає…

MarkTechPost

Знайомтеся: Redis LangCache — керований семантичний кеш, який скорочує витрати на LLM API до 90% і повертає збіги з кешу до 15 разів швидше

Промислові LLM-застосунки рідко отримують запитання, якого ніхто не ставив раніше. Асистенти підтримки та RAG-конвеєри обробляють ті самі наміри тисячі разів на день, щоразу в іншому формулюванні, а більшість стеків розглядає кожне формулювання як новий, повністю тарифікований запит.…