Sakhanda Wire
NVDA $237.17 +2.73% MSFT $517.69 +0.95% GOOGL $344.54 +1.86% META $733.79 +1.08% AMZN $252.72 +1.81%

MarkTechPost

208 новин · усі джерела

MarkTechPost

DeepSeek AI випустила DeepSeek Harness у попередній версії для розробників: ліцензована за MIT оболонка для агентів, де все є плагіном

DeepSeek Harness v0.1 — ліцензована за MIT оболонка для агентів, де кожна можливість є плагіном Cordis. Чотири режими виконання, журнали сесій лише з додаванням і маршрутизація моделей, незалежна від провайдера.

MarkTechPost

Дообучення LLM із викликом інструментів: повний посібник із XYZ-Aquila-SFT і Qwen3

Реалізуйте наскрізний конвеєр дообучення мовних моделей із викликом інструментів. Посібник охоплює розбір траєкторій, структуроване вилучення викликів інструментів, формування представлення у сумісному з Qwen форматі ChatML та ефективну адаптацію LoRA за допомогою PyTorch.

MarkTechPost

Z.ai випустила GLM-5.3 без перенавчання базової моделі: краще виконує складне програмування та завдання з довгим горизонтом

Z.ai випустила GLM-5.3 14 серпня 2026 року. Модель повторно використовує незмінену базову модель GLM-5.2 на 743 млрд параметрів. Увесь заявлений приріст забезпечило масштабоване постнавчання: більше середовищ для завдань із довгим горизонтом, більше типів середовищ і триваліше навчання. Результат у Terminal-Bench 3.0 зріс із 4,6 до 28,3, а DeepSWE…

MarkTechPost

Зустрічайте Needle 2: відкрита модель із 45 млн параметрів для виклику інструментів, що постачається як бінарний файл розміром 14 МБ і запускає повну сесію в 28 МБ оперативної пам’яті

Cactus Compute випустила Needle 2 — відкриту модель із 45 млн параметрів для виклику інструментів, роботи з пристроями та структурованого вилучення даних. Повна модель — це єдиний бінарний файл розміром 14 МБ, який запускає сесію приблизно у 28 МБ оперативної пам’яті. Вона лідирує в обох сплітах Seal-Tools, водночас…

MarkTechPost

Створення LLM, орієнтованої на міркування: практичний посібник зі потокового завантаження, відбору та донавчання корпусу міркувань SupraLabs

Цей посібник описує повний робочий процес створення компактної мовної моделі, орієнтованої на міркування. Завантажуючи корпус міркувань SupraLabs із Hugging Face у потоковому режимі, ми застосовуємо фільтри якості та відбираємо дані для контрольованого донавчання (SFT). Використовуючи SmolLM2-135M-Instruct і LoRA, ми демонструємо…

MarkTechPost

Google AI щойно випустила Gemini 3.7 Flash: модель для програмування й агентів за ціною $0,75 за 1 млн вхідних токенів

Google випустила Gemini 3.7 Flash — вдосконалену версію Gemini 3.6 Flash з алгоритмічними покращеннями ядра міркувань. Модель працює з текстом, зображеннями, аудіо та відео в контекстному вікні на 1 млн токенів із вихідними даними обсягом до 64 тис. токенів і підтримує налаштовувані конфігурації мислення. Програмування…

MarkTechPost

Liquid AI випустила LFM2.5-VL-3B: 3B-модель для роботи із зображеннями й мовою, що читає екрани, локалізує об’єкти та викликає інструменти на пристрої

Liquid AI випустила LFM2.5-VL-3B — модель для роботи із зображеннями й мовою з 3,1 млрд параметрів, створену для розгортання на пристроях. У середньому вона набирає 80,7 бала в ScreenSpot-v2 і підвищує результат локалізації об’єктів у RefCOCO з 57,1 до 87,9. Виклик функцій є новою можливістю для лінійки VL, а результат у ToolSandbox зріс із 26,4 до 59,5…

MarkTechPost

Dyna Robotics представила Dyna-2: модель дій у світі, попередньо навчену на 1 мільйоні годин людського відео

Dyna Robotics випустила Dyna-2 — модель дій у світі, попередньо навчену на понад мільйоні годин егоцентричного відео людей. У технічному звіті встановлено три результати: закон масштабування на людських даних до 1 млн годин, перше перенесення цього закону…

MarkTechPost

SpaceXAI випустила Grok 4.6: передову модель із контекстом 500K, оптимізовану для агентів із тривалим виконанням, програмування та роботи зі знаннями

SpaceXAI випустила Grok 4.6 12 серпня 2026 року — це посттренувальне оновлення Grok 4.5, а не більша базова модель. Вона зрівнялася з GPT-5.6 Sol Max, набравши 61 бал в Artificial Analysis Intelligence Index, отримала контекст 500K і новий режим xhigh…

MarkTechPost

Посттренування Tulu 3 за допомогою AllenAI Open Instruct із SFT, DPO, RLVR, GRPO та оцінюванням на основі верифікатора

Створіть власний конвеєр посттренування LLM за допомогою фреймворку Open Instruct від AllenAI. Цей вичерпний посібник розповідає про контрольоване донавчання (SFT), пряму оптимізацію вподобань (DPO) та навчання з підкріпленням на основі перевірюваних винагород (GRPO), оптимізоване для ефективної роботи на обладнанні з 16 ГБ без потреби у важкому…

MarkTechPost

NVIDIA AI випустила Nemotron 3.5 Lightning: відкриту MoE-модель на 30 млрд параметрів із 3 млрд активних параметрів і NeMo Switchyard Model Router

Відкрита 30-мільярдна MoE-модель NVIDIA орієнтована на рівень виконання завдань агентами, а Switchyard спрямовує кожен крок до найдешевшої придатної моделі.

MarkTechPost

MiLM Plus від Xiaomi представляє PROVE: узгоджені зі сприйняттям метрики видалення об’єктів RC-S і RC-T із реалістичним відеобенчмарком

Моделі видалення об’єктів удосконалювалися швидше, ніж метрики, які використовують для їх оцінювання. Дифузійні інструменти видалення тепер переконливо відновлюють тіні, відбиття та закриту структуру, однак PSNR, SSIM, LPIPS, ReMOVE і CFD часто неправильно ранжують їхні результати. Корінь проблеми…