Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новин · усі джерела

MarkTechPost

IFM випустила K2 Horizon: шість моделей за ліцензією Apache 2.0 — від 0,9 млрд до 375 млрд

Більшість релізів відкритих моделей містять одну контрольну точку й таблицю з результатами бенчмарків. Минулого тижня Institute of Foundation Models (IFM) представила дещо масштабніше. IFM — лабораторія передових моделей, заснована MBZUAI у травні 2025 року. K2 Horizon — набір із шести…

MarkTechPost

H Company випустила NeoMME: сімейство однобаштових мультимодальних енкодерів на 260 млн і 800 млн параметрів, які відмовляються від візуальної башти та каузального декодера

Розглядаємо NeoMME — сімейство двонапрямлених енкодерів на 260 млн і 800 млн параметрів від H Company. На відміну від ретриверів у стилі ColPali, воно обробляє багатомовні текстові токени та необроблені патчі зображень 32×32 в одному Transformer, без попередньо навченої візуальної башти та без каузального…

MarkTechPost

Meta FAIR представляє моделі уподобань для досліджень ШІ (RPMs): ранжування ML-експериментів до витрачання GPU-годин

Агенти досліджень ШІ можуть запропонувати набагато більше експериментів, ніж можуть собі дозволити провести. Meta FAIR, Oxford і UCL представляють моделі уподобань для досліджень ШІ — заморожені судді на базі LLM, які ранжують 15 невиконаних кандидатів і виконують лише один. На AIRS-Bench, …

MarkTechPost

Дослідники UC Berkeley представили CUA-Lite — відкриту платформу, що об’єднує пісочниці, дані, оцінювання та RL для агентів, які працюють із комп’ютером

Для навчання та бенчмаркінгу агента, який працює з комп’ютером, потрібні чотири речі — агенти, середовища, трейси та фреймворк для їхнього оцінювання й навчання, — але сьогодні всі чотири постачаються в несумісних форматах. CUA-Lite, створена командою під керівництвом UC Berkeley, об’єднує їх за…

MarkTechPost

Perplexity докладно описує свій стек ембедингів на GPU: як Ivy, Tulip і ROSE обслуговують pplx-embed

Якість пошуку в продукті для пошуку на основі ШІ обмежена двома чинниками: наскільки хороша модель ембедингів і наскільки дешево її можна запускати на індексі. Цього тижня команда Perplexity Engineering опублікувала Fast Embeddings on GPUs — детальний огляд внутрішньої роботи…

MarkTechPost

GitHub представляє Project HydraFusion: оркестрація кількох моделей під час виконання, що створює окремий робочий процес для кожного завдання з кодування в Copilot CLI

Ми розглядаємо Project HydraFusion — дослідницьку попередню версію GitHub, яка трактує вибір робочого процесу як задачу оптимізації, а не як вибір моделі. Ми розбираємо три шаблони виконання, між якими система маршрутизує завдання: Single, Cascade із порогом якості та Critique…

MarkTechPost

Nous Research додала налаштування локальних моделей одним кліком у Hermes Desktop

Nous Research звела налаштування локальної моделі до одного кліку в Hermes Desktop. Застосунок зчитує дані про ваше обладнання, перевіряє сумісність каталогу з вашим GPU, обирає найякіснішу збірку, яка підходить, завантажує її та налаштовує llama.cpp — із жорстким…

MarkTechPost

Adaption Labs представляє «Invent a Dataset»: навчальні дані генеруються з опису завдання, а не з початкового корпусу

Adaption Labs випустила Invent a Dataset, який генерує структурований набір даних, готовий для навчання, на основі опису поведінки, якої ви хочете навчити модель. Немає початкового корпусу, розроблення схеми чи посібника з розмітки. Один datasets.invent…

MarkTechPost

NVIDIA випускає Personal AI Router (PAIR): віртуальний маршрутизатор інференсу з відкритим кодом, що розподіляє локальні запити до ШІ між вузлами RTX, DGX Spark і Mac

Ми розглядаємо NVIDIA Personal AI Router (PAIR) — віртуальний маршрутизатор інференсу з відкритим кодом, який розподіляє локальні запити до ШІ між комп’ютерами, уже підключеними до домашньої мережі. Ми розповідаємо, як PAIR проксує наявні кінцеві точки Ollama і LM Studio, щоб агент…

MarkTechPost

WeatherNext 3 від Google DeepMind навчається на спостереженнях метеостанцій, щоб надавати глобальні прогнози з роздільною здатністю 5 км, які оновлюються щогодини

WeatherNext 3 обробляє актуальні мозаїки геостаціонарних супутників, оновлюється щогодини та надає прогнози з роздільною здатністю 5 км у Search, Gemini і Maps.

MarkTechPost

OpenAI випустила GPT-6 Astra: модель для роботи з комп’ютером із контекстом у 1,05 млн токенів, доступна після «критичного» кіберпорогу

OpenAI випустила GPT-6 Astra 3 вересня 2026 року, позиціонуючи її як флагманську модель для роботи з комп’ютером, а не як чат-модель. Компанія повідомляє про результат 72,6% в OSWorld V2-Offline, замінює стискання контексту в Codex на нотатки з можливістю пошуку та пропонує контекст у 1,05 млн токенів за ціною $10/$50 за мільйон…