Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%

MarkTechPost

208 новини · всички източници

MarkTechPost

IFM представи K2 Horizon: шест модела по Apache 2.0 от 0,9 млрд. до 375 млрд.

Повечето представяния на отворени модели включват един контролен пункт и таблица с бенчмаркове. Миналата седмица Institute of Foundation Models (IFM) представи нещо по-мащабно. IFM е лабораторията за водещи модели, създадена от MBZUAI през май 2025 г. K2 Horizon е набор от шест…

MarkTechPost

H Company представя NeoMME: семейство от еднобашови мултимодални енкодери с 260 млн. и 800 млн. параметра, които премахват визуалната кула и каузалния декодер

Разглеждаме NeoMME, семейство от двупосочни енкодери с 260 млн. и 800 млн. параметра от H Company. За разлика от ретривърите в стил ColPali, то обработва многоезични текстови токени и необработени фрагменти от изображения 32×32 в един Transformer, без предварително обучена визуална кула и без каузален…

MarkTechPost

Meta FAIR представя модели за предпочитания в ИИ изследванията (RPMs): класиране на ML експерименти преди изразходването на GPU часове

Агентите за изследвания в областта на ИИ могат да предложат много повече експерименти, отколкото могат да си позволят да изпълнят. Meta FAIR, Oxford и UCL представят модели за предпочитания за изследвания в ИИ — замразени LLM съдии, които класират 15 неизпълнени кандидата и изпълняват само един. В AIRS-Bench, …

MarkTechPost

Изследователи от UC Berkeley представиха CUA-Lite — отворена платформа, обединяваща пясъчници, данни, оценяване и RL за агенти, използващи компютър

Обучението и бенчмаркингът на агент, използващ компютър, изискват четири неща — агенти, среди, трасета и рамка за оценяване и обучение — а днес и четирите се предоставят в несъвместими формати. CUA-Lite, разработена от екип под ръководството на UC Berkeley, ги обединява зад…

MarkTechPost

Perplexity представя подробно своя GPU стек за ембединг: как Ivy, Tulip и ROSE обслужват pplx-embed

Качеството на извличането в продукт за търсене с изкуствен интелект е ограничено от две неща: колко добър е моделът за ембединг и колко евтино може да се изпълнява върху индекс. Тази седмица екипът на Perplexity Engineering публикува Fast Embeddings on GPUs — поглед отвътре…

MarkTechPost

GitHub представя Project HydraFusion: оркестрация на множество модели по време на изпълнение, която изгражда работен процес за всяка задача за кодиране в Copilot CLI

Разглеждаме Project HydraFusion, изследователската предварителна версия на GitHub, която разглежда избора на работен процес като оптимизационен проблем, а не като избор на модел. Разясняваме трите модела на изпълнение, между които маршрутизира — Single, Cascade с праг за качество и Critique…

MarkTechPost

Nous Research добавя настройка на локални модели с едно кликване в Hermes Desktop

Nous Research сведе настройката на локален модел до едно кликване в Hermes Desktop. Приложението разпознава хардуера ви, проверява съвместимостта на каталога с вашия GPU, избира най-висококачествената версия, която се побира, изтегля я и конфигурира llama.cpp — с твърдо…

MarkTechPost

Adaption Labs представя „Invent a Dataset“: обучаващи данни, генерирани от описание на задача, а не от изходен корпус

Adaption Labs пусна Invent a Dataset, който генерира структуриран, готов за обучение набор от данни въз основа на описание на поведението, което искате моделът да научи. Няма изходен корпус, проектиране на схема или ръководство за анотиране. Един datasets.invent…

MarkTechPost

NVIDIA пуска Personal AI Router (PAIR): виртуален рутер за инференс с отворен код, който разпределя локалните AI заявки между възли с RTX, DGX Spark и Mac

Разглеждаме NVIDIA Personal AI Router (PAIR) — виртуален рутер за инференс с отворен код, който разпределя локалните AI заявки между машините, налични в домашната мрежа. Разглеждаме как PAIR проксира съществуващите крайни точки на Ollama и LM Studio, така че агент…

MarkTechPost

WeatherNext 3 на Google DeepMind се обучава с наблюдения от метеорологични станции, за да предоставя глобални прогнози с резолюция 5 км, обновявани на всеки час

WeatherNext 3 обработва в реално време мозайки от геостационарни спътници, обновява се на всеки час и предоставя прогнози с резолюция 5 км в Search, Gemini и Maps.

MarkTechPost

OpenAI пуска GPT-6 Astra: модел за работа с компютър с контекст от 1,05 млн. токена, достъпен след „критичен“ киберпраг

OpenAI пусна GPT-6 Astra на 3 септември 2026 г., позиционирайки го като водещ модел за работа с компютър, а не като чат модел. Компанията отчита 72,6% на OSWorld V2-Offline, заменя компактирането в Codex с бележки с възможност за търсене и предлага контекст от 1,05 млн. токена на цена $10/$50 за милион…