Sakhanda Wire
NVDA $233.95 +1.34% MSFT $517.53 +0.92% GOOGL $343.50 +1.56% META $728.08 +0.30% AMZN $251.52 +1.33%

Останні новини

Давніші новини

TechCrunch

Провідні лабораторії ШІ досі не кажуть, як стримували б неконтрольовану модель

Нове дослідження показало, що провідні лабораторії ШІ мають небагато публічно задокументованих планів щодо стримування неконтрольованих моделей, що викликає питання про їхню готовність, оскільки системи ШІ дедалі частіше демонструють неочікувану й потенційно небезпечну поведінку.

MarkTechPost

Курс Decoding AI з відкритим вихідним кодом описує три способи запуску циклу агента та економіку провайдерів кожного з них

Більшість команд вважає вибір моделі найважливішим рішенням. Однак література з harness-інжинірингу постійно вказує на інше. В експерименті LangChain із Terminal-Bench зміна лише harness — за незмінної моделі протягом усього тесту — підняла кодинг-агента приблизно з 30-го місця до топ-5. Цей результат…

The Decoder

Дослідження пояснює, чому ШІ-агенти виграють від «навичок» і коли зазнають невдач

Дослідження науковців із Принстонського університету та Каліфорнійського університету в Сан-Дієго показує, що так звані навички підвищують ефективність ШІ-агентів переважно завдяки структурованим робочим процесам, а не доданим знанням. Але зі зростанням бібліотеки навичок агентам стає дедалі важче…

The Decoder

Нові AI-окуляри RayNeo відмовляються від камери й зосереджуються на текстових накладеннях

RayNeo випускає нову гарнітуру без камери та динаміків. Стаття «Нові AI-окуляри RayNeo відмовляються від камери й зосереджуються на текстових накладеннях» уперше вийшла в The Decoder.

The Decoder

Netflix тестує мовну модель як альтернативу вручну створеній логіці рекомендацій

Netflix порівняла свою багаторічну систему рекомендацій із розробленою всередині компанії мовною моделлю GenRec і заявила, що отримала кращі результати. Замість того щоб покладатися на тисячі створених вручну ознак, GenRec перетворює поведінку під час перегляду на звичайний текст. Сама Netflix називає її «ранньою…

The Decoder

Психометричні методи виявили серйозні слабкі місця в тестуванні безпеки ШІ

Дослідники з британського Інституту безпеки ШІ використали психометричні методи, щоб показати: популярні бенчмарки безпеки мовних моделей не вимірюють одну сталу характеристику. Суцільне блокування запитів може штучно підвищити оцінку безпеки, навіть коли модель стає менш…

MarkTechPost

Найкращі GPU-неохмари 2026 року: CoreWeave, Nebius, Lambda, Crusoe і Groq — рейтинг за опублікованими цінами та законтрактованими потужностями

П’ять найбільших GPU-неохмар тепер працюють за дуже різними моделями. CoreWeave і Nebius звітують перед SEC; Lambda і Crusoe є приватними компаніями та рухаються до IPO; Groq перебудувала себе на інференс-хмару після ліцензування своєї LPU-технології…

TechCrunch

Opus 4.6 від Anthropic — машина для порно

Anthropic забороняє своїм моделям Claude генерувати відверто сексуальний контент. Але серія тестів, проведених TechCrunch, показала, що для обходу цього обмеження багато не потрібно.

MarkTechPost

Створення агентних конвеєрів для інтелектуальної роботи з документами: наукові ілюстрації за допомогою AutoFigure

У цьому посібнику розглядається AutoFigure — практичний набір інструментів для створення професійних наукових ілюстрацій безпосередньо з текстових описів і наукових статей. Ми покажемо, як налаштувати середовище, сконфігурувати робочий процес генерації через API та перетворити складні конвеєри інтелектуальної роботи з документами на діаграми у стилі наукових публікацій,…

The Verge

Понад 1 мільйон людей натиснули кнопку LinkedIn «Схоже на ШІ-шлак»

LinkedIn справді оголосила про кнопку «Схоже на ШІ-шлак» 30 липня, і компанія повідомляє, що нею вже скористалося багато людей. За словами директора з продукту Харі Шрінівасана в дописі в четвер, «понад мільйон людей»…

MarkTechPost

Anthropic переносить Claude Mythos 5 у Claude Security: корпоративні команди отримують передове сканування вразливостей без прямого доступу до моделі

Anthropic перенесла свою найпотужнішу модель для кібербезпеки в продукт, який команди безпеки можуть самостійно ввімкнути. Сканування в Claude Security тепер працює на Claude Mythos 5, доступній у публічній бета-версії для клієнтів Claude Enterprise без окремого додатка для моделі. Сканування підключається…