Sakhanda Wire
NVDA $233.95 +1.34% MSFT $517.53 +0.92% GOOGL $343.50 +1.56% META $728.08 +0.30% AMZN $251.52 +1.33%

Последни новини

По-стари новини

TechCrunch

Водещите лаборатории за ИИ все още не казват как биха ограничили неконтролируем модел

Ново проучване установява, че водещите лаборатории за ИИ имат малко публично документирани планове за ограничаване на неконтролируеми модели, което повдига въпроси за готовността им, тъй като системите с ИИ все по-често демонстрират неочаквано и потенциално опасно поведение.

MarkTechPost

Курсът на Decoding AI с отворен код очертава три начина за стартиране на агентски цикъл и икономиката на доставчиците зад всеки от тях

Повечето екипи приемат „кой модел“ за важното решение. Литературата за harness инженеринг обаче постоянно насочва към нещо друго. В експеримента на LangChain с Terminal-Bench промяната само на harness-а — при един и същ модел през цялото време — изкачи кодиращ агент от приблизително 30-о място в топ 5. Този резултат…

The Decoder

Проучване обяснява защо AI агентите имат полза от „умения“ и кога се провалят

Проучване на изследователи от Принстънския университет и Калифорнийския университет в Сан Диего установява, че т.нар. умения правят AI агентите по-добри главно чрез структурирани работни процеси, а не чрез добавени знания. Но с нарастването на библиотеката от умения на агентите им става все по-трудно…

The Decoder

Netflix тества езиков модел като алтернатива на ръчно изградена логика за препоръки

Netflix сравни своята съществуваща от години система за препоръки с вътрешен езиков модел, наречен GenRec, и заяви, че е получил по-добри резултати. Вместо да разчита на хиляди ръчно създадени характеристики, GenRec преобразува поведението при гледане в обикновен текст. Самата Netflix го нарича „ранен…

The Decoder

Психометрични методи разкриват сериозни слабости в тестването на сигурността на ИИ

Изследователи от британския Институт за сигурност на ИИ използваха психометрични методи, за да покажат, че популярните бенчмаркове за безопасност на езиковите модели не измерват една-единствена постоянна характеристика. Безразборното блокиране на заявки може изкуствено да повиши оценката за безопасност, дори когато моделът става по-малко…

MarkTechPost

Най-добрите GPU неооблаци за 2026 г.: CoreWeave, Nebius, Lambda, Crusoe и Groq, класирани според публикуваните цени и договорената мощност

Петте най-големи GPU неооблака вече работят по съвсем различни модели. CoreWeave и Nebius подават отчети до SEC; Lambda и Crusoe са частни компании и се насочват към IPO; Groq се преобразува в облак за инференс, след като лицензира своята LPU технология на…

TechCrunch

Opus 4.6 на Anthropic е машина за порно

Anthropic забранява на своите модели Claude да генерират сексуално експлицитно съдържание. Но серия от тестове на TechCrunch показа, че не е нужно много, за да бъде заобикраничено ограничението.

MarkTechPost

Изграждане на агентни конвейери за интелигентна обработка на документи: създаване на научни фигури с AutoFigure

Този урок разглежда AutoFigure — практичен набор от инструменти за генериране на професионални научни фигури директно от текстови описания и научни публикации. Показваме как се настройва средата, конфигурира се работен процес за генериране чрез API и сложни конвейери за интелигентна обработка на документи се преобразуват в диаграми в стил научни публикации,…

The Verge

Над 1 милион души са натиснали бутона за AI slop в LinkedIn

LinkedIn действително обяви бутон „Изглежда като AI slop“ на 30 юли, а компанията казва, че много хора вече са го използвали. Според публикация от четвъртък на главния продуктов директор Хари Сринивасан „над един милион души“…

MarkTechPost

Anthropic внедрява Claude Mythos 5 в Claude Security: корпоративните екипи получават водещо сканиране за уязвимости без пряк достъп до модела

Anthropic премести най-способния си модел за киберсигурност в продукт, който екипите по сигурността могат да активират сами. Сканиранията в Claude Security вече работят с Claude Mythos 5, който е в публична бета за клиентите на Claude Enterprise без отделен добавъчен пакет за модела. Сканирането се свързва…