GPT-6 Astra изглежда показва „скок в развитието“ в пространственото мислене според предварителни тестове
GPT-6 Astra изглежда представлява голям напредък в пространственото мислене. Нов роботизиран бенчмарк, наречен StationeryBench, противопоставя GPT-6 Astra на OpenAI на MolmoAct2 на Ai2 в пет задачи с предмети от бюро, като сваляне на капачка от маркер, изсипване на кламери или подаване на линийка между две роботизирани ръце. И двата модела управляват едни и същи двуръки роботи YAM в рамките на 200 изпитания. Astra завършва напълно 7 от 100 задачи; MolmoAct2 не завършва нито една. Медианният резултат за напредък на Astra достига 46 от 100, докато MolmoAct2 постига 12. Всички резултати, видеоклипове и код са налични в GitHub. OpenAI има дългосрочни планове да създаде собствени потребителски роботи.
Yoav Artzi, изследовател в областта на изкуствения интелект в Cornell и Google DeepMind, нарича Astra „скок в пространственото мислене“. Във все още непубликувания бенчмарк REMAP GPT-Astra достига точност, близка до човешкото ниво, макар че Artzi отбелязва: „дори ASTRA не достига това, което правят хората в други сценарии.“ Той предполага, че OpenAI е обучила модела с големи количества 3D данни, например сцени от Blender. Това съответства на специфичното подобрение на Astra при 3D задачите.
Новини за изкуствения интелект без сензация – подбрани от хора
Абонирайте се за THE DECODER и получете четене без реклами, седмичен бюлетин за изкуствения интелект, нашия ексклузивен шест пъти годишно доклад за новостите в сферата на изкуствения интелект „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.