GPT-6 Astra, похоже, демонстрирует «качественный скачок» в пространственном мышлении по результатам предварительных тестов
GPT-6 Astra, судя по всему, совершила большой скачок в области пространственного мышления. Новый робототехнический бенчмарк под названием StationeryBench сравнивает GPT-6 Astra от OpenAI и MolmoAct2 от Ai2 в пяти задачах с объектами на столе, таких как снятие колпачка с маркера, высыпание скрепок или передача линейки между двумя роботизированными манипуляторами. Обе модели управляли одинаковыми роботами YAM с двумя манипуляторами в ходе 200 испытаний. Astra полностью выполнила 7 из 100 задач; MolmoAct2 не выполнила ни одной. Медианный показатель прогресса Astra достиг 46 из 100, тогда как MolmoAct2 набрала 12. Все результаты, видео и код доступны на GitHub. У OpenAI есть долгосрочные планы по созданию собственных потребительских роботов.
Йоав Арци, исследователь ИИ из Корнеллского университета и Google DeepMind, называет Astra «скачком в пространственном мышлении». В ещё не опубликованном бенчмарке REMAP GPT-Astra достигает точности, близкой к человеческому уровню, хотя Арци отмечает, что «даже ASTRA не достигает того, чего достигают люди в других сценариях». Он предполагает, что OpenAI обучала модель на больших объёмах 3D-данных, например сценах из Blender. Это согласуется с заметным улучшением Astra именно в задачах, связанных с 3D.
Новости об ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный обзор передовых разработок «AI Radar» шесть раз в год, иметь полный доступ к архиву и разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.