Открытый бенчмарк проверит, могут ли ИИ-агенты проектировать роботов
Вышел открытый бенчмарк, оценивающий способность ИИ-агентов проектировать работающих роботов, а не только писать код. Тест проверяет, как агенты справляются с задачами в физическом мире.
- Бенчмарк открытый и оценивает ИИ-агентов в робототехнике
- Тест проверяет работу агентов с физическим миром, а не только с кодом
- Кодинг-агенты уже почти автономно пишут и правят программы
Читать дальше
ИИ