Тест устойчивости: как шесть ИИ-фреймворков переживают восемь сломанных вызовов инструментов
Проект agentic-arena прогнал восемь сценариев сбоев вызовов инструментов через шесть агентных фреймворков. pydantic_ai, microsoft_af и smolagents восстановились во всех 8 случаях, langgraph и openai_agents — в 7, google_adk — в 6. smolagents тратит до 6 вызовов LLM на четырёх сбоях против 2 у остальных.
- Восемь сбоев: битый JSON, несуществующий инструмент, пропущенный аргумент, null вместо объекта
- pydantic_ai, microsoft_af и smolagents прошли 8/8, langgraph и openai_agents — 7/8
- google_adk — 6/8: необработанные исключения на res-01 и res-02
- smolagents тратит 6 вызовов LLM на четырёх сбоях — в 2,7 раза больше токенов
Читать дальше
ИИ