Post #8686

@ai_machinelearning_big_data

Machinelearning

Просмотры31,600Количество просмотров

Опубликован3 окт.03.10.2025, 09:47

Содержимое поста

Содержимое

⚡️ Релиз Agent S3 - продвинутый агент для работы с компьютером, который приближается к человеческому уровню. Вместо того, чтобы усложнять одну модель, авторы запускают несколько агентов параллельно и затем выбирают лучший результат. Метод назвили **Behavior Best-of-N (bBoN). Как работает: - Каждый агент пробует решить задачу. - Его действия переводятся в поведенческий нарратив - короткое описание, что реально изменилось на экране. - Специальный судья сравнивает эти нарративы и выбирает лучший. Результаты: - GPT-5 с 10 параллельными агентами → 69.9% успеха - Для примера у GPT-5 Mini → 60.2% - Agent S3* набирает на +10% выше предыдущей SOTA 📄Paper: http://arxiv.org/abs/2510.02250 💻Code: http://github.com/simular-ai/Agent-S 📝Blog: http://simular.ai/articles/agent-s3 @ai_machinelearning_big_data #AI#Agents#AgentS3#OSWorld#SimularAI#LLM