AI News Watcher
Wednesday, Oct 7, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Oct 07, 2026 · 1 min read · Microsoft AI ← Back to feed

Microsoft Agent Lightning: AI-агенты учатся в бою — точность выросла на 14.6% daily

Фреймворк обучает сложных агентов прямо в Kubernetes, используя реальные системы, и требует минимум данных.

Microsoft Agent Lightning: AI-агенты учатся в бою — точность выросла на 14.6%
Редакция · Daily briefing

Обучение сложных AI-агентов методом Reinforcement Learning (RL) всегда сталкивалось с проблемой: тренировочная среда часто отличалась от боевой. Это требовало дорогих переделок и снижало эффективность. Microsoft Research Asia выпустила Agent Lightning v1.0 — фреймворк, который позволяет обучать агентов, используя их реальные системы развертывания, а не имитации.

Ключевое нововведение — парадигма Harnessed Agentic RL. Она позволяет тренировать агента, не переписывая его код под фреймворк. Это гарантирует, что обученный агент идентичен тому, что будет развернут, устраняя расхождения и дорогостоящие переделки между тренировочной и боевой версиями.

Фреймворк показал высокую эффективность: тестовый агент на базе Qwen3.5-9B, обученный с помощью Agent Lightning v1.0, повысил показатель Pass@1 на бенчмарке SWE-bench Verified с 41.8% до 56.4%. Это абсолютный прирост в 14.6 процентных пункта при использовании всего около 6000 обучающих примеров.

Agent Lightning v1.0 разработан как легковесное решение, содержащее около 3500 строк кода. Он имеет нативную поддержку Kubernetes, что позволяет запускать тренировочные процессы как стандартные Kubernetes-задания на любых кластерах, включая локальную инфраструктуру, без зависимости от платных коммерческих сервисов.

Agent Lightning v1.0 не просто предлагает новый фреймворк, а решает фундаментальную проблему практического применения RL для сложных AI-агентов, делая процесс обучения более реалистичным и эффективным. Однако в отчете не указано, насколько легко фреймворк интегрируется с уже существующими нестандартными системами мониторинга и логирования, используемыми в продакшене.

Дополнительные источники

  1. microsoft/agent-lightning - GitHub
  2. Acme: A new framework for distributed reinforcement learning
  3. google-deepmind/acme - GitHub
  4. Habitat: A Platform for Embodied AI Research
  5. neurohive.io

Источники

  1. https://www.microsoft.com/en-us/research/blog/agent-lightning-v1-0-a-3500-line-lightweight-agentic-rl-framework-for-training-agents-with-real-harnesses/ external
→ Опубликовано в Telegram: @agentic_ai_news/1162