AI News Watcher
Monday, Aug 24, 2026  ·  Daily briefing
Feed Telegram
Daily briefing · By AI News Watcher · Aug 24, 2026 · 2 min read · OpenAI ← Back to feed

GPT-5.6 теперь строит код как агент — и сам его проверяет daily

Модель GPT-5.6, интегрированная в Kiro, берёт на себя весь цикл разработки — от требований до тестов; на бенчмарках Terminal-Bench 2.1 она показала 75-78% точности.

GPT-5.6 теперь строит код как агент — и сам его проверяет
Редакция · Daily briefing

Когда речь заходит об ИИ в разработке, обычно имеется в виду автодополнение или генерация кода по запросу. OpenAI с выпуском GPT-5.6 переосмысливает эту роль: теперь модель может взять на себя весь цикл создания программы, действуя как полноценный инженер-агент. Она уже доступна в Kiro — платформе для так называемой «агентской инженерии».

Платформа Kiro позиционируется как среда для агентской инженерии, где ИИ-агенты не просто пишут код, а выполняют комплексные задачи по разработке. Kiro превращает запросы в исполняемые спецификации, проверяет корректность кода и работает с крупными кодовыми базами с помощью параллельных агентов.

Возможности Kiro, теперь с GPT-5.6:

На бенчмарке Terminal-Bench 2.1, который оценивает системы на основе моделей-агентов, OpenAI представила две версии GPT-5.6. GPT-5.6 Terra достигла точности 78.4%, а GPT-5.6 Luna — 75.7%. Это позволяет модели конкурировать с другими крупными игроками, хотя лидерство пока удерживает Claude Code с Claude 5 Fable, показавший 83.8%.

По словам президента и сооснователя OpenAI Грега Брокмана, компания развила способность делать долгосрочные исследовательские ставки и анонсировала «новый способ выполнения интеллектуальной работы». Этот релиз GPT-5.6 в Kiro, а также демонстрация голосового агента в Codex для работы без клавиатуры на настольных и мобильных устройствах, подтверждают стратегию OpenAI по созданию более автономных и многоэтапных ИИ-систем, способных автоматизировать не только отдельные части, но и весь цикл разработки.

Переход к агентской инженерии с GPT-5.6 — это попытка OpenAI автоматизировать разработку от начала до конца, а не только её отдельные этапы. Однако на ключевых бенчмарках модель пока уступает лидерам, что означает необходимость дальнейших улучшений для её широкого внедрения в производственные процессы.

Дополнительные источники

  1. https://kiro.dev
  2. https://snorkel.ai/leaderboard/terminal-bench-2-1/
  3. https://developers.openai.com/api/docs/guides/code-generation
  4. models

Источники

  1. https://x.com/gdb/status/2091745169221787681 external
  2. https://x.com/gdb/status/2091861755253371243 external
  3. https://x.com/OpenAIDevs/status/2091966982015103068 external
  4. https://x.com/OpenAIDevs/status/2091980673808728184 external
  5. https://x.com/OpenAIDevs/status/2091995301397893501 external
→ Опубликовано в Telegram: @agentic_ai_news/909