Новости ИИ — 23 июля 2026
11 материал(ов) за день · искусственный интеллект

За 23 июля 2026 в ленте 11 материалов о развитии ИИ. Главное — ChatGPT Voice на ПК: управляй компьютером и агентами без клавиатуры. Также: Together AI: открытые модели в продакшене — полный контроль без сборки стека; Ling-3.0-flash: 262K токенов контекста — и бесплатно на OpenRouter.
ChatGPT Voice на ПК: управляй компьютером и агентами без клавиатуры
Голосовое управление теперь координирует работу агентов в Codex и ChatGPT Work — и меняет взаимодействие с ПК.
Together AI: открытые модели в продакшене — полный контроль без сборки стека
Готовые профили, тесты на реальном трафике и быстрый старт — чтобы продакшен не ломался.
Ling-3.0-flash: 262K токенов контекста — и бесплатно на OpenRouter
Модель от InclusionAI (поддержанной Ant Group) открывает доступ к огромному контексту — но его заполнение может снизить точность.
ИИ-агенты GitHub Issues: объясняют свои действия и ждут одобрения
Человек решает, что делать автоматизации — теперь с оценкой уверенности и обоснованием каждого шага.
Claude Opus теперь слушает и действует — в Slack и Gmail
модели Claude теперь доступны голосом — и умеют управлять внешними сервисами, но пока ждёт вашей очереди.
Runway Model Router: ИИ сам подберёт модель для видео, фото, аудио — по скорости, цене или качеству
Снимает с разработчиков выбор модели вручную: достаточно указать приоритеты.
ChatGPT Health: ваш диагноз увидит ИИ, а не HIPAA
Сервис подключает медицинские записи и данные Apple Health — но в отличие от врача, чатбот не подпадает под HIPAA.
Black Forest Labs FLUX 3: один ИИ для видео и роботов
Модель учится физике мира, чтобы одинаково хорошо создавать видео и управлять роботами.
Tencent Hunyuan выпустила Hy-MT2: мощный переводчик работает без облака и обходит коммерческие API
Экстремальная квантизация до 1.25 бит сжимает модель до 440 МБ и ускоряет в полтора раза — для работы на устройствах через GGUF.
Nunchaku Lite в Diffusers: 4-битные модели стали вдвое легче
Веса и активации квантуются до 4 бит, чтобы модели работали быстрее, а не только занимали меньше памяти.
Replicate упёрся в потолок H100: модели стояли в очередях
Десять часов простоя показали, что даже крупные платформы уязвимы к дефициту топовых GPU.