Пока большинство мультимодальных моделей ограничиваются текстом и изображениями, на OpenRouter появилась Perceptron Mk1.5, которая расширяет восприятие ИИ до аудио и видео. Это делает её одной из самых "чувствительных" моделей на платформе, способной комплексно воспринимать мир.
Perceptron Mk1.5 выделяется на фоне конкурентов своей способностью обрабатывать сразу четыре типа входных данных: текст, изображения, аудио и видео, выдавая при этом текстовый ответ. Это отличает её от моделей вроде LLaVA-1.5, которые фокусируются в основном на тексте и изображениях.
Модель предлагает инженерам внушительное контекстное окно в 36864 токена, что позволяет анализировать сложные и длинные мультимедийные последовательности. Например, целые видеофрагменты или аудиозаписи можно обрабатывать, сохраняя широкий контекст беседы.
Появление Perceptron Mk1.5 на OpenRouter усиливает конкуренцию среди мультимодальных моделей на платформе. Здесь уже представлены такие игроки, как DeepSeek V4.1 Flash и GPT-5.6 Luna, предлагающие свои уникальные архитектуры и оптимизации.
Интеграция Perceptron Mk1.5 в OpenRouter — шаг к созданию по-настоящему универсальных ИИ, способных обрабатывать разнообразные сенсорные данные. Однако пока неясно, как её производительность и стоимость соотносятся с лидерами рынка, чьи модели доминируют в рейтингах использования.