Стартап Thinking Machines Lab, созданный Мирой Мурати, экс-техническим директором OpenAI, представил свою первую демонстрацию инновационной модели, которая позволяет пользователям взаимодействовать в формате живого разговора. В отличие от традиционных систем, новая модель реагирует на слова и жесты почти мгновенно, с задержкой всего 0,4 секунды, что значительно быстрее, чем у аналогов GPT-realtime-2.0 и Gemini-3.1-flash-live.
Команда объяснила, что стандартные модели не подходят для живого общения, так как они работают по очереди и не могут воспринимать окружающую обстановку. Thinking Machines отказалась от традиционной схемы вопрос-ответ, заменив её на потоковую обработку, что позволяет модели обрабатывать аудио и видео параллельно. В основе системы лежит разреженная архитектура с 276 миллиардами параметров, где активны только 12 миллиардов на каждом шаге.
На тестах TML-Interaction-Small показала отличные результаты, обойдя конкурентов в задачах живого взаимодействия и визуальной проактивности. Доступ к моделям пока ограничен, однако в ближайшие месяцы планируется открытие ограниченного превью для сборки обратной связи перед полноценным релизом.

