Компания Thinking Machines Lab, основанная экс-техническим директором OpenAI Мирой Мурати, представила свою первую демонстрацию новой модели, которая обеспечивает живое взаимодействие с пользователями. Особенностью является задержка в 0,4 секунды между репликой пользователя и ответом модели, что значительно быстрее, чем у конкурентов — GPT-realtime-2.0 и Gemini-3.1-flash-live.
В блоге команда объясняет, что традиционные модели неэффективны для живого диалога, так как работают по очереди, не воспринимая взаимодействие в реальном времени. Thinking Machines отказалась от этого подхода и использует потоковую обработку, разбивая входящие данные на 200-миллисекундные куски, что позволяет параллельно обрабатывать аудио и генерировать ответы.
Модель состоит из двух частей: TML-Interaction-Small, которая работает в реальном времени, и фоновой модели, которая выполняет более сложные задачи. На тестах TML показала лучшие результаты в сравнении с конкурентами. Доступ к модели предоставлен ограниченному числу партнеров, с планами на открытие превью в ближайшие месяцы.
