Команда Qwen представила свою новую мультимодальную модель Qwen3.5-Omni, способную обрабатывать текст, изображения, аудио и видео, а также генерировать текст и речь в реальном времени. Модель доступна в трех вариантах — Plus, Flash и Light — через Offline API и Realtime API. Основное отличие от предшествующей версии Qwen3-Omni заключается в увеличении контекстного окна с 32 до 256 тысяч токенов, что позволяет обрабатывать до 10 часов аудио или 400 секунд видео в формате 720p за один запрос. Теперь распознавание речи поддерживает 113 языков и диалектов, а синтез — 36. Оба компонента архитектуры использовали Hybrid-Attention MoE и были предобучены на более чем 100 миллионах часов мультимодальных данных. Версия Plus показала выдающиеся результаты по многим аудио- и видео-бенчмаркам и обошла конкурентов по стабильности голоса. Среди новых функций — семантическое прерывание, клонирование голоса и управление эмоциями. Также появилось умение, позволяющее модели писать код по видеозаписи экрана с аудиоинструкциями без текстового промпта.
Самосвальные полуприцепы: техника для стройки и добычи инертных материалов
Строительные площадки, карьеры и дорожные работы формируют один из самых требовательных сегментов рынка грузовой техники — здесь полуприцепы работают в жёстких условиях: бездорожье, абразивные материалы, интенсивная эксплуатация и частые циклы…

