Qwen выпустила модель для работы с аудио и видео через агентов
Alibaba представила Qwen3.8-Omni-Flash — мультимодальную модель, которая принимает текст, изображения, аудио и видео, анализирует их и управляет инструментами для решения задач. Модель может расшифровывать записи встреч, создавать видеоклипы из аудио, генерировать навыки на основе скриншотов рабочего экрана и добавлять дубляж или субтитры к видео.
Одновременно Qwen открыла исходный код своего harness — инструмента для работы с моделью.
Источник: GPT/ChatGPT/AI Central Александра Горного
Новости этого рынка выходят у нас в телеграме первыми — @adposium_ai.