Artificial Intelligence
Alibaba Unleashes Qwen3.5-Omni: A Fully Omnimodal AI That Speaks 113 Languages and Clones Voices in Real Time
Alibaba's Qwen team has unveiled Qwen3.5-Omni, a next-generation omnimodal AI model capable of understanding text, images, audio, and video while generating real-time speech. Supporting speech recognition in 113 languages, speech generation in 36 languages, voice cloning, and semantic interruption, the model outperforms rivals like Gemini and GPT-4o across multiple benchmarks.
·2 min