Il modello Wan3.0 di Alibaba, ora disponibile in beta, raddoppia la lunghezza massima dei video generati dall'AI portandola a 30 secondi in un'unica passata. La novità più rilevante per gli sviluppatori e i team di contenuto è la capacità di accettare documenti statici — PDF, presentazioni PowerPoint, fogli di calcolo e pagine web — come input diretto per la creazione video.

Aggiungi AlexTech.ai comeFonte Preferita su Google

Da documento statico a clip dinamica

Wan3.0 elabora simultaneamente testo, immagini, video e audio: un singolo prompt può includere fino a 10 immagini, 5 clip video e 5 file audio. Secondo Alibaba, il modello mira a risolvere i problemi di deriva visiva e distorsione tipici dei video AI mantenendo coerenti personaggi, oggetti e layout spaziali rispetto ai materiali di riferimento. Il sistema include inoltre uno strumento per estendere la durata dei video esistenti e suggerisce automaticamente la lunghezza ottimale in base al prompt.

Prezzi e disponibilità

Alibaba launches Wan3.0 video model with 30-second generation and ... — https://news.lavx.hu/article/alibaba-launches-wan3-0-video-model-with-30-second-generation-and-document-input

Il modello è accessibile tramite il sito wan.video, Alibaba Cloud Model Studio o via API su Qwen Cloud. Sono disponibili due tier: una versione Standard, attualmente con uno sconto del 30%, e una versione Prime più veloce. Un clip di 30 secondi in 1080p costa 6,00 dollari con la versione Standard e 8,40 dollari con Prime; in 720p i costi scendono a 3,00 dollari e 4,20 dollari, mentre in 480p si parte da 1,50 dollari.

Il contesto finanziario del lancio

L'uscita di Wan3.0 arriva in un momento cruciale per la strategia AI di Alibaba: l'azienda ha appena completato la vendita di azioni più grande tra le società quotate a Hong Kong per finanziare il proprio push sull'intelligenza artificiale. La settimana precedente, Alibaba aveva riportato un calo del 75% degli utili trimestrali su base annua, attribuito a investimenti in AI drasticamente più alti. Il modello si inserisce in una serie di rilasci recenti del Tongyi Lab, tra cui Qwen-Image-3.0 per la generazione grafica e Qwen-Audio-3.0 per la sintesi vocale, consolidando l'approccio multimodale dell'azienda.

Verso la produzione professionale e il training robotico

Alibaba posiziona Wan3.0 per un'ampia gamma di applicazioni: dalla produzione cinematografica alla creazione di short drama e clip social, fino al training di veicoli autonomi e sistemi robotici tramite footage simulato realistico. Con la concorrenza che si fa sempre più agguerrita — da ByteDance con Seedance 2.5 a MiniMax H3 — la capacità di trasformare documenti aziendali in video dinamici rappresenta un vantaggio competitivo concreto per i flussi di lavoro aziendali.