
In breve
- Dal 2 settembre 2026 FastH3 open gira in locale. Il team FastVideo di Hao AI Lab ha pubblicato un percorso per la preview di FastH3 a 4 step su una o due NVIDIA DGX Spark e su Apple Silicon tramite MLX, con un minimo di 36 GB di memoria unificata sul Mac (Hao blog; @haoailab).
- Il dato sulla velocità non è un numero solo. Il titolo del blog dice 7x; il riassunto (TLDR) dice fino a 8x; il thread dice 8x. Le tabelle nel corpo dell’articolo, confrontate con una ricetta pubblica vLLM-Omni per MiniMax H3 su Spark, riportano circa 7× a 1024×576, 8,4× a 832×480 e 7,9× a 1344×768 (Hao blog; thread 1/7).
- Quei secondi si riferiscono alla ricetta locale di Hao, non a questo sito. Nel thread: 134 s per un video di 5 s a 480p su una Spark, 454 s su un M4 Max con 36 GB. Nel blog, la stessa coppia 134 s / 119 s corrisponde al percorso TAEH3 a 480p; con il VAE completo si va più piano. Nessuno di questi valori va letto come tempo di attesa qui.
- Regola per decidere: hai una DGX Spark o un Mac da 36 GB o più, accetti di caricare il modello a fasi e vuoi i pesi open di FastH3 sul tuo hardware → segui il Cookbook di Hao. Ti serve un video da 5–15 secondi e non vuoi quell’hardware, CUDA 13 né un modello che non entra tutto in memoria in una volta → genera con Fast H3 su questo sito.
- Questo sito non è il checkpoint open. Il generatore in homepage è Fast H3: prompt oppure fotogramma iniziale, fotogramma finale facoltativo, 480P / 768P, audio nativo. Non sono i pesi a 4 step di FastVideo che girano nella tua scheda del browser.
Punti chiave
- FastH3 in locale è uscito il 2 settembre 2026 per NVIDIA DGX Spark (una macchina sola o una coppia collegata via QSFP) e per Apple Silicon tramite MLX. Lo stesso giorno FastVideo ha aperto anche un Cookbook (Hao blog; README su GitHub).
- L’hardware è il vero filtro, non uno slogan. I numeri ufficiali sul Mac vengono da un M4 Max con 36 GB di memoria unificata. La Spark è il computer desktop Blackwell di NVIDIA: GB10, 128 GB di memoria unificata (Hao blog; DGX Spark). Nessuna delle due macchine tiene in memoria l’intera pipeline contemporaneamente: entrambe lavorano a fasi.
- Alla maggior parte delle persone l’installazione non serve. Se il lavoro è una singola ripresa da 5–15 secondi con audio, il generatore in homepage è la strada più corta. Non devi compilare CUDA 13 né convertire un DiT.
- I secondi del thread e quelli del blog non sempre si riferiscono allo stesso decoder. La coppia 134 s / 119 s a 480p del thread coincide con la colonna end-to-end TAEH3 del blog. Con il VAE completo, sulla stessa ricetta 832×480, 124 fotogrammi, quattro step, i tempi sono 451 s (M4 Max), 243 s (una Spark) e 209 s (due Spark) (Hao blog; thread 2/7).
- FastH3 open è MiniMax H3 distillato, non il prodotto 2K ospitato da MiniMax. MiniMax ha aperto H3 il 31 luglio / 3 agosto 2026: fino a 15 secondi, percorso di rigenerazione 2K, 24 FPS, stereo a 32 kHz, Community License (MiniMax H3; nota sull’open source). FastH3 è lo «studente» a 4 step che FastVideo ha distillato da quel modello base (HF Preview v0.2).
- Il video da 13 s / 14× su Blackwell della settimana scorsa è un’altra ricetta. Il thread del 28 agosto su FastH3 v1 dichiarava 15 s a 768p in 13 s e fino a 14× su NVIDIA Blackwell. Non è un numero da Spark o Mac, e non è una promessa di questo sito (thread v1).
Cosa è uscito davvero
Il 2 settembre 2026 Hao AI Lab ha annunciato che FastH3 «passa in locale». Nella stessa settimana il README di FastVideo ha datato il lavoro su Spark + MLX al 1° settembre 2026 (Hao blog; README).
NVIDIA DGX Spark. Il percorso CUDA della release Preview ora gira su una Spark o su una coppia. Due Spark si dividono un’unica generazione tramite QSFP (parallelismo di sequenza). Il modello non si carica nel modo consueto: encoder, transformer e decoder insieme superano i ~121 GB effettivamente disponibili a un carico di lavoro sulla Spark. Per questo la pipeline codifica il prompt, scarica l’encoder di testo, carica il transformer, esegue il denoising, scarica anche quello e solo allora carica il VAE. Il caricamento del DiT direttamente in GPU ha ridotto il tempo di caricamento del transformer da 445 s a 39 s su una GB10 (Hao blog; thread 2/7).
Apple Silicon / MLX. Minimo ufficiale: 36 GB di memoria unificata o più. Stesso caricamento a fasi. Un prompt non in cache passava circa 80 s nell’encoder di testo; una lettura limitata ha portato quel tempo a circa 17 s, e un prompt già in cache salta del tutto la codifica. Con TAEH3 la decodifica sul Mac scende da 102 s a 1 s (Hao blog; thread 3/7). Su Hugging Face ci sono DiT MLX pronti all’uso in INT8 / INT6 / INT4; INT6 è il formato predefinito usato nelle misurazioni (MLX INT6; modelli FastVideo).
Su un M4 Max, stesso prompt e stesso seed:
| Formato | Tempo reale | Picco di memoria |
|---|---|---|
| INT8 | 481 s | 24,2 GiB |
| INT6 | 456 s | 19,5 GiB |
| INT4 | 467 s | 14,8 GiB |
Fonte: Hao blog, 2 settembre 2026. I 454 s del thread si riferiscono alla stessa classe di macchina, non a un quarto formato.
Cookbook. Le ricette per MiniMax H3 ora coprono CUDA, MLX nativo, una ricetta per una coppia di Spark e un server locale compatibile con OpenAI. Su MLX il percorso mantenuto è solo da testo a video con audio (T2VA): primo/ultimo fotogramma e omni-reference non sono collegati su quel runtime (Cookbook; guida Apple Silicon).
Cosa non è uscito. Hao non ha pubblicato tempi di FastH3 su M6, M5 Ultra, M5 Max o M5 Pro. Le RTX 5090 / 4090 sono indicate come prossimo obiettivo CUDA, non come schede misurate in locale in questo post (Hao blog).

FastH3 in locale è una questione di hardware · copertina editoriale · generata per il blog di Fast H3
FastH3 in locale e Fast H3 su questo sito a confronto
Questa tabella si legge in 30 secondi. Le celle riportano fatti pubblici, non un test A/B condotto da noi. I secondi della versione locale restano legati agli URL di Hao.
| Il tuo lavoro | FastH3 open (FastVideo / Hao) | Fast H3 su questo sito |
|---|---|---|
| Che cos’è | MiniMax H3 distillato a 4 step, da scaricare ed eseguire tu (HF Preview) | Generatore nel browser per video da 5–15 s con audio. Non è il checkpoint open di FastH3 |
| Hardware a carico tuo | DGX Spark (1 o 2) oppure un Mac da 36 GB o più (Hao blog) | Un browser. Niente Spark, nessun minimo di 36 GB |
| Chi lo mantiene | Tu: CUDA 13 / MLX, caricamento a fasi, flag del Cookbook | Questo sito |
| Risoluzione / durata (dati pubblici) | Le ricette misurate ruotano attorno a 832×480, 124 fotogrammi (~5 s); con la coppia e il VAE completo 345 fotogrammi (~14 s) (Hao blog) | 480P / 768P, durata in secondi interi da 5 a 15, predefinita 5. Qui non c’è un’opzione 2K |
| Input nel percorso documentato | MLX: T2VA. Il Cookbook CUDA elenca anche altre ricette H3; MLX non collega FL2VA / Ref2VA (Cookbook) | Testo, oppure un fotogramma iniziale più un fotogramma finale facoltativo |
| Carichi tu i pesi? | Sì. Encoder / DiT / VAE non restano in memoria tutti insieme | No |
| Durata pubblica di una ripresa | Thread: 134 s (1 Spark, 5 s a 480p), 454 s (M4 Max 36 GB). Blog TAEH3 480p: 134 s / 119 s. VAE completo 832×480: 451 s / 243 s / 209 s (M4 / 1 Spark / 2 Spark) | Benchmark della versione ospitata di agosto 2026: un video da 5 s a 768P in meno di 3 secondi di tempo modello, più la coda. Non è il cronometro di Hao su Spark/Mac |
| Come provarlo | Cookbook + repository | Il generatore in homepage di questo sito |
Come usare la tabella: se la macchina ce l’hai già e vuoi i pesi open, segui Hao. Se il video ti serve oggi pomeriggio, resta su questa pagina.
Cosa sappiamo e cosa no
| Lo sappiamo (con fonte) | Non lo sappiamo / non lo affermiamo |
|---|---|
| Post su FastH3 in locale del 2026-09-02; riga di novità nel README del 2026-09-01 (blog; README) | Che 7x e 8x siano la stessa misura. Titolo, TLDR, thread e righe del confronto con vLLM-Omni non coincidono; riportiamo ciascun valore con il suo URL |
| Minimo Mac ≥36 GB; ogni numero sul Mac nel post viene da un M4 Max 36 GB (blog) | La velocità di FastH3 su M6, M5 Ultra, M5 Max, M5 Pro o su un Mac da 16 GB |
| Spark: GB10, 128 GB unificati; coppia collegata via QSFP (blog; NVIDIA) | Un tempo misurato su una RTX 5090 / 4090 consumer. Indicata come prossimo obiettivo CUDA, non misurata qui |
| Thread: 1 Spark 224 s a 768p; blog con VAE completo: 374 s (poi 336 s con il caricamento diretto in GPU) a 768×1344, 124 fotogrammi | Quale ricetta a 768p abbia usato il thread per i suoi 224 s. Non la appiattiamo sui 336/374 del blog |
| TAEH3 è il decoder di anteprima; il VAE completo di H3 è il percorso di qualità (blog) | Che i 134 s di TAEH3 siano «la» velocità di FastH3 in locale |
| I pesi open di MiniMax H3 esistono sotto una Community License (open source) | Che questo sito serva quei pesi, INT4/INT6/INT8 o una schedulazione a 4 step |
| Questo generatore: 5–15 s, 480P/768P, prompt o fotogramma iniziale, finale facoltativo, audio nativo | Un tempo di coda garantito su questo sito. Il «meno di 3 secondi» della versione ospitata è tempo modello di agosto 2026, non una promessa per le ore di punta |
| Thread di FastH3 v1 del 2026-08-28: 13 s a 768p, 14× su Blackwell (thread v1) | Che 13 s / 14× valgano come velocità di questo sito, o come velocità locale su Spark/Mac |
Come provarlo su questo sito
Per i prossimi tre prompt non ti servono né una Spark, né MLX, né un Mac da 36 GB.
- Apri il generatore in homepage (nell’intestazione: Genera).
- Incolla il Prompt A, B o C così com’è (cambia solo il nome di un prodotto, se ti serve davvero).
- Parti da 5 secondi / 480P. Tieni il 768P per la ripresa da pubblicare.
- Ascolta con le cuffie: immagine e suono arrivano nello stesso file.
- I crediti si contano per secondo di video generato. Controlla i prezzi prima di accumulare una serie di riprese da 15 secondi a 768P. Questo articolo non confronta i listini al secondo di altri servizi.
I prompt restano in inglese, così puoi incollarli senza modifiche.
Prompt A — carrellata in giardino
Un gattino bianco insegue una farfalla gialla tra le erbe basse, con la camera ad altezza gatto e solo l’ambiente sonoro del giardino.
Horizontal 16:9, about 8 seconds, sunny garden.
A white kitten chases a yellow butterfly across low herbs. Camera tracks at cat height,
leaf-filtered daylight, shallow depth, no logos, no captions.
Soft garden ambience, wing flutter, no music bed, no watermark.
Prompt B — scaletta temporizzata
Un monaco guerriero su una terrazza in rovina al tramonto: quattro secondi di inquadratura ferma, poi cammina verso la camera, con vento e ronzio lontano dei droni.
Horizontal 16:9, about 10 seconds, cliffside monastery at dusk.
First four seconds: a warrior-monk in a weathered robe stands on a ruined terrace,
two small survey drones overhead, wind in prayer flags.
Then he walks the cracked stone toward camera, same robe, same drones.
Native wind and distant rotor hum, no music, no on-screen text, no watermark.
Prompt C — una foto che pronuncia la battuta
Parti da un ritratto: la persona guarda in camera e pronuncia la frase tra virgolette, con il labiale sincronizzato e solo il suono naturale della stanza.
Use a portrait as the start frame. About 6 seconds, medium close-up, indoor window light.
The person looks to camera and says, clearly, "This is the take we keep."
Natural room tone only, lips match the line, no music, no captions, no watermark.
Il Prompt C richiede un fotogramma iniziale. A e B partono dal solo testo.
Regola per decidere (in una frase)
Scegli il Cookbook di Hao se hai già una DGX Spark o un Mac da 36 GB o più, accetti il caricamento a fasi e vuoi eseguire FastH3 open in prima persona.
Scegli Fast H3 su questo sito se il lavoro è un video da 5–15 secondi e non vuoi comprare quell’hardware, compilare CUDA 13 o fare da balia a un modello che non entra in memoria in un pezzo solo. Le FAQ in homepage riassumono in breve cosa questo generatore fa e cosa no.
FAQ
Posso eseguire FastH3 in locale?
Sì, seguendo il percorso pubblicato da Hao il 2 settembre 2026: NVIDIA DGX Spark (una o due) oppure Apple Silicon con 36 GB o più di memoria unificata, tramite il Cookbook e il repository di FastVideo (blog; Cookbook; GitHub). Non è un’app da installare con un clic: è un’installazione locale vera e propria.
Questo sito è quel pacchetto open source?
No. FastH3 (tutto attaccato) è la distillazione open a 4 step di MiniMax H3 realizzata da FastVideo. Fast H3 su questo sito è il generatore nel browser: 5–15 secondi, 480P o 768P, prompt o fotogramma iniziale. Nella tua scheda non facciamo girare il checkpoint di Hao, né INT4, né la schedulazione a 4 step.
Non ho una Spark né un Mac da 36 GB. Che faccio?
Usa il generatore in homepage. Il minimo indicato da Hao per il Mac è 36 GB; la Spark è un computer desktop Blackwell. Un portatile da 16 GB non compare nelle loro tabelle di misura. Questo sito non richiede quell’hardware.
Perché alcuni post dicono 7x e altri 8x?
Perché Hao non ha pubblicato un unico dato di riferimento. Il titolo del blog dice 7x; il TLDR dice fino a 8x; il thread dice 8x; le righe Spark contro vLLM-Omni riportano ~7× / 8,4× / 7,9× a seconda del formato (blog; thread). Non scegliamo un vincitore.
Quanto dura davvero una ripresa in locale?
Dipende dalla ricetta. I 134 s del thread (1 Spark, 5 s a 480p) corrispondono al TAEH3 del blog. Con il VAE completo a 832×480 e 124 fotogrammi: 451 s su Mac / 243 s su una Spark / 209 s su due Spark. Nessuno di questi numeri è la coda di questo sito (blog; thread 2/7).
Il percorso Mac gestisce primo e ultimo fotogramma o le omni-reference?
Non sul runtime MLX che Hao documenta oggi. Secondo il Cookbook, FastH3 su MLX fa T2VA; FL2VA e Ref2VA non sono collegati (Cookbook). Questo sito accetta invece un fotogramma iniziale e un fotogramma finale facoltativo.
FastH3 è lo stesso modello di MiniMax H3?
No. MiniMax H3 è il modello omni-modale open di MiniMax (fino a 15 secondi, rigenerazione 2K, stereo) (H3; open source). FastH3 è la distillazione a pochi step di quel modello base realizzata da FastVideo (scheda HF).
Hanno già mostrato 15 secondi generati in 13 secondi?
Il 28 agosto 2026 il thread di FastH3 v1 parlava di 15 s a 768p in 13 s e di fino a 14× su Blackwell. È la storia da datacenter della settimana scorsa, non la tabella locale Spark/Mac, e non è un tempo garantito qui (thread v1).
Quanto costa un video su questo sito?
Paghi i secondi effettivamente generati: 10 crediti al secondo a 480P, 20 a 768P. Una ripresa da 5 secondi a 480P costa 50 crediti. I piani partono dalla pagina dei prezzi. Qui non mettiamo in tabella i listini in dollari al secondo di altri servizi.
Posso vendere ciò che genero qui?
Con un piano a pagamento, i risultati sono tuoi per un uso commerciale lecito. Marchi, sembianze di persone e materiale protetto da copyright che inserisci vanno comunque autorizzati da parte tua. I pesi open di FastH3 sono soggetti alla Community License di MiniMax: quello riguarda il download di Hao, non questo generatore (open source).
Chi è Priya Nand
Priya Nand è analista delle release di Fast Video. Segue le uscite di FastVideo e MiniMax H3 in locale e in versione ospitata, e trasforma le dichiarazioni pubbliche sull’hardware in percorsi chiari per provare Fast H3.
