All'inizio di quest'anno abbiamo scritto su come generare centinaia di pagine di documenti e presentazioni. Poter richiedere un report di 100 pagine è una cosa. Ottenere tutte le 100 pagine, ogni singola volta, con la pagina 87 qualitativamente all'altezza della pagina 3, si è rivelato un problema più difficile, che ha generato le segnalazioni di bug più frustranti di quest'anno: un documento che sembrava finito e che invece si interrompeva alla pagina 14.
Questo post spiega come funziona la generazione di documenti lunghi, cosa abbiamo modificato nella v1.11.1 e come ottenere il miglior risultato quando si ha bisogno di un documento molto lungo.
NextDocs non chiede a un singolo modello di scrivere 100 pagine tutto d'un fiato. Il lavoro viene suddiviso tra tre ruoli:
Ogni ruolo viene eseguito sul modello più adatto. Il router è leggero e veloce. Il modello di creazione viene scelto in base al tuo piano e alla modalità: GPT-5.6 Luna sulla corsia veloce (fast lane), Gemini 3.8 Flash su quella di qualità (quality), Claude Sonnet 4.6 su quella premium. Il post sulla scala dei modelli spiega queste scelte.
Un modello che scrive un documento lungo ha un budget di tempo: NextDocs concede circa undici minuti per una creazione e sei per un aggiornamento. Alcuni modelli scrivono a un ritmo costante dalla prima all'ultima pagina. Altri partono velocemente e rallentano man mano che il documento cresce. Su un documento lungo, i modelli più lenti esauriscono il budget di tempo, lo streaming si interrompe e — questo era il bug — il documento completato a metà veniva salvato come se fosse finito. Nessun errore, nessun avviso, solo un report che terminava a metà frase.
Lo abbiamo scoperto riproducendo una richiesta reale di 22 pagine proveniente dall'ambiente di produzione su tutti i modelli che utilizziamo. Una volta individuato, il pattern era inconfondibile, e ora è la prima cosa che testiamo. Cinque modelli sono stati sottoposti a questo test di riproduzione; due di essi non hanno ottenuto una corsia proprio a causa di questo.
Tre cose.
Uno streaming che si interrompe in anticipo ora è considerato un fallimento, non un documento. Se un modello si ferma prima di aver finito, NextDocs si rifiuta di salvare il risultato troncato e ti spiega cosa è successo, così puoi riprovare invece di scoprire il problema durante una riunione.
Un'esecuzione interrotta conserva ciò che è stato completato. Questo è l'altro lato della medaglia: se la connessione cade o chiudi la scheda durante una generazione lunga, le pagine completate vengono conservate e puoi riprendere da lì invece di ricominciare da capo. Un troncamento silenzioso è un fallimento; un'interruzione deliberata no.
Ogni modello sulla scala ha superato un test di sbarramento per i documenti lunghi. Nessun modello ottiene una corsia, per quanto nuovo o per quanto ottimi siano i suoi benchmark, finché non ha completato la riproduzione di 22 pagine entro il budget di tempo. Gemini 3.8 Flash ha superato il test entro un giorno dal suo rilascio ed è stato promosso il 3 settembre. Claude Sonnet 5 si è fermato a 16 pagine e non è stato promosso.
Un documento lungo generato da NextDocs ora termina in uno di due modi: completo, oppure con un messaggio chiaro che spiega perché non lo è. Non esiste una terza via. Può sembrare una cosa da poco. Ma se ti è mai capitato di presentare un report che si interrompeva a pagina 14, sai bene che non lo è.
Genera un documento lungo in NextDocs
Il Team di NextDocs

Ora puoi generare documenti e presentazioni AI più grandi in NextDocs, con limiti fino a 92 pagine per documento in base al tuo piano. Scopri i limiti per piano e come suddividere gli output più lunghi in più documenti.
Leggi di più
Prima che un modello ottenga una corsia in NextDocs, deve completare un vero documento di 22 pagine proveniente dalla produzione. Ecco come funziona il test di sbarramento, come si sono comportati GPT-5.6 Luna, Gemini 3.5 e 3.8 Flash, Claude Sonnet 4.6 e Claude Sonnet 5, e perché il modello più recente non è sempre quello ideale per scrivere il tuo report.
Leggi di più
Un riepilogo di tutto ciò che è stato rilasciato tra giugno e settembre: caricamento di font personalizzati, esportazione in Word, documenti lunghi che arrivano a compimento, testo più ricco sulla tela, nuovi modelli su ogni corsia, Memoria AI e un servizio di assistenza che risponde con persone reali, oltre a una breve nota sulle novità di Shyne.
Leggi di più