Se você ganha a vida criando apresentações, propostas e relatórios, os últimos quatro meses de anúncios de IA têm sido difíceis de acompanhar e fáceis de interpretar mal. Este é um guia em linguagem simples: o que foi lançado, o que isso significa para o trabalho com documentos e o que você realmente pode usar no NextDocs hoje.
| Modelo | Fornecedor | Lançamento | Por que importa para documentos |
|---|---|---|---|
| Claude Opus 4.8 | Anthropic | 28 de maio de 2026 | O último Opus antes da série 5; ainda é um redator forte para textos longos |
| Claude Fable 5 e Mythos 5 | Anthropic | 9 de jun. de 2026 | Novo nível de fronteira. O Mythos é o mesmo modelo, mas sem salvaguardas e com acesso restrito |
| Claude Sonnet 5 | Anthropic | 30 de jun. de 2026 | O Sonnet mais agentivo; US$ 2 de entrada / US$ 10 de saída por milhão de tokens |
| GPT-5.6 (Sol, Terra, Luna) | OpenAI | 9 de jul. de 2026 | Uma família de três níveis. O Luna é o rápido, o Sol é o principal |
| Kimi K3 | Moonshot | 16 de jul. de 2026 | Modelo de pesos abertos com 2,8 trilhões de parâmetros, contexto de 1M |
| Claude Opus 5 | Anthropic | 24 de jul. de 2026 | Qualidade próxima ao Fable pela metade do preço; US$ 5 de entrada / US$ 25 de saída |
| DeepSeek V4-Pro | DeepSeek | 13 de ago. de 2026 | Focado em agentes, contexto de 1M, preços para horários de pico e fora de pico |
| Gemini Omni 1.1 Flash | 27 de ago. de 2026 | "Crie qualquer coisa a partir de qualquer entrada"; upscale 4K e extensão de cena | |
| Claude Fable 5.1 e Mythos 5.1 | Anthropic | 1 de set. de 2026 | O Claude disponível ao público mais capaz; US$ 10 de entrada / US$ 50 de saída, leituras em cache reduzidas para US$ 0,25 |
| Gemini 3.8 Flash | 2 de set. de 2026 | A quarta geração Flash em quatro meses | |
| GPT-6 Astra | OpenAI | 4 de set. de 2026 | Prévia em 3 de set., disponibilidade geral no dia seguinte |
Duas correções sobre coisas que você deve ter lido: não existe Grok 5 nem Llama 5. A Meta substituiu o Llama pelo Muse Spark em abril e lançou o Muse Spark 1.1 em 9 de julho. E o Gemini 3.5 Pro, anunciado no I/O em maio, ainda não havia sido lançado até o final de agosto.
Documentos longos ficaram mais confiáveis, não apenas mais extensos. O número interessante nesses lançamentos não é o tamanho do contexto, mas o quão bem um modelo mantém a estrutura ao longo de um documento de 20 páginas: cabeçalhos consistentes, seções numeradas que permanecem numeradas, tabelas que mantêm suas colunas, uma conclusão que condiz com a introdução. É isso que testamos, e é aí que a nova geração se diferencia da antiga.
Os preços foram em ambas as direções. O Fable 5.1 é um modelo premium a US$ 10 e US$ 50 por milhão de tokens. O Sonnet 5 a US$ 2 e US$ 10 é mais barato do que o modelo que ele substitui. O Gemini Flash continua ficando mais rápido e mais barato a cada geração. Para uma ferramenta de documentos, isso importa porque um relatório de 60 páginas consome muitos tokens; a escolha da faixa altera o custo de criação de um documento.
Os agentes tornaram-se a abordagem padrão. Cada fornecedor agora descreve seu modelo como um agente. Para documentos, a versão útil disso é um modelo que pode planejar um documento, escrevê-lo, analisar o resultado e corrigi-lo. O NextDocs executa esse ciclo de criar, verificar e refinar desde a v1.8; os novos modelos tornam cada etapa melhor.
O NextDocs não executa apenas um modelo. Ele funciona em uma escala, e o degrau depende do seu plano e do modo que você escolher.
Além das faixas, o seletor de modelos permite que você escolha explicitamente: Gemini 3 Flash e Gemini 3.8 Flash, Gemini 3.1 Pro Preview, GPT-5.5, Claude Opus 4.8, Claude Sonnet 4.6, Kimi K2.6, GLM 5.3 e Qwen 3.7 Max. Alguns estão no plano gratuito, os maiores no Pro e superiores.
Por que não usar simplesmente o modelo mais novo em todos os lugares? Porque testamos antes de promover. O Claude Sonnet 5 foi testado em nossa barreira de documentos de 22 páginas e não passou, por isso o Sonnet 4.6 permaneceu na faixa premium. O Gemini 3.8 Flash passou e entrou no ar em poucos dias. O próximo post explica o teste e o que aprendemos ao rodar cinco modelos na mesma apresentação.
O GPT-6 Astra e o Claude Fable 5.1 ainda não estão no NextDocs. Se você já paga pelo Claude Code ou Codex, existe uma maneira de usá-los para trabalhos de documentos hoje: o Shyne, nosso produto irmão, tem um aplicativo de desktop que detecta um Claude Code, Codex ou opencode instalado localmente e permite que você execute o agente Shyne nele. Isso significa Claude Fable 5.1, Opus 5 e Sonnet 5 através do Claude Code, ou GPT-6 Astra e a família GPT-5.6 através do Codex, cobrados na assinatura que você já possui e sem custo extra por parte do Shyne.
Os modelos hospedados do Shyne, caso prefira não trazer o seu próprio, são a família GPT-5.6 com o Terra como padrão, além do Kimi K2.6, K2.7 Code e K3.
Os nomes dos modelos continuarão mudando a cada poucas semanas. A pergunta que vale a pena fazer continua a mesma: ele produz um documento que você pode enviar?
Experimente o seletor de modelos no NextDocs · Traga seu próprio modelo no Shyne para desktop
A Equipe NextDocs

Antes de um modelo ganhar uma faixa no NextDocs, ele precisa concluir um documento real de 22 páginas da produção. Veja como funciona o portão de entrada, o que o GPT-5.6 Luna, Gemini 3.5 e 3.8 Flash, Claude Sonnet 4.6 e Claude Sonnet 5 fizeram nele, e por que o modelo mais recente nem sempre é o que você deseja escrevendo seu relatório.
Leia mais
Gere até 4 variantes de documentos simultaneamente. Compare diferentes abordagens.
Leia mais
Agora criamos dois produtos. Esta é a resposta curta e honesta sobre qual deles se adapta ao que você está fazendo — além do que acontece com a sua conta NextDocs (nada) e para onde vai o nosso novo trabalho (Shyne).
Leia mais