博客
AI ModelsGPT-6ClaudeGeminiKimiNextDocs

2026年9月模型浪潮:写文档的人需要了解的一切

2 min
2026年9月模型浪潮:写文档的人需要了解的一切

2026年9月模型浪潮:写文档的人需要了解的一切

如果你以制作演示文稿(PPT)、提案和报告为生,那么过去四个月里密集的 AI 发布会可能让你眼花缭乱,甚至产生误解。这是一份通俗易懂的指南:发布了什么、对文档工作意味着什么,以及你今天在 NextDocs 中实际可以使用哪些模型。

按发布顺序盘点

模型 厂商 发布时间 对文档工作有何意义
Claude Opus 4.8 Anthropic 2026年5月28日 5系列之前的最后一代 Opus;依然是强大的长文写作工具
Claude Fable 5 和 Mythos 5 Anthropic 2026年6月9日 全新前沿级别。Mythos 是解除安全限制并限制访问的同款模型
Claude Sonnet 5 Anthropic 2026年6月30日 最具 Agent 属性的 Sonnet;每百万 Token 输入 $2 / 输出 $10
GPT-5.6 (Sol, Terra, Luna) OpenAI 2026年7月9日 三档模型家族。Luna 主打速度,Sol 是旗舰款
Kimi K3 月之暗面 (Moonshot) 2026年7月16日 2.8万亿参数的开源权重模型,支持 1M 上下文
Claude Opus 5 Anthropic 2026年7月24日 接近 Fable 的质量,价格仅为一半;输入 $5 / 输出 $25
DeepSeek V4-Pro 深度求索 (DeepSeek) 2026年8月13日 专注于 Agent,支持 1M 上下文,采用高峰与非高峰期差异化定价
Gemini Omni 1.1 Flash 谷歌 (Google) 2026年8月27日 “从任何输入中创造任何内容”;支持 4K 超分辨率和场景延伸
Claude Fable 5.1 和 Mythos 5.1 Anthropic 2026年9月1日 目前最强大的通用 Claude 模型;输入 $10 / 输出 $50,缓存读取降至 $0.25
Gemini 3.8 Flash 谷歌 (Google) 2026年9月2日 四个月内的第四代 Flash 模型
GPT-6 Astra OpenAI 2026年9月4日 9月3日发布预览版,次日全面开放

纠正你可能读到的两条错误信息:目前没有 Grok 5,也没有 Llama 5。Meta 已在 4 月用 Muse Spark 取代了 Llama,并于 7 月 9 日发布了 Muse Spark 1.1。此外,在 5 月 I/O 大会上宣布的 Gemini 3.5 Pro,直到 8 月底仍未正式发布。

文档工作究竟发生了什么变化

长文档变得更可靠,而不仅仅是字数变长。 在这些发布中,最值得关注的数字不是上下文长度,而是模型在处理 20 页文档时保持结构的能力:标题是否前后一致、编号章节是否保持正确编号、表格是否保留列格式、结论是否呼应引言。这正是我们测试的重点,也是新一代模型与旧一代模型拉开差距的地方。

价格呈现两极分化。 Fable 5.1 是一款高端模型,每百万 Token 的价格为输入 $10 / 输出 $50。而 Sonnet 5 价格为输入 $2 / 输出 $10,比它取代的模型更便宜。Gemini Flash 的每一代都在变得更快、更便宜。对于文档工具而言,这至关重要,因为一份 60 页的报告会消耗大量 Token;选择不同的通道会直接影响文档的制作成本。

智能体(Agent)成为默认框架。 现在每个厂商都将自己的模型描述为 Agent。对于文档而言,真正实用的版本是能够规划文档、撰写内容、检查结果并进行修正的模型。NextDocs 自 v1.8 版本起就已经运行了这种“创建、验证、完善”的循环;而新模型让每一个步骤都变得更好。

NextDocs 目前运行哪些模型

NextDocs 运行的不是单一模型,而是一个模型梯队,具体使用哪一个取决于你的订阅计划和选择的模式。

  • 快速通道(Fast lane): GPT-5.6 Luna,运行在 Azure AI Foundry 上。
  • 质量通道(Quality lane): Gemini 3.8 Flash,在通过我们的长文档测试门槛后,于 9 月 3 日正式上线。
  • 高级通道(Premium lane,适用于 Pro+ 和 Ultra): Claude Sonnet 4.6。

除了这些通道,模型选择器还允许你明确选择:Gemini 3 Flash、Gemini 3.8 Flash、Gemini 3.1 Pro Preview、GPT-5.5、Claude Opus 4.8、Claude Sonnet 4.6、Kimi K2.6、GLM 5.3 和 Qwen 3.7 Max。其中部分模型可在免费计划中使用,较大的模型则需要 Pro 及以上计划。

为什么不直接在所有地方都使用最新模型?因为我们在上线前会进行严格测试。我们用 22 页的文档测试门槛对 Claude Sonnet 5 进行了测试,但它未能通过,因此 Sonnet 4.6 仍保留在高级通道中。而 Gemini 3.8 Flash 顺利通过,并在几天内上线。下一篇博文将详细介绍这一测试门槛,以及我们在同一套幻灯片上运行五个模型的收获。

如何使用最新的模型

GPT-6 Astra 和 Claude Fable 5.1 尚未接入 NextDocs。如果你已经付费订阅了 Claude Code 或 Codex,今天就有一种方法可以将它们用于文档工作:我们的兄弟产品 Shyne 拥有一款桌面应用,它可以检测本地安装的 Claude Code、Codex 或 opencode,并允许你在其上运行 Shyne Agent。这意味着你可以通过 Claude Code 使用 Claude Fable 5.1、Opus 5 和 Sonnet 5,或者通过 Codex 使用 GPT-6 Astra 和 GPT-5.6 家族,费用直接从你已有的订阅中扣除,Shyne 不收取额外费用。

如果你不想自带模型,Shyne 的托管模型包括以 Terra 为默认模型的 GPT-5.6 家族,以及 Kimi K2.6、K2.7 Code 和 K3。

简单选择指南

  • 起草幻灯片或短文档,且注重速度:选择快速通道即可。
  • 撰写长篇报告、或章节之间必须保持高度一致的提案:选择质量通道
  • 需要细腻文笔、注重语气,或是要呈送给董事会的文档:选择高级通道,或在选择器中直接选择 Claude Opus 4.8。
  • 想要对比效果:使用不同的模型生成多个版本并保留最好的一个。这是文档工具能做到而聊天窗口做不到的独特功能。

模型名称每隔几周就会发生变化,但值得思考的核心问题始终未变:它生成的文档能直接发出去吗?

在 NextDocs 中体验模型选择器 · 在 Shyne 桌面端使用你自己的模型


NextDocs 团队