如果你以制作演示文稿(PPT)、提案和报告为生,那么过去四个月里密集的 AI 发布会可能让你眼花缭乱,甚至产生误解。这是一份通俗易懂的指南:发布了什么、对文档工作意味着什么,以及你今天在 NextDocs 中实际可以使用哪些模型。
| 模型 | 厂商 | 发布时间 | 对文档工作有何意义 |
|---|---|---|---|
| Claude Opus 4.8 | Anthropic | 2026年5月28日 | 5系列之前的最后一代 Opus;依然是强大的长文写作工具 |
| Claude Fable 5 和 Mythos 5 | Anthropic | 2026年6月9日 | 全新前沿级别。Mythos 是解除安全限制并限制访问的同款模型 |
| Claude Sonnet 5 | Anthropic | 2026年6月30日 | 最具 Agent 属性的 Sonnet;每百万 Token 输入 $2 / 输出 $10 |
| GPT-5.6 (Sol, Terra, Luna) | OpenAI | 2026年7月9日 | 三档模型家族。Luna 主打速度,Sol 是旗舰款 |
| Kimi K3 | 月之暗面 (Moonshot) | 2026年7月16日 | 2.8万亿参数的开源权重模型,支持 1M 上下文 |
| Claude Opus 5 | Anthropic | 2026年7月24日 | 接近 Fable 的质量,价格仅为一半;输入 $5 / 输出 $25 |
| DeepSeek V4-Pro | 深度求索 (DeepSeek) | 2026年8月13日 | 专注于 Agent,支持 1M 上下文,采用高峰与非高峰期差异化定价 |
| Gemini Omni 1.1 Flash | 谷歌 (Google) | 2026年8月27日 | “从任何输入中创造任何内容”;支持 4K 超分辨率和场景延伸 |
| Claude Fable 5.1 和 Mythos 5.1 | Anthropic | 2026年9月1日 | 目前最强大的通用 Claude 模型;输入 $10 / 输出 $50,缓存读取降至 $0.25 |
| Gemini 3.8 Flash | 谷歌 (Google) | 2026年9月2日 | 四个月内的第四代 Flash 模型 |
| GPT-6 Astra | OpenAI | 2026年9月4日 | 9月3日发布预览版,次日全面开放 |
纠正你可能读到的两条错误信息:目前没有 Grok 5,也没有 Llama 5。Meta 已在 4 月用 Muse Spark 取代了 Llama,并于 7 月 9 日发布了 Muse Spark 1.1。此外,在 5 月 I/O 大会上宣布的 Gemini 3.5 Pro,直到 8 月底仍未正式发布。
长文档变得更可靠,而不仅仅是字数变长。 在这些发布中,最值得关注的数字不是上下文长度,而是模型在处理 20 页文档时保持结构的能力:标题是否前后一致、编号章节是否保持正确编号、表格是否保留列格式、结论是否呼应引言。这正是我们测试的重点,也是新一代模型与旧一代模型拉开差距的地方。
价格呈现两极分化。 Fable 5.1 是一款高端模型,每百万 Token 的价格为输入 $10 / 输出 $50。而 Sonnet 5 价格为输入 $2 / 输出 $10,比它取代的模型更便宜。Gemini Flash 的每一代都在变得更快、更便宜。对于文档工具而言,这至关重要,因为一份 60 页的报告会消耗大量 Token;选择不同的通道会直接影响文档的制作成本。
智能体(Agent)成为默认框架。 现在每个厂商都将自己的模型描述为 Agent。对于文档而言,真正实用的版本是能够规划文档、撰写内容、检查结果并进行修正的模型。NextDocs 自 v1.8 版本起就已经运行了这种“创建、验证、完善”的循环;而新模型让每一个步骤都变得更好。
NextDocs 运行的不是单一模型,而是一个模型梯队,具体使用哪一个取决于你的订阅计划和选择的模式。
除了这些通道,模型选择器还允许你明确选择:Gemini 3 Flash、Gemini 3.8 Flash、Gemini 3.1 Pro Preview、GPT-5.5、Claude Opus 4.8、Claude Sonnet 4.6、Kimi K2.6、GLM 5.3 和 Qwen 3.7 Max。其中部分模型可在免费计划中使用,较大的模型则需要 Pro 及以上计划。
为什么不直接在所有地方都使用最新模型?因为我们在上线前会进行严格测试。我们用 22 页的文档测试门槛对 Claude Sonnet 5 进行了测试,但它未能通过,因此 Sonnet 4.6 仍保留在高级通道中。而 Gemini 3.8 Flash 顺利通过,并在几天内上线。下一篇博文将详细介绍这一测试门槛,以及我们在同一套幻灯片上运行五个模型的收获。
GPT-6 Astra 和 Claude Fable 5.1 尚未接入 NextDocs。如果你已经付费订阅了 Claude Code 或 Codex,今天就有一种方法可以将它们用于文档工作:我们的兄弟产品 Shyne 拥有一款桌面应用,它可以检测本地安装的 Claude Code、Codex 或 opencode,并允许你在其上运行 Shyne Agent。这意味着你可以通过 Claude Code 使用 Claude Fable 5.1、Opus 5 和 Sonnet 5,或者通过 Codex 使用 GPT-6 Astra 和 GPT-5.6 家族,费用直接从你已有的订阅中扣除,Shyne 不收取额外费用。
如果你不想自带模型,Shyne 的托管模型包括以 Terra 为默认模型的 GPT-5.6 家族,以及 Kimi K2.6、K2.7 Code 和 K3。
模型名称每隔几周就会发生变化,但值得思考的核心问题始终未变:它生成的文档能直接发出去吗?
在 NextDocs 中体验模型选择器 · 在 Shyne 桌面端使用你自己的模型
NextDocs 团队

在模型进入 NextDocs 的推荐通道之前,它必须完整处理一份来自生产环境的真实 22 页文档。本文将介绍这一准入测试的工作原理,GPT-5.6 Luna、Gemini 3.5 和 3.8 Flash、Claude Sonnet 4.6 以及 Claude Sonnet 5 在测试中的表现,以及为什么最新的模型并不总是撰写报告的最佳选择。
阅读更多
同时生成多达 4 个文档变体。比较不同的结构、视觉方向和叙事方式。
阅读更多
我们现在推出了两款产品。本文将为您提供简短而坦诚的解答,帮助您确定哪一款最适合您的工作——此外,还会说明您的 NextDocs 账户会发生什么变化(没有任何影响)以及我们未来的工作重心(Shyne)。
阅读更多