今年早些时候,我们写过关于生成数百页文档和演示文稿的文章。能够要求生成一份 100 页的报告是一回事。但每次都完整获取全部 100 页,且让第 87 页的质量与第 3 页一样好,事实证明这是一个更难解决的问题,也是导致我们今年收到最令人沮丧的 Bug 报告的原因:一份看起来已经完成的文档,却在第 14 页戛然而止。
本文将解释长文档生成的工作原理、我们在 v1.11.1 中做出的改变,以及在需要超长文档时如何获得最佳效果。
NextDocs 不会要求单个模型一口气写完 100 页。而是由三个角色分工合作:
每个角色都运行在最适合它的模型上。路由模型体量小且速度快。生成模型则根据您的方案和模式进行选择:极速通道(fast lane)使用 GPT-5.6 Luna,质量通道(quality lane)使用 Gemini 3.8 Flash,高级通道(premium lane)使用 Claude Sonnet 4.6。阶梯模型文章详细解释了这些选择。
模型在撰写长文档时是有时间预算的:NextDocs 允许单次创建耗时约 11 分钟,单次更新耗时约 6 分钟。有些模型从第一页到最后一页都能保持稳定的速度。而另一些模型则是起步很快,随着文档变长而逐渐变慢。在生成长文档时,变慢的模型会耗尽预算,流式传输随之结束。而以前的 Bug 就在于:这份半成品的文档会被保存下来,就好像它已经全部完成了一样。没有错误提示,没有警告,只有一份在句子中间戛然而止的报告。
我们通过在使用的每个模型上重放一个来自生产环境的真实 22 页请求,发现了这个问题。一旦看清了这种模式,它就变得显而易见,现在它已成为我们测试的首要项目。有五个模型参与了那次重放测试;其中两个模型因此未能获得通道分配。
共有三项改变。
提前结束的流式传输现在会被判定为失败,而不是生成一份文档。 如果模型在完成之前停止,NextDocs 将拒绝保存被截断的结果,并告知您发生了什么,以便您可以重新尝试,而不是在开会时才发现问题。
中断的运行会保留已完成的部分。 这是硬币的另一面:如果在长文档生成过程中您的网络连接断开或关闭了标签页,已完成的页面将被保留,您可以从那里继续,而无需重新开始。静默截断是失败,但刻意中止则不是。
阶梯上的每个模型都通过了长文档关卡的检验。 任何模型,无论多新、基准测试成绩多好,在预算内完成 22 页的重放测试之前,都无法获得通道分配。Gemini 3.8 Flash 在发布后一天内就通过了测试,并于 9 月 3 日获得晋升。而 Claude Sonnet 5 在第 16 页时停止了,因此未能通过。
现在,NextDocs 生成的长文档只有两种结局:要么完整完成,要么附带一条清晰的未完成说明及原因。不存在第三种状态。这听起来像是一件小事。但如果您曾经用一份在第 14 页戛然而止的报告做过演示,您就会明白这绝非小事。
NextDocs 团队

您现在可以在 NextDocs 中生成更大的 AI 文档和演示文稿,具体页数上限取决于您的方案,每个文档最多可达 92 页。查看各方案的页数限制,以及如何将更长的输出拆分到多个文档中。
阅读更多
在模型进入 NextDocs 的推荐通道之前,它必须完整处理一份来自生产环境的真实 22 页文档。本文将介绍这一准入测试的工作原理,GPT-5.6 Luna、Gemini 3.5 和 3.8 Flash、Claude Sonnet 4.6 以及 Claude Sonnet 5 在测试中的表现,以及为什么最新的模型并不总是撰写报告的最佳选择。
阅读更多
汇总 6 月至 9 月期间发布的所有更新:自定义字体、Word 导出、支持生成超长文档、更丰富的画布文本、全线接入新模型、AI 记忆功能,以及能够联系到真人的支持服务台,此外还简要介绍了 Shyne 的最新动态。
阅读更多