وبلاگ‌ها
AI ModelsGPT-6ClaudeGeminiKimiNextDocs

موج مدل‌های سپتامبر ۲۰۲۶، به زبان ساده برای تولیدکنندگان اسناد

7 min
موج مدل‌های سپتامبر ۲۰۲۶، به زبان ساده برای تولیدکنندگان اسناد

موج مدل‌های سپتامبر ۲۰۲۶، به زبان ساده برای تولیدکنندگان اسناد

اگر شغل شما ساخت ارائه‌ها، پروپوزال‌ها و گزارش‌ها است، دنبال کردن اخبار و معرفی‌های هوش مصنوعی در چهار ماه گذشته دشوار بوده و به‌راحتی ممکن است دچار سوءبرداشت شده باشید. این یک راهنمای ساده و روان است: چه مدل‌هایی عرضه شده‌اند، این موضوع چه معنایی برای کار با اسناد دارد و امروز کدام‌یک از آن‌ها را می‌توانید در NextDocs استفاده کنید.

مدل‌های عرضه‌شده، به ترتیب زمانی

مدل ارائه‌دهنده تاریخ عرضه چرا برای اسناد اهمیت دارد
Claude Opus 4.8 Anthropic ۲۸ مه ۲۰۲۶ آخرین نسخه Opus قبل از سری ۵؛ همچنان یک نویسنده قوی برای متون طولانی
Claude Fable 5 و Mythos 5 Anthropic ۹ ژوئن ۲۰۲۶ سطح پیشرو جدید. Mythos همان مدل است اما بدون محدودیت‌های حفاظتی و با دسترسی محدود
Claude Sonnet 5 Anthropic ۳۰ ژوئن ۲۰۲۶ عامل‌گراترین (Agentic) نسخه Sonnet؛ ۲ دلار ورودی / ۱۰ دلار خروجی به ازای هر میلیون توکن
GPT-5.6 (Sol, Terra, Luna) OpenAI ۹ ژوئیه ۲۰۲۶ یک خانواده سه سطحی. Luna نسخه سریع و Sol پرچمدار است
Kimi K3 Moonshot ۱۶ ژوئیه ۲۰۲۶ مدل با وزن‌های باز و ۲.۸ تریلیون پارامتر، با طول زمینه ۱ میلیون توکن
Claude Opus 5 Anthropic ۲۴ ژوئیه ۲۰۲۶ کیفیتی نزدیک به Fable با نصف قیمت؛ ۵ دلار ورودی / ۲۵ دلار خروجی
DeepSeek V4-Pro DeepSeek ۱۳ اوت ۲۰۲۶ تمرکز بر عامل‌ها، طول زمینه ۱ میلیون توکن، قیمت‌گذاری ساعات اوج و غیر اوج مصرف
Gemini Omni 1.1 Flash Google ۲۷ اوت ۲۰۲۶ «خلق هر چیز از هر ورودی»؛ ارتقای کیفیت 4K و توسعه صحنه
Claude Fable 5.1 و Mythos 5.1 Anthropic ۱ سپتامبر ۲۰۲۶ قدرتمندترین نسخه عمومی Claude؛ ۱۰ دلار ورودی / ۵۰ دلار خروجی، کاهش هزینه خواندن کش به ۰.۲۵ دلار
Gemini 3.8 Flash Google ۲ سپتامبر ۲۰۲۶ چهارمین نسل Flash در چهار ماه
GPT-6 Astra OpenAI ۴ سپتامبر ۲۰۲۶ نسخه پیش‌نمایش در ۳ سپتامبر، عرضه عمومی در روز بعد

دو اصلاحیه درباره چیزهایی که ممکن است خوانده باشید: هیچ مدل Grok 5 یا Llama 5 وجود ندارد. Meta در ماه آوریل Muse Spark را جایگزین Llama کرد و نسخه Muse Spark 1.1 را در ۹ ژوئیه عرضه نمود. همچنین Gemini 3.5 Pro که در کنفرانس I/O در ماه مه معرفی شده بود، تا اواخر اوت هنوز عرضه نشده بود.

چه چیزی واقعاً برای کار با اسناد تغییر کرده است

اسناد طولانی نه‌تنها طولانی‌تر، بلکه قابل‌اعتمادتر شده‌اند. عدد جالب در این نسخه‌ها طول زمینه نیست، بلکه این است که یک مدل چقدر خوب می‌تواند ساختار را در یک سند ۲۰ صفحه‌ای حفظ کند: عناوین هماهنگ، بخش‌های شماره‌گذاری‌شده‌ای که شماره خود را حفظ می‌کنند، جدول‌هایی که ستون‌هایشان به هم نمی‌ریزد و نتیجه‌گیری‌ای که با مقدمه همخوانی دارد. این همان چیزی است که ما آزمایش می‌کنیم و جایی است که نسل جدید را از نسل قدیم متمایز می‌سازد.

قیمت‌ها در دو جهت حرکت کردند. مدل Fable 5.1 یک مدل پرمیوم با قیمت ۱۰ دلار و ۵۰ دلار به ازای هر میلیون توکن است. Sonnet 5 با قیمت ۲ دلار و ۱۰ دلار ارزان‌تر از مدلی است که جایگزین آن شده است. Gemini Flash در هر نسل سریع‌تر و ارزان‌تر می‌شود. برای یک ابزار تولید سند، این موضوع اهمیت زیادی دارد زیرا یک گزارش ۶۰ صفحه‌ای شامل توکن‌های بسیار زیادی است؛ انتخاب مسیر (lane) هزینه ساخت سند را تغییر می‌دهد.

عامل‌ها (Agents) به چارچوب پیش‌فرض تبدیل شدند. اکنون هر ارائه‌دهنده‌ای مدل خود را به عنوان یک عامل توصیف می‌کند. برای اسناد، نسخه کاربردی آن مدلی است که می‌تواند برای یک سند برنامه‌ریزی کند، آن را بنویسد، نتیجه را بررسی کرده و اصلاح کند. NextDocs این چرخه ساخت، تأیید و بهبود را از نسخه ۱.۸ اجرا کرده است؛ مدل‌های جدید هر یک از این مراحل را بهتر انجام می‌دهند.

NextDocs امروز کدام مدل‌ها را اجرا می‌کند

NextDocs تنها یک مدل را اجرا نمی‌کند. بلکه از یک نردبان استفاده می‌کند و پله‌ای که روی آن قرار می‌گیرید به اشتراک شما و حالتی که انتخاب می‌کنید بستگی دارد.

  • مسیر سریع (Fast lane): مدل GPT-5.6 Luna، در حال اجرا روی Azure AI Foundry.
  • مسیر کیفیت (Quality lane): مدل Gemini 3.8 Flash، که در ۳ سپتامبر پس از قبولی در تست اسناد طولانی ما ارتقا یافت.
  • مسیر پرمیوم (Premium lane - نسخه‌های Pro+ و Ultra): مدل Claude Sonnet 4.6.

در کنار این مسیرها، بخش انتخاب مدل (model picker) به شما اجازه می‌دهد به طور مستقیم انتخاب کنید: Gemini 3 Flash و Gemini 3.8 Flash، نسخه پیش‌نمایش Gemini 3.1 Pro، مدل GPT-5.5، مدل Claude Opus 4.8، مدل Claude Sonnet 4.6، مدل Kimi K2.6، مدل GLM 5.3 و Qwen 3.7 Max. برخی از این مدل‌ها در طرح رایگان و مدل‌های بزرگ‌تر در طرح Pro و بالاتر در دسترس هستند.

چرا به سادگی جدیدترین مدل را در همه جا استفاده نمی‌کنیم؟ چون ما قبل از ارتقا، آزمایش می‌کنیم. Claude Sonnet 5 روی تست سند ۲۲ صفحه‌ای ما آزمایش شد و قبول نشد، بنابراین Sonnet 4.6 در مسیر پرمیوم باقی ماند. اما Gemini 3.8 Flash قبول شد و ظرف چند روز فعال گردید. مطلب بعدی این تست و آنچه را که از اجرای پنج مدل روی یک اسلاید یکسان آموختیم، توضیح می‌دهد.

چگونه از جدیدترین مدل‌ها استفاده کنیم

مدل‌های GPT-6 Astra و Claude Fable 5.1 هنوز در NextDocs در دسترس نیستند. اگر در حال حاضر هزینه Claude Code یا Codex را پرداخت می‌کنید، راهی برای استفاده از آن‌ها برای کار با اسناد وجود دارد: Shyne، محصول خواهر ما، یک اپلیکیشن دسکتاپ دارد که Claude Code، Codex یا opencode نصب‌شده به صورت محلی را شناسایی کرده و به شما امکان می‌دهد عامل Shyne را روی آن اجرا کنید. این یعنی دسترسی به Claude Fable 5.1، Opus 5 و Sonnet 5 از طریق Claude Code، یا GPT-6 Astra و خانواده GPT-5.6 از طریق Codex، که هزینه آن روی همان اشتراک فعلی شما حساب می‌شود و هزینه اضافی برای Shyne نخواهد داشت.

مدل‌های میزبانی‌شده Shyne (اگر ترجیح می‌دهید از مدل خود استفاده نکنید) شامل خانواده GPT-5.6 با Terra به عنوان پیش‌فرض، به همراه Kimi K2.6، K2.7 Code و K3.

یک روش ساده برای انتخاب

  • پیش‌نویس یک اسلاید یا یک سند کوتاه، و سرعت اهمیت دارد: مسیر سریع مناسب است.
  • یک گزارش طولانی، یک پروپوزال با بخش‌هایی که باید هماهنگ باقی بمانند: مسیر کیفیت.
  • نگارش دقیق با لحن خاص، یا سندی که قرار است برای هیئت‌مدیره ارسال کنید: مسیر پرمیوم، یا انتخاب Claude Opus 4.8 از بخش انتخاب مدل.
  • می‌خواهید مقایسه کنید: چندین نسخه مختلف را هر کدام با یک مدل متفاوت تولید کنید و بهترین را نگه دارید. این تنها کاری است که یک ابزار تخصصی سند می‌تواند انجام دهد اما یک پنجره چت معمولی قادر به انجام آن نیست.

نام مدل‌ها هر چند هفته یک‌بار تغییر خواهد کرد. اما سوالی که ارزش پرسیدن دارد همچنان یکسان است: آیا این مدل سندی تولید می‌کند که بتوانید آن را ارسال کنید؟

بخش انتخاب مدل را در NextDocs امتحان کنید · مدل خود را روی نسخه دسکتاپ Shyne اجرا کنید


تیم NextDocs

مطالب مرتبط

ما پنج مدل را روی یک سند ۲۲ صفحه‌ای یکسان اجرا کردیم. این چیزی است که یاد گرفتیم.

ما پنج مدل را روی یک سند ۲۲ صفحه‌ای یکسان اجرا کردیم. این چیزی است که یاد گرفتیم.

قبل از اینکه یک مدل بتواند در NextDocs جایگاهی کسب کند، باید یک سند واقعی ۲۲ صفحه‌ای از محیط عملیاتی را با موفقیت به پایان برساند. در این مطلب بررسی می‌کنیم که این فیلتر ارزیابی چگونه کار می‌کند، مدل‌های GPT-5.6 Luna، Gemini 3.5 و 3.8 Flash، Claude Sonnet 4.6 و Claude Sonnet 5 چه عملکردی داشتند، و چرا جدیدترین مدل همیشه بهترین گزینه برای نوشتن گزارش شما نیست.

ادامه مطلب
معرفی تولید چند‌متغیره — NextDocs نسخه ۱.۴

معرفی تولید چند‌متغیره — NextDocs نسخه ۱.۴

تولید همزمان تا ۴ نسخه مختلف از سند. مقایسه رویکردهای متفاوت

ادامه مطلب
نکست‌داکس و شاین — از کدام‌یک باید استفاده کنید؟

نکست‌داکس و شاین — از کدام‌یک باید استفاده کنید؟

ما اکنون دو محصول تولید می‌کنیم. این پاسخ کوتاه و صادقانه‌ای است به این سوال که کدام‌یک برای کار شما مناسب‌تر است — به همراه توضیحاتی درباره اینکه چه اتفاقی برای حساب نکست‌داکس شما می‌افتد (هیچ اتفاقی) و کارهای جدید ما در کجا قرار می‌گیرند (شاین).

ادامه مطلب