Một năm trước, chúng tôi đã viết về Nano Banana, mô hình hình ảnh của Google cuối cùng đã giữ cho một chủ thể nhất quán từ hình ảnh này sang hình ảnh tiếp theo. Bài viết đó vẫn là một trong những bài được đọc nhiều nhất trên blog này, bởi vì sự nhất quán là điều mà một bài thuyết trình (deck) cần: cùng một sản phẩm, cùng một nhân vật, cùng một phong cách trên slide thứ ba và slide thứ ba mươi.
Kể từ đó, lĩnh vực này đã thay đổi một lần nữa. Đây là hướng dẫn cho tháng 9 năm 2026: thế mạnh của từng mô hình hiện tại khi kết quả đầu ra được đưa lên slide, những mô hình nào mà sản phẩm của chúng tôi cung cấp, và cách lựa chọn mà không cần đọc các bài đánh giá hiệu năng (benchmark).
Các mô hình hình ảnh thường được đánh giá dựa trên một bức ảnh đẹp duy nhất. Nhưng một bài thuyết trình lại đòi hỏi những yếu tố khác:
Nano Banana 2 và Nano Banana Pro (Google). Những phiên bản kế nhiệm của mô hình đã giúp việc tạo sự nhất quán trở nên thực tế. Đây vẫn là điểm tham chiếu để giữ cho chủ thể ổn định trong một chuỗi ảnh và cho các chỉnh sửa tôn trọng những gì đã có sẵn trong ảnh. Nano Banana 2 là lựa chọn hàng ngày; Pro dành cho những hình ảnh chính (hero image) cần sự chi tiết.
GPT Image 2.5 (OpenAI). Mô hình mạnh nhất hiện nay trong việc chèn văn bản dễ đọc vào trong hình ảnh, khiến nó trở thành lựa chọn hàng đầu khi bản thân hình ảnh cần chứa nhãn dán, chú thích sơ đồ hoặc một con số. Nó cũng tuân theo các câu lệnh dài và cụ thể rất tốt, vì vậy một yêu cầu chi tiết về bố cục thường sẽ được thực hiện đúng như mong muốn.
FLUX 2 Pro (Black Forest Labs). Độ chân thực của ảnh chụp và ánh sáng. Nếu slide cần một thứ gì đó trông giống như một bức ảnh chụp thực tế hơn là một hình minh họa, thì đây chính là mô hình phù hợp. Black Forest Labs đã ra mắt FLUX 3 vào tháng 7; nhưng FLUX 2 Pro vẫn là phiên bản mà hầu hết các công cụ đang chạy hiện nay.
Seedream 5 Pro (ByteDance). Mạnh về các tác phẩm mang tính nghệ thuật, minh họa và bố cục thẩm mỹ. Một lựa chọn tốt cho các slide trang bìa và slide phân tách phần (section divider) nơi cảm xúc quan trọng hơn độ chính xác.
Recraft 4.1 (Recraft). Được xây dựng cho công việc thiết kế: đầu ra dạng vector, hình khối sạch sẽ, tuân thủ nghiêm ngặt bảng màu. Khi một bài thuyết trình cần các biểu tượng (icon), hình minh họa phẳng (flat illustration) hoặc bất kỳ thứ gì cần đặt cạnh bộ nhận diện thương hiệu mà không bị xung đột, Recraft là mô hình hoạt động hiệu quả nhất.
Qwen Image 2.0 (Alibaba). Nhanh, rẻ và đủ tốt cho hầu hết các hình minh họa trong nội dung. Đây là mô hình đứng sau tính năng tạo hình ảnh trên gói miễn phí của NextDocs.
NextDocs tạo và chỉnh sửa hình ảnh từ bảng phương tiện (media panel). Gói miễn phí sử dụng Qwen Image 2.0. Gói Pro sử dụng Nano Banana, còn Pro+ và Ultra sử dụng Nano Banana 2. Bảng điều khiển này xử lý cả việc tạo ảnh từ câu lệnh lẫn chỉnh sửa hình ảnh bạn đã có, và kết quả sẽ được đưa trực tiếp vào tài liệu.
Shyne cung cấp bộ tùy chọn rộng hơn: GPT Image 2.5 là mặc định, với Nano Banana 2, Nano Banana Pro, FLUX 2 Pro, Seedream 5 Pro và Recraft 4.1 có sẵn trên các gói trả phí, mỗi mô hình đều có tính năng chỉnh sửa tương ứng, và chuyển hình ảnh thành video với Veo 3.1 hoặc Kling 3 khi một bức ảnh tĩnh cần chuyển động. Trong Shyne, bạn yêu cầu trợ lý ảo tạo một hình ảnh thay vì mở một bảng điều khiển: "tạo cho tôi một hình ảnh chính cho slide một theo bảng màu thương hiệu, phong cách ảnh chụp, với sản phẩm đặt trên bàn", và nó sẽ xuất hiện trên khung thiết kế (canvas) để bạn có thể nhìn thấy, sau đó được tinh chỉnh trong cùng một cuộc trò chuyện.
| Slide cần | Hãy chọn |
|---|---|
| Cùng một chủ thể trên nhiều slide | Nano Banana 2 |
| Văn bản bên trong hình ảnh | GPT Image 2.5 |
| Thứ gì đó trông giống như một bức ảnh chụp | FLUX 2 Pro |
| Tâm trạng, bầu không khí, ảnh bìa | Seedream 5 Pro |
| Biểu tượng, hình minh họa phẳng, màu sắc thương hiệu nghiêm ngặt | Recraft 4.1 |
| Hai mươi hình minh họa nhanh trong nội dung | Qwen Image 2.0 hoặc Nano Banana 2 |
Mô tả cả chuỗi ảnh, không chỉ một bức ảnh. "Một bộ gồm sáu hình minh họa theo cùng một phong cách phẳng, bảng màu tím dịu, mỗi hình thể hiện một bước của quá trình làm quen (onboarding)" sẽ giúp bạn có được một bộ ảnh nhất quán từ bất kỳ mô hình nào ở trên. Sáu câu lệnh riêng biệt sẽ cho bạn sáu phong cách khác nhau.
Chỉnh sửa thay vì tạo lại từ đầu. Tất cả các mô hình này hiện đều có thể thay đổi một yếu tố trong hình ảnh hiện có. Nếu hình ảnh của slide bốn đã ổn ngoại trừ màu sắc của chiếc ghế, hãy yêu cầu đổi màu chiếc ghế chứ đừng yêu cầu một hình ảnh mới. Cách này nhanh hơn, rẻ hơn và giữ cho phần còn lại của bài thuyết trình được nhất quán.
Các mô hình hình ảnh sẽ tiếp tục thay đổi sau mỗi vài tháng. Nhưng các thói quen thì không.
Tạo hình ảnh trong NextDocs · Yêu cầu trợ lý Shyne tạo ảnh
Đội ngũ NextDocs

Phân tích sâu về Nano Banana cho tạo hình và chỉnh sửa ảnh: chủ đề nhất quán, chỉnh sửa dựa trên prompt trực quan, lý luận hình ảnh, watermark SynthID, giá cả và hướng dẫn khởi động nhanh.
Đọc thêm
Chúng tôi đã xây dựng lại bảng điều khiển Media dựa trên ba tab rõ ràng: Tải lên, Kho ảnh và AI. Tạo hình ảnh mới và chỉnh sửa các hình ảnh hiện có bằng các mô hình tiên tiến nhất (bao gồm Google Nano Banana), với chi phí minh bạch và quy trình làm việc mượt mà hơn.
Đọc thêm
OpenAI đã đóng ứng dụng Sora vào tháng 4 và sẽ ngừng hoạt động Sora API vào ngày 24 tháng 9 năm 2026. Nếu video từng là một phần trong quy trình thuyết trình của bạn, dưới đây là hai giải pháp hiệu quả hiện nay, một trong NextDocs và một trong Shyne.
Đọc thêm