Mục lục
TL;DR: OpenAI đã bắt đầu triển khai ChatGPT Images 2.5, mô hình tạo ảnh mới mà công ty cho biết có thể tạo ảnh nhanh hơn tới 50% so với Images 2.0, đồng thời cải thiện khả năng chỉnh sửa và kiểm soát sáng tạo.
Bản cập nhật xuất hiện trong ChatGPT, ChatGPT Work và Codex trên desktop, web lẫn thiết bị di động. Theo OpenAI, người dùng có thể kỳ vọng ảnh có ánh sáng và kết cấu tự nhiên hơn, giữ chủ thể tốt hơn khi dùng ảnh tham chiếu, cũng như thực hiện chuỗi chỉnh sửa nhiều lượt ổn định hơn.
Cùng với mô hình mới, OpenAI bổ sung một số công cụ giao diện nhằm giúp người dùng mô tả ý tưởng bằng hình ảnh thay vì chỉ dựa vào câu lệnh chữ. Với nhà phát triển, hãng phát hành hai model API là GPT-Image-2.5 Flare và GPT-Image-2.5 Sunburst, nhắm đến nhu cầu từ tạo nội dung số lượng lớn đến quy trình sáng tạo cần kiểm soát kỹ.
Cải thiện trọng tâm là tốc độ và độ bám yêu cầu
OpenAI cho biết độ trễ tạo ảnh của Images 2.5 giảm tới 50% so với Images 2.0. Đây là thay đổi đáng chú ý với các tác vụ thường phải thử nhiều phương án, rồi tiếp tục sửa bố cục, màu sắc hoặc chi tiết trước khi có bản dùng được.
Hãng cũng nói mô hình mới bám ảnh tham chiếu tốt hơn. Chẳng hạn, khi biến đổi một người, vật thể hoặc không gian sang phong cách và bối cảnh khác, các đặc điểm nhận diện của chủ thể có khả năng được giữ lại tốt hơn. Đây là một tuyên bố của OpenAI; chất lượng thực tế vẫn phụ thuộc vào ảnh đầu vào và mức độ phức tạp của yêu cầu.
Ở khâu chỉnh sửa, Images 2.5 được thiết kế để thay đổi đúng vùng hoặc yếu tố được yêu cầu, trong khi giữ nguyên những phần còn lại của ảnh. Công ty nêu các tình huống như thay sản phẩm, nền hoặc phần chữ mà vẫn bảo toàn chủ thể, bố cục và cách thể hiện thương hiệu xung quanh.
Chỉnh sửa nhiều lượt và xử lý bố cục phức tạp
Một vấn đề phổ biến của công cụ tạo ảnh là kết quả dễ trôi khỏi bản ban đầu sau mỗi lần sửa tiếp theo. OpenAI cho biết Images 2.5 cải thiện tính nhất quán qua nhiều lượt trong cùng cuộc trò chuyện: các thay đổi trước đó có nhiều khả năng được duy trì, còn yêu cầu mới sẽ được bổ sung mà không làm giảm chất lượng ảnh theo thời gian.
Theo hãng, mô hình cũng hiểu tốt hơn các chỉ dẫn thị giác phức tạp, xử lý thông tin đời thực chính xác hơn và hỗ trợ những bố cục khó hơn, gồm ảnh nền trong suốt. Với doanh nghiệp, điều này có thể hữu ích khi tạo một loạt tài sản sáng tạo theo visual guideline nhất quán, phác thảo giao diện cần giữ thứ bậc bố cục, hoặc hình ảnh trình bày theo cấu trúc xác định.
Sketch, template và bình luận trực tiếp trên ảnh
Tính năng mới đáng chú ý trong ChatGPT là Sketch. Người dùng có thể vẽ trực tiếp một phác thảo đơn giản để làm tham chiếu, sau đó thêm mô tả về phong cách và chi tiết mong muốn để hệ thống tạo ảnh hoàn chỉnh. OpenAI gợi ý Sketch có thể dùng để phác bố trí căn phòng, đường nét trang phục hoặc một hình vẽ nhanh; không yêu cầu kỹ năng vẽ chuyên nghiệp.

Nguồn ảnh: OpenAI | Tính năng Sketch trên ChatGPT Images 2.5
ChatGPT cũng bổ sung template cho một số định dạng sáng tạo phổ biến như poster, hàng hóa in thiết kế và ảnh sản phẩm. Thay vì bắt đầu từ khung trống, người dùng chọn mẫu rồi điền nội dung, thành phần thiết kế và phong cách cần cá nhân hóa.
Ngoài ra, người dùng có thể thêm chú thích trực tiếp lên ảnh để hướng dẫn chỉnh sửa tập trung hơn. Khi chia sẻ ảnh, họ cũng có thể đính kèm prompt đã dùng, để người khác tái sử dụng ý tưởng đó với ảnh và thông tin riêng của mình.

Nguồn ảnh: OpenAI | Hình ảnh được tạo từ ChatGPT Images 2.5
Hai lựa chọn mới cho nhà phát triển qua API
GPT-Image-2.5 Flare là lựa chọn mặc định cho phần lớn ứng dụng API, theo OpenAI. Model này mang các cải tiến về chất lượng, chỉnh sửa và tốc độ của Images 2.5; hãng cho biết Flare có chất lượng cao hơn GPT-Image-2 với độ trễ thấp hơn 50%. Các trường hợp sử dụng được nêu gồm nội dung cho nhà sáng tạo và mạng xã hội, trải nghiệm sản phẩm, tìm kiếm bằng hình ảnh, phác thảo nhanh và tạo ảnh khối lượng lớn.
Trong khi đó, GPT-Image-2.5 Sunburst hướng đến quy trình hình ảnh cao cấp cần kiểm soát chặt hơn qua các lần chỉnh sửa. OpenAI định vị model này cho các tài sản chiến dịch có thể đưa vào sản xuất hoặc ảnh sản phẩm được hoàn thiện kỹ, đổi lại thời gian tạo ảnh dài hơn.
Khả dụng và biện pháp nhận diện ảnh AI
Images 2.5 đang được triển khai cho mọi gói ChatGPT, ChatGPT Work và Codex trên desktop, mobile và web. Hai model Flare và Sunburst cũng đã khả dụng qua API; OpenAI cho biết chi phí sử dụng được công bố trên trang giá API riêng.
Về an toàn, OpenAI nói tiếp tục kiểm tra prompt và ảnh nhằm ngăn đầu ra gây hại. Ảnh tạo bằng công cụ của hãng vẫn sử dụng metadata C2PA, một chuẩn lưu thông tin nguồn gốc nội dung, cùng watermark vô hình để hỗ trợ nhận diện. Các cơ chế này giúp bổ sung tín hiệu về xuất xứ ảnh, nhưng không tự loại bỏ mọi rủi ro liên quan đến nội dung tổng hợp hoặc việc ảnh bị chỉnh sửa sau khi tạo.
Vì sao đáng chú ý?
Cuộc cạnh tranh trong tạo ảnh AI đang chuyển dần từ việc tạo một hình ảnh ấn tượng sang khả năng đưa công cụ vào quy trình làm việc lặp lại. Tốc độ, tính ổn định qua nhiều lượt chỉnh sửa và khả năng giữ đúng chủ thể từ ảnh tham chiếu là các yếu tố quan trọng hơn với đội ngũ marketing, bán lẻ, truyền thông và phát triển sản phẩm. Việc OpenAI đưa cả công cụ vẽ phác trong ChatGPT lẫn hai phân khúc model API cho thấy hãng đang nhắm tới nhiều mức độ sử dụng, từ người dùng phổ thông đến các hệ thống tích hợp trong doanh nghiệp.
- Nguồn chính thức: Introducing ChatGPT Images 2.5 — OpenAI — 08/09/2026

