OpenAI ra mắt GPT Image mới, vượt mặt Image 2, cuối cùng cũng hết hiệu ứng 'nhựa'

marsbitXuất bản vào 2026-08-10Cập nhật gần nhất vào 2026-08-10

Tóm tắt

OpenAI vừa trình làng mô hình hình ảnh mới có mã danh "mona-lisa-1" trên LM Arena. Qua các bài kiểm tra thực tế, mô hình này được đánh giá vượt trội so với GPT Image 2 về độ chân thực, giảm đáng kể cảm giác "nhựa" và cải thiện chi tiết, ánh sáng cùng độ phong phú trong hình ảnh. Nó xử lý tốt nhiều tác vụ phức tạp như tạo giao diện web, sơ đồ thông tin, hình ảnh y khoa chi tiết và cả tranh nghệ thuật. Bằng chứng từ công cụ SynthID xác nhận đây là sản phẩm của OpenAI. Mô hình dường như được huấn luyện từ năm ngoái, với kiến thức cập nhật đến năm 2025, tương tự GPT Image 2. Điều này cho thấy nó có thể là một phiên bản checkpoint mới được phát triển trên nền tảng hiện có hơn là một kiến trúc hoàn toàn mới. Hậu tố "-1" trong mã danh ám chỉ rằng đây có thể chưa phải là phiên bản cuối cùng. Việc OpenAI liên tục nâng cấp và tự vượt mặt chính mình, chỉ bốn tháng sau khi GPT Image 2 ra mắt, cho thấy tốc độ phát triển nhanh chóng trong lĩnh vực AI tạo sinh hình ảnh và hứa hẹn một bước tiến lớn hơn nữa khi phiên bản chính thức được công bố.

OpenAI sắp tung đòn lớn tiếp theo!

Hôm nay, một mô hình hình ảnh hoàn toàn mới, mã danh mona-lisa-1, đã chính thức xuất hiện trên Arena.

Người dùng thử nghiệm trực tiếp đều kinh ngạc, hiệu quả tạo ảnh của mona-lisa-1 thực sự đỉnh cao, có thể nhìn thấy rõ ràng là đã vượt qua GPT Image 2.

Hình ảnh chân thực hơn, hiệu ứng "nhựa" giảm đi đáng kể.

Vua mới của GPT Image sắp xuất hiện

Bốn tháng trước, GPT Image 2 xuất hiện gây kinh ngạc, ngay lập tức làm nổ cộng đồng AI.

Khi đó, Image 2 thẳng tay đè bẹp Nano Banana Pro, và cho đến nay vẫn giữ vững ngôi vương tạo ảnh AI.

Nhưng bây giờ, biến cục đã đến.

Một mô hình ẩn danh mang mã danh "mona-lisa-1" đã lặng lẽ lao vào bảng xếp hạng mù LM Arena.

Người dùng @AiBattle_ đã điều tra kỹ lưỡng, ném hình ảnh do nó tạo ra vào công cụ xác minh của OpenAI để kiểm tra —

Ôi trời, ngay lập tức quét ra watermark SynthID! Vụ án đã được phá, đòn lớn bí ẩn này một lần nữa lại do OpenAI tung ra.

Có vẻ lần này, OpenAI đã quyết tâm "cuốn" chết chính mình.

Hiệu ứng nhựa biến mất

Nhà phát triển Riccardo Wolf đã đưa cùng một prompt cho cả hai mô hình này.

Từ đầu ra dưới đây có thể thấy, mona-lisa-1 có cảm giác chân thực tốt hơn một chút, và hiệu ứng nhựa cũng giảm đi.

Từ trái sang phải: Image 2 (medium); mona-lisa-1; Image 2 (high)

Lấy ví dụ về ảnh chân dung người thật Ultraman được tạo ra, sự cải thiện về chất lượng này đặc biệt rõ ràng.

Trong mắt người dùng Tim Jayas, hiệu quả đầu ra của mona-lisa-1 chi tiết phong phú hơn nhiều.

Ngoài ra, khi tạo ra các tác phẩm nghệ thuật đầy ý cảnh như thế này, mona-lisa-1 cũng thể hiện trình độ thẩm mỹ cực cao.

Dù là sự lan tỏa của màu sắc, tầng thứ của ánh sáng và bóng tối, hay việc tạo dựng bầu không khí tổng thể, đều đã thoát khỏi hoàn toàn "mùi thuật toán" cứng nhắc của hội họa AI trước đây.

Biểu đồ thông tin, phức tạp hơn

GPT Image vốn đã rất giỏi trong việc tạo ra các biểu đồ thông tin phức tạp.

Trong thử nghiệm thực tế, có người dùng mona-lisa-1 để tạo ngay ra một giao diện người dùng web, hiệu ứng hình ảnh rất chân thực.

Ngay cả "Sơ đồ giải phẫu cơ quan cơ thể người" cực kỳ thử thách chi tiết, mona-lisa-1 cũng xử lý dễ dàng.

Dù là "Tổng quan GPT-5 bằng một hình ảnh" có mật độ thông tin cao, hay "Chân dung tự họa riêng cho ChatGPT" đầy trí tưởng tượng, nó đều có thể tạo ra chính xác.

Nó còn có thể bắt chước nét chữ của Einstein và xuất ra thành phẩm trực tiếp.

Có người cho rằng, mô hình hình ảnh mới của ChatGPT một lần nữa kết thúc cuộc cạnh tranh.

Một prompt đơn giản, có thể tạo ra ngay một hình nền anime.

Còn rất nhiều Demo thần thánh khác, xem trực tiếp hình ảnh:

"Bộ não" không đổi

Huấn luyện hoàn thành năm ngoái

Một số nhà phát triển tinh ý phát hiện, việc huấn luyện mona-lisa-1 rất có thể đã kết thúc vào năm ngoái.

@ivanainai đã tiến hành liên tục 5 lần thử nghiệm liên quan đến ngày tháng, câu trả lời của mô hình không ngoại lệ nào đều dừng lại ở năm 2025.

Sau đó, cô ấy thử để mô hình xử lý nội dung liên quan đến tin tức mới nhất, đều thất bại. Tất nhiên, điều này ở một mức độ nào đó cũng là do phiên bản ẩn danh này chưa mở chức năng kết nối mạng.

Điều đáng suy ngẫm là, nếu so sánh ngang hàng: thời điểm cắt của cơ sở kiến thức GPT Image 2, cũng chính xác là tháng 12 năm 2025.

Nghĩa là, từ thông tin ít ỏi lộ ra hiện tại —

mona-lisa-1 giống như một checkpoint mới trên nền tảng cùng thế hệ, chứ không phải thay một bộ não khác.

Thậm chí, cảm giác của một số người sau nhiều vòng thử nghiệm là, mona-lisa-1 chỉ là phiên bản vừa (medium) của Image 2.5.

Mặt khác, số "-1" ở cuối mã danh hầu như đã ngầm chỉ: sau này sẽ còn có các checkpoint mới lần lượt xuất hiện.

Nghĩa là, phiên bản đang được thử nghiệm này, chưa chắc đã là hình thái cuối cùng của GPT Image hoàn toàn mới.

Nếu mona-lisa-1 thực sự chỉ là một checkpoint trung gian, thì phiên bản chính thức mà OpenAI cuối cùng mang ra, có lẽ còn tiến thêm một bước lớn nữa.

GPT Image 2 mới lên ngôi được bốn tháng, OpenAI đã bắt đầu tự tay làm mới kỷ lục của chính mình.

Theo nhịp độ này, khi phiên bản chính thức thực sự được phát hành, trần nhà của việc tạo ảnh AI, e rằng lại phải được nâng lên một bậc.

Tiếp theo, hãy xem OpenAI khi nào sẽ vén màn bộ mặt thật của mona-lisa.

Tài liệu tham khảo:

https://x.com/AiBattle_/status/2086405404368503240?s=20

Bài viết này đến từ tài khoản WeChat công chúng "Tân Trí Nguyên", tác giả: ASI Khải Thị Lục, biên tập: Đào Tử

Câu hỏi Liên quan

QMô hình hình ảnh mới của OpenAI có tên mã là gì?

AMô hình mới có tên mã là "mona-lisa-1".

QTheo bài viết, mona-lisa-1 có những cải tiến đáng chú ý nào so với GPT Image 2?

Amona-lisa-1 có hình ảnh chân thực hơn, giảm rõ rệt cảm giác "nhựa" (plastic), chi tiết phong phú hơn và khả năng xử lý hình ảnh thông tin phức tạp tốt hơn.

QLàm thế nào mà cộng đồng mạng xác định mona-lisa-1 là sản phẩm của OpenAI?

ANgười dùng @AiBattle_ đã kiểm tra ảnh do mô hình tạo ra bằng công cụ xác minh của OpenAI và phát hiện ra hình mờ SynthID - một công nghệ của OpenAI, từ đó xác định nguồn gốc.

QBài viết đề cập kiến thức của mona-lisa-1 được cập nhật đến thời điểm nào? Điều này cho thấy điều gì?

AKiến thức của mona-lisa-1 được cập nhật đến năm 2025, giống với GPT Image 2. Điều này cho thấy nó có thể chỉ là một phiên bản cải tiến (checkpoint mới) trên cùng nền tảng chứ không phải một mô hình hoàn toàn khác.

QTên mã "mona-lisa-1" gợi ý điều gì về các bản phát hành trong tương lai?

AHậu tố "-1" trong tên mã gợi ý rằng đây có thể chỉ là phiên bản đầu tiên và sẽ còn nhiều phiên bản checkpoint hoặc phiên bản nâng cấp khác xuất hiện trong tương lai.

Nội dung Liên quan

Khi “Odysseus” Gặp Gỡ Thuật Toán

"Khi 'Odysseus' gặp gỡ thuật toán" so sánh sự đối đầu giữa điện ảnh truyền thống và AI thông qua hai phiên bản phim "Odyssey" năm 2026. Phiên bản của đạo diễn Christopher Nolan, kinh phí 2.5 tỷ USD, quay phim IMAX trên khắp 6 quốc gia với các hiệu ứng thực tế công phu, đã thu về hơn 1 tỷ USD doanh thu phòng vé toàn cầu, đẩy giá cổ phiếu IMAX tăng mạnh. Ngược lại, phim "Odysseus: The Fall" do studio Fountain0 sản xuất hoàn toàn bằng AI chỉ tốn 50,000 USD, chứng minh tính khả thi về mặt kỹ thuật nhưng doanh thu trực tuyến hạn chế và thiếu mô hình kinh doanh bền vững. Bài viết phân tích những hạn chế hiện tại của phim AI: cảnh quay ngắn, thiếu tính nhất quán, biểu cảm nhân vật trung bình và đặc biệt là sự phá hủy tính "khan hiếm" - yếu tố tạo ra giá trị và trải nghiệm điện ảnh cao cấp. Trong khi đó, cách làm phim "không hiệu quả" của Nolan lại tạo ra sự khác biệt, sự kiện có tính nghi lễ và một bảo chứng vật lý cho nhà đầu tư. AI được dự đoán sẽ thay đổi sâu sắc các khâu sản xuất hậu kỳ và hiệu ứng, thay thế các công việc lặp đi lặp lại, nhưng khó thay thế được quyết định sáng tạo cốt lõi. Mối lo ngại lớn là AI có thể làm cạn kiệt nguồn ngân sách và cơ hội thực hành cho các đạo diễn trẻ, khiến nền điện ảnh đại chúng bị chia rẽ giữa các "tác phẩm thủ công" xa xỉ và "sản phẩm tiêu dùng" vô hạn từ AI. Cuộc đối đầu này phản ánh sự không thể dung hòa giữa "logic hiệu suất" của thuật toán và "logic trải nghiệm" của nghệ thuật. Giống như Odysseus chọn con đường gian khó để trở về quê hương, giá trị đích thực có thể nằm ở những hành trình đầy thách thức khiến chúng ta cảm thấy "đang sống", chứ không phải ở lối đi dễ dàng do thuật toán vạch ra.

marsbit36 phút trước

Khi “Odysseus” Gặp Gỡ Thuật Toán

marsbit36 phút trước

Thị trường văn phòng quý III tại Bắc Kinh: Nhu cầu đầu tư và mua sắm tự sử dụng sẽ phục hồi song song

**Tóm tắt thị trường văn phòng Bắc Kinh quý III/2026** Nhu cầu thuê văn phòng tại Bắc Kinh đang được định hình lại bởi sự phân hóa ngành kinh tế. Các ngành công nghệ cao như AI, bán dẫn và năng lượng mới tiếp tục mở rộng, thúc đẩy nhu cầu, trong khi các ngành truyền thống có thể thu hẹp diện tích. Giá thuê dự kiến tiếp tục giảm, nhưng mức giảm sẽ thu hẹp tại các khu thương mại có khả năng đáp ứng doanh nghiệp công nghệ cao. Xu hướng tập trung vào các khu vực có hệ sinh thái ngành mạnh và việc ứng dụng AI tối ưu hiệu suất lao động cũng ảnh hưởng đến nhu cầu không gian. Thị trường giao dịch lớn (大宗交易) cho thấy dấu hiệu phục hồi với sự song hành của nhu cầu đầu tư và mua tự dùng. Các nhà đầu tư tìm kiếm tài sản có dòng tiền thuê ổn định tại các khu vực trọng điểm công nghệ. Đồng thời, các doanh nghiệp công nghệ cao ngày càng quan tâm đến việc mua văn phòng làm trụ sở tự có. **Khuyến nghị:** * **Đối với người thuê:** Tập trung vào các dự án chất lượng cao, đặc biệt tại các khu như Quốc Mậu (国贸) nếu hình ảnh là yếu tố quan trọng. Tận dụng thương hiệu để đàm phán các điều khoản thuê có lợi. * **Đối với chủ sở hữu:** Chuyển đổi thành nhà cung cấp dịch vụ doanh nghiệp, xây dựng dịch vụ hỗ trợ ngành và có chính sách giữ chân người thuê linh hoạt. * **Đối với bên mua:** Nhà đầu tư nên cân nhắc các tòa nhà có tỷ lệ lấp đầy cao tại khu vực như Trung Quan Thôn (中关村). Bên mua tự dùng có thể tìm kiếm cơ hội tại các tòa nhà có áp lực tài chính, cần đánh giá kỹ chi phí cải tạo. **Tình hình quý II/2026:** * **Thị trường cho thuê:** Giá thuê trung bình giảm 2.7% xuống 197 CNY/m²/tháng. Tỷ lệ trống là 16.3%. Các giao dịch lớn được ghi nhận tại các khu công nghệ cao như Trung Quan Thôn và Vọng Kinh - Tửu Tiên Kiều (望京-酒仙桥). * **Thị trường giao dịch lớn:** Tổng giá trị giao dịch đạt 14.2 tỷ CNY. Giá bán trung bình tăng 24% lên 38,312 CNY/m², một phần do các giao dịch mua tự dùng tại các khu vực trọng điểm. Giao dịch đáng chú ý: một quỹ chuyên trách do các công ty bảo hiểm dẫn đầu đã mua tòa nhà Dinghao DH3 ở Trung Quan Thôn với giá 6.1 tỷ CNY.

marsbit43 phút trước

Thị trường văn phòng quý III tại Bắc Kinh: Nhu cầu đầu tư và mua sắm tự sử dụng sẽ phục hồi song song

marsbit43 phút trước

"Lý thuyết âm mưu" ở Wall Street: Phải chăng Walsh cố ý đẩy lợi suất trái phiếu dài hạn Mỹ lên cao?

Thị trường lan truyền tin đồn Chủ tịch Fed Powell cố ý đẩy lợi suất trái phiếu dài hạn lên cao thông qua các cuộc họp báo để thắt chặt điều kiện tài chính. Tuy nhiên, BofA Securities bác bỏ luận điểm này, cho rằng nó không phù hợp với khuôn khổ hoạt động của Fed và khó nhận được sự ủng hộ từ FOMC. Báo cáo của BofA ngày 7/8 nhấn mạnh, theo Tuyên bố Chiến lược Chính sách Tiền tệ, công cụ chính sách chính của FOMC là điều chỉnh lãi suất quỹ liên bang. Fed chỉ sử dụng các công cụ rộng hơn khi lãi suất này ở mức thấp hiệu quả. Powell không có quyền đơn phương thay đổi cách thức thực thi chính sách. Về mặt vận hành, Fed có khả năng kiểm soát trực tiếp và chính xác lãi suất qua đêm, trong khi ảnh hưởng đến lãi suất dài hạn rất hạn chế, chủ yếu thông qua kỳ vọng chính sách hoặc phần bù kỳ hạn (term premium) - một yếu tố khó kiểm soát và dễ biến động mạnh. Việc lãi suất dài hạn tăng mạnh gần đây chính là lời cảnh báo về rủi ro khi Fed hoạt động ngoài phạm vi kiểm soát trực tiếp. Do đó, FOMC khó có khả năng ủng hộ các công cụ chính sách chưa được kiểm chứng đầy đủ như vậy. Kết luận của BofA rõ ràng: Powell không thể đơn phương thay đổi thông lệ của FOMC, và Ủy ban này nhiều khả năng sẽ tiếp tục sử dụng lãi suất qua đêm làm công cụ chính sách cốt lõi. Lý thuyết về việc thao túng lãi suất dài hạn chỉ là cách diễn giải quá mức của thị trường.

marsbit43 phút trước

"Lý thuyết âm mưu" ở Wall Street: Phải chăng Walsh cố ý đẩy lợi suất trái phiếu dài hạn Mỹ lên cao?

marsbit43 phút trước

Báo cáo từ BofA: Chỉ số Bull & Bear tăng lên 9.7, Đảm bảo thanh khoản và Bầu cử giữa kỳ tạo nên mâu thuẫn cốt lõi của thị trường

Báo cáo của BofA cho thấy chỉ số Bull & Bear đã tăng lên mức 9.7 - mức cao nhất kể từ năm 2021 và sắp chạm ngưỡng bán tháo. Dòng tiền tuần trước chảy mạnh vào tiền mặt (52.9 tỷ USD), cổ phiếu (32.9 tỷ USD) và trái phiếu (23.1 tỷ USD). BofA nhận định ý đồ hỗ trợ thanh khoản từ các nhà hoạch định chính sách là rõ ràng, được minh chứng bởi cuộc can thiệp tỷ giá phối hợp gần đây. Tuy nhiên, ba mâu thuẫn cốt lõi đang hình thành: chỉ số Bull & Bear ở vùng cực đoan, chênh lệch tín dụng của các công ty AI siêu lớn vẫn mở rộng, và sự bất ổn từ cuộc bầu cử giữa kỳ đang gia tăng. Do đó, chiến lược được đề xuất là "Rút lui hoặc Luân chuyển" - rời khỏi tài sản rủi ro hoặc luân chuyển sang các lĩnh vực phòng thủ (như hàng tiêu dùng thiết yếu), tài sản có thời gian đáo hạn dài (như REITs, cổ phiếu vốn hóa nhỏ) và đồng USD. Bầu cử giữa kỳ được xác định là biến số vĩ mô lớn nhất nửa cuối năm, có thể định hình lại câu chuyện thị trường. Trong khi hỗ trợ thanh khoản tạo ra một "tấm đệm" phía dưới, chỉ số Bull & Bear ở mức 9.7 cho thấy không gian tăng giá đã được định giá đầy đủ. Báo cáo cũng lưu ý đến dữ liệu việc làm tháng 7 và diễn biến chính sách tại Jackson Hole như những yếu tố then chốt sắp tới.

marsbit46 phút trước

Báo cáo từ BofA: Chỉ số Bull & Bear tăng lên 9.7, Đảm bảo thanh khoản và Bầu cử giữa kỳ tạo nên mâu thuẫn cốt lõi của thị trường

marsbit46 phút trước

Giao dịch

Giao ngay
活动图片