# Bài viết Liên quan Tạo Hình ảnh

Trung tâm Tin tức HTX cung cấp những bài viết mới nhất và phân tích chuyên sâu về "Tạo Hình ảnh", bao gồm xu hướng thị trường, cập nhật dự án, phát triển công nghệ và chính sách quản lý trong ngành tiền kỹ thuật số.

Bất Ngờ, Google Earth Gấp Rút Rút Lại Tính Năng Tạo Ảnh Nano Banana 2!

Google Earth vừa triển khai tính năng tạo ảnh mới "Nano Banana 2" cho phép người dùng chỉnh sửa cảnh quan thực tế bằng lời nhắc văn bản. Tuy nhiên, chỉ sau một ngày, tính năng này đã bị thu hồi khẩn cấp sau khi cộng đồng mạng "nghịch ngợm" tạo ra những hình ảnh như tượng đài lịch sử Mỹ biến thành phế tích tận thế hay thành phố bị zombie xâm chiếm. Công nghệ mới này sử dụng "ràng buộc không gian địa lý", kết hợp ảnh vệ tinh, dữ liệu độ cao 3D và kiến thức thực tế để tạo ra hình ảnh phù hợp với địa hình thật. Nó hứa hẹn ứng dụng trong giáo dục (tái hiện lịch sử), bất động sản (trực quan hóa dự án) và khám phá. Mặc dù tạo ra hình ảnh chất lượng cao với văn bản chính xác, thời gian xử lý lên tới 2 phút và không khả dụng trong chế độ Street View. Việc tích hợp này đánh dấu chiến lược riêng của Google: tận dụng kho dữ liệu bản đồ độc quyền để tạo ra công cụ AI "hiện thực" dựa trên tọa độ thực, thay vì chỉ cạnh tranh về khả năng nghệ thuật. Tính năng hiện đã được tái triển khai với các biện pháp bảo vệ được tăng cường.

marsbit2 ngày trước 03:58

Bất Ngờ, Google Earth Gấp Rút Rút Lại Tính Năng Tạo Ảnh Nano Banana 2!

marsbit2 ngày trước 03:58

Đây có thể là bức ảnh ấn tượng nhất tại WAIC năm nay!

Mô hình sinh ảnh mới SenseNova U1 Pro của SenseTime vừa ra mắt tại Hội nghị Trí tuệ Nhân tạo Thế giới (WAIC) 2026 đã gây ấn tượng với khả năng xuất ảnh **nguyên bản 8K** và tư duy tạo nội dung phức tạp. Nổi bật với bức tranh cuộn dài "9 năm WAIC 2018-2026", mô hình này không chỉ tạo ra hình ảnh độ phân giải cực cao mà còn duy trì được độ chi tiết, văn bản rõ ràng và bố cục mạch lạc khi phóng to. U1 Pro được định vị là một hệ thống hướng đến việc **giao hàng thành phẩm** cho các nhiệm vụ đa phương thức phức tạp, như thiết kế thông tin, quy hoạch đô thị, poster học thuật hoặc thương mại. Thay vì chỉ sinh ảnh đơn lẻ, nó hoạt động như một quy trình sáng tạo khép kín: hiểu mục tiêu, lập kế hoạch, tổ chức thông tin, tạo nội dung, kiểm tra và sửa lỗi. Bài viết đã kiểm tra U1 Pro qua bốn thử thách: tạo ảnh dài 8K về "24 tiết khí", thiết kế poster phòng lab cao cấp, tạo bức tranh sơn thủy kiến trúc cổ phong với chất liệu pha lê, và thiết kế poster điện ảnh thương mại. Kết quả cho thấy mô hình không chỉ xử lý được các cảnh rộng, yêu cầu phức tạp mà còn có khả năng tổ chức thông tin, phong cách và chi tiết một cách gắn kết, hướng tới sản phẩm có thể sử dụng ngay. Động lực cốt lõi của U1 Pro là sự **thống nhất nguyên bản giữa hiểu, tạo và hành động**. Công nghệ 8K được xử lý thông qua việc sử dụng "patch" lớn (32x32) để giảm tải tính toán, kết hợp với các kỹ thuật kiểm soát nhiễu và lấy mẫu thích ứng để bảo toàn chi tiết. Hướng đi này phản ánh sự phát triển tương tự như trong lĩnh vực AI Coding: từ tạo mã đơn lẻ, đến lập trình theo ý định, và giờ là các tác nhân (Agent) có thể đảm nhận toàn bộ dự án. U1 Pro đại diện cho bước tiến hóa của công cụ sinh ảnh, từ việc "rút thẻ" ngẫu nhiên sang chịu trách nhiệm về kết quả cuối cùng, mở ra cuộc cạnh tranh mới cho các tác nhân đa phương thức trong lĩnh vực thiết kế sáng tạo.

marsbit07/19 02:41

Đây có thể là bức ảnh ấn tượng nhất tại WAIC năm nay!

marsbit07/19 02:41

Mango của 'Tiểu Trát' chỉ thua GPT Image 2 trong việc tạo ảnh, không ai dạy nó sửa bài, nó tự học được

Meta ra mắt mô hình tạo ảnh mới nhất Muse Image, biệt danh "Mango". Trên bảng xếp hạng Arena AI, nó hiện đứng thứ hai, chỉ sau GPT Image 2 của OpenAI. Muse Image hoạt động như một tác nhân AI, tự học cách sửa đổi và cải thiện hình ảnh thông qua học tăng cường. Nó có thể tìm kiếm thông tin trực tuyến, viết mã để tạo biểu đồ hoặc mã QR, và quan trọng nhất là tự sửa lỗi sau khi phản ánh. Một tính năng nổi bật là khả năng @ tên người dùng Instagram công khai để đưa hình ảnh của họ vào ảnh được tạo. Tính năng này mặc định được bật, gây lo ngại về quyền riêng tư. Muse Image được tích hợp với mô hình ngôn ngữ Muse Spark (Avocado) để thực hiện các nhiệm vụ phức tạp. Mô hình video Muse Video, có chung nền tảng với Muse Image, hiện xếp thứ ba trên bảng xếp hạng tạo video. Sức mạnh thực sự của Meta nằm ở khả năng phân phối: Muse Image sẽ được tích hợp vào các ứng dụng có hàng tỷ người dùng như Meta AI, Instagram, WhatsApp và Facebook. Mỗi hình ảnh AI được tạo đều có chữ ký số Content Seal để nhận diện. Tóm lại, Meta không chỉ cạnh tranh về chất lượng hình ảnh mà còn về khả năng biến AI thành một công cụ hàng ngày dễ tiếp cận, mặc dù đi kèm với những thách thức mới về quyền riêng tư.

marsbit07/08 10:41

Mango của 'Tiểu Trát' chỉ thua GPT Image 2 trong việc tạo ảnh, không ai dạy nó sửa bài, nó tự học được

marsbit07/08 10:41

Bản Nano Banana phiên bản video đã ra mắt: Tích hợp kiến thức thế giới của Gemini, tạo ảnh bản gốc chỉ mất 4 giây

Google đã chính thức ra mắt hai mô hình AI đa phương thức mới: Gemini Omni Flash và Nano Banana 2 Lite. Gemini Omni Flash là một mô hình tạo video có khả năng chỉnh sửa video thông qua hội thoại tự nhiên, kết hợp đầu vào đa phương thức (văn bản, hình ảnh, video) và sử dụng kiến thức thế giới của Gemini để xây dựng video chân thực. Mô hình này hiện hỗ trợ tạo video 10 giây với chi phí 0,10 USD mỗi giây đầu ra. Nano Banana 2 Lite (hay gemini-3.1-flash-lite-image) là phiên bản hình ảnh nhanh và tiết kiệm chi phí. Nó có thể tạo hình ảnh độ phân giải 1K chỉ trong khoảng 4 giây với giá khoảng 0,034 USD mỗi hình, giữ lại khả năng kết xuất văn bản xuất sắc. Điểm đáng chú ý là hai mô hình này có thể được kết hợp để tạo ra quy trình làm việc liền mạch: tạo hình ảnh nhanh chóng với Nano Banana 2 Lite, sau đó sử dụng hình ảnh đó làm tài liệu tham chiếu để Gemini Omni Flash tạo ra video động. Google đã minh họa tiềm năng này qua các ứng dụng demo như du lịch ảo (Anywhere), thiết kế nội thất (Space Lift) và tạo nội dung tiếp thị thương mại điện tử (Omni Product Studio). Những phát triển này cho thấy chiến lược của Google là tập trung vào việc áp dụng AI đa phương thức vào các ngành dọc cụ thể như thương mại điện tử, quảng cáo và sáng tạo nội dung, tận dụng lợi thế hệ sinh thái Android để thúc đẩy thương mại hóa.

marsbit07/01 01:56

Bản Nano Banana phiên bản video đã ra mắt: Tích hợp kiến thức thế giới của Gemini, tạo ảnh bản gốc chỉ mất 4 giây

marsbit07/01 01:56

活动图片