Google trình làng Nano Banana 2.1, tạo ảnh AI với chi phí giảm một nửa

(CLO) Ngày 6/10, Google đã chính thức trình làng Nano Banana 2.1, phiên bản mới nhất của mô hình trí tuệ nhân tạo (AI) chuyên tạo và chỉnh sửa hình ảnh từ câu lệnh văn bản.

Mô hình nâng cấp này hiện đang được triển khai trên diện rộng trong hệ sinh thái sản phẩm của hãng, bao gồm ứng dụng Gemini, Chế độ AI (AI Mode) trong Google Search, Google Ads, cùng các công cụ dành cho nhà phát triển như Google AI Studio, Flow, Stitch và nền tảng Gemini Enterprise Platform.

Đại diện phía Google, ông Robby Stein, Phó Chủ tịch phụ trách sản phẩm Tìm kiếm, xác nhận rằng người dùng có thể trải nghiệm ngay mô hình mới bằng cách mở ứng dụng Google và nhấn vào biểu tượng quả chuối nằm ngay bên dưới ô tìm kiếm.

1791304917-google-nano-banana-21.jpg
Google trình làng Nano Banana 2.1. Ảnh: Google

Được đánh giá là sự thay thế mạnh mẽ cho thế hệ tiền nhiệm, Nano Banana 2.1 mang đến những cải tiến vượt bậc về mặt thị giác và hiệu suất xử lý bối cảnh. Trong thông báo chính thức trên mạng xã hội X, Google khẳng định: "Phiên bản nâng cấp này vượt trội hơn các mô hình trước đây của chúng tôi trên mọi khía cạnh, với những bước tiến đáng kể về thiết kế trực quan, chỉnh sửa dựa trên vùng chọn và tính nhất quán của chủ thể để giúp bạn tạo ra những hình ảnh tự nhiên hơn".

Điểm nổi bật của Nano Banana 2.1 nằm ở khả năng xử lý chữ viết và đồ họa thông tin (infographic) với độ chính xác cao, khắc phục triệt để tình trạng ký tự bị biến dạng hay xáo trộn vốn thường xuất hiện ở các công cụ tạo ảnh AI trước đây. Mô hình hỗ trợ tổng hợp đồng thời tối đa 14 hình ảnh tham chiếu, đảm bảo giữ nguyên diện mạo cho tối đa 4 nhân vật và 10 vật thể qua nhiều lượt chỉnh sửa liên tiếp.

Bên cạnh đó, khả năng tích hợp công nghệ kết nối dữ liệu (grounding) với Google Web Search và Google Image Search giúp mô hình truy xuất hình ảnh bối cảnh thực tế chính xác hơn trước khi vẽ. Xuất ra các độ phân giải 1K, 2K và 4K, Nano Banana 2.1 cũng giải quyết triệt để sự cố lặp ô thị giác ở các tỷ lệ khung hình siêu rộng như 1:4, 4:1, 1:8 hay 8:1. Mọi sản phẩm tạo ra đều được nhúng dấu bản quyền SynthID ẩn để bảo đảm tính minh bạch nội dung.

Cùng với bước nhảy vọt về mặt kỹ thuật, Google gây bất ngờ khi ấn định mức chi phí tạo ảnh qua giao diện API giảm một nửa so với Nano Banana 2. Cụ thể, mỗi bức ảnh tiêu chuẩn kích thước 1K có giá 0.0336 USD thay vì 0.067 USD, trong khi bức ảnh độ phân giải 4K chỉ tiêu tốn 0.0756 USD so với mức 0.151 USD như trước đây. Khi xử lý số lượng lớn (batch processing), các nhà phát triển còn được giảm thêm 50% chi phí.

screenshot-2026-10-07-at-063324.jpg
So sánh chi phí giữa các mô hình. Ảnh: Google

Mặc dù giá xuất ảnh giảm mạnh, chi phí dữ liệu đầu vào (input tokens) lại tăng gấp 3 lần, lên mức 1,5 USD cho mỗi triệu token, do đó các tác vụ chỉnh sửa phức tạp mang theo nhiều ảnh tham chiếu đòi hỏi người dùng phải tính toán cẩn thận để tối ưu hóa ngân sách.

Về mặt hiệu năng, các bài kiểm tra nội bộ của Google chỉ ra rằng Nano Banana 2.1 đạt 1,050 điểm ELO ở tiêu chí đánh giá mức độ ưa thích tổng thể khi tạo ảnh từ văn bản, vượt qua cả Nano Banana 2 (990 điểm) lẫn dòng cao cấp Nano Banana Pro (935 điểm). Xét về tiêu chí độ chính xác của đồ họa thông tin, mô hình đạt 0.521 điểm, vượt trội hơn hẳn con số 0.179 của thế hệ trước.

Với sự ra mắt chính thức của Nano Banana 2.1, tập đoàn công nghệ Mỹ cũng đưa ra thông báo ngừng hỗ trợ đối với Nano Banana 2 và sẽ chính thức đóng cửa mô hình cũ này vào ngày 29/10. Google khuyến nghị tất cả các nhà phát triển mau chóng chuyển đổi hệ thống sang Nano Banana 2.1 để đảm bảo quy trình vận hành không bị gián đoạn.

Xem thêm

Cựu kỹ sư OpenAI cảnh báo các công ty AI chưa đủ an toàn

Cựu kỹ sư OpenAI cảnh báo các công ty AI chưa đủ an toàn

(CLO) Một cựu kỹ sư an toàn của OpenAI cảnh báo các công ty trí tuệ nhân tạo (AI) đang phát triển công nghệ quá nhanh và chưa áp dụng các biện pháp an toàn cần thiết, chỉ vài ngày sau khi Tổng thống Mỹ Donald Trump công bố thỏa thuận tự nguyện với 6 công ty AI lớn.

Nhật Bản lần đầu bảo vệ giọng nói con người trước sự sao chép của AI

Nhật Bản lần đầu bảo vệ giọng nói con người trước sự sao chép của AI

(CLO) Xác lập tiền lệ pháp lý quan trọng về bản quyền trong kỷ nguyên số, Tòa án Tokyo lần đầu tiên công nhận giọng nói của một cá nhân được bảo hộ theo quyền khai thác thương mại hình ảnh và danh tiếng, sau phán quyết trong vụ kiện liên quan đến hành vi dùng AI giả lập giọng của diễn viên lồng tiếng nổi tiếng Kenjiro Tsuda.

Chính phủ Mỹ cho ra mắt cổng thông tin tích hợp AI

Chính phủ Mỹ cho ra mắt cổng thông tin tích hợp AI

(CLO) Ngày 29/9, Tổng thống Mỹ Donald Trump đã chính thức công bố nền tảng kỹ thuật số America.gov, đánh dấu một bước tiến quan trọng trong việc ứng dụng trí tuệ nhân tạo vào dịch vụ công tại nước này.

EU đề xuất cấm trẻ dưới 13 tuổi sử dụng mạng xã hội

EU đề xuất cấm trẻ dưới 13 tuổi sử dụng mạng xã hội

(CLO) Chủ tịch Ủy ban châu Âu Ursula von der Leyen ngày 17/9 công bố kế hoạch tăng cường bảo vệ trẻ em trên môi trường số, trong đó đề xuất cấm trẻ dưới 13 tuổi sử dụng mạng xã hội và yêu cầu các nền tảng thiết kế dịch vụ an toàn hơn cho người dùng nhỏ tuổi.

Cỡ chữ bài viết: