Google phát hành mô hình hình ảnh Nano Banana 2.1, giá gọi cho các nhà phát triển khoảng một nửa so với thế hệ trước
Google đã phát hành mô hình tạo và chỉnh sửa hình ảnh mới nhất Nano Banana 2.1 vào ngày 6 tháng 10, và đã được triển khai trên ứng dụng Gemini, chế độ AI của Google Search, Google Ads cũng như các công cụ phát triển như Google AI Studio, Flow, Stitch. Mô hình này có thể tạo hình ảnh từ mô tả văn bản và cũng có thể chỉnh sửa các bức ảnh đã có.
Google cho biết lần nâng cấp này tập trung vào ba khía cạnh: thiết kế hình ảnh, chỉnh sửa dựa trên mặt nạ (chỉ thay đổi khu vực đã được đánh dấu) và tính nhất quán của chủ thể, tức là nhân vật hoặc vật thể vẫn giữ được đặc điểm ban đầu sau nhiều lần chỉnh sửa. Trong bài kiểm tra sở thích tổng thể về văn bản sinh hình, Nano Banana 2.1 đạt 1050 điểm ELO, cao hơn so với 990 điểm của Nano Banana 2 và 935 điểm của Nano Banana Pro. Mô hình này có thể xử lý tối đa 14 hình ảnh tham khảo cùng lúc, theo dõi 4 nhân vật và 10 vật thể, xuất ra độ phân giải tối đa 4K, tỷ lệ khung hình tối đa 8:1, các nhà phát triển cũng có thể thiết lập thời gian suy nghĩ trước khi tạo ra hình ảnh, và cho phép nó kiểm tra sự thật dựa trên Google Search và Google Image Search.
Khi gọi API của Google Developer, giá cho hình ảnh tiêu chuẩn 1K là 0.0336 USD, khoảng một nửa so với 0.067 USD của Nano Banana 2; hình ảnh 4K có giá 0.0756 USD, phiên bản trước là 0.151 USD, và các nhiệm vụ theo lô có thể được giảm giá 50%. Dữ liệu hiệu suất trên đến từ thử nghiệm của chính Google.






