Google I/O 2026: Hệ sinh thái Google chính thức bước vào kỷ nguyên tác nhân AI tự chủ
Phát biểu tại sự kiện, ông Sundar Pichai - CEO của Google và Alphabet nhấn mạnh chu kỳ công nghệ AI đã dịch chuyển sang giai đoạn tạo ra giá trị thực tế trong đời sống hằng ngày. Minh chứng rõ nhất là quy mô xử lý dữ liệu của hãng đã đạt mức tăng trưởng kỷ lục. Nếu như hai năm trước, hệ thống chỉ xử lý 9,7 nghìn tỷ token mỗi tháng, thì hiện tại con số này đã tăng vọt gấp 7 lần so với cùng kỳ năm ngoái, đạt hơn 3,2 triệu tỷ token/tháng. Hệ sinh thái này thu hút hơn 8,5 triệu lập trình viên hoạt động hằng tháng, cùng các cổng API xử lý khoảng 19 tỷ token mỗi phút.
Sức hút từ các mô hình Gemini cũng thúc đẩy lượng người dùng các sản phẩm cốt lõi của Google tăng trưởng mạnh mẽ. Công cụ Tìm kiếm (Search) với tính năng AI Overviews hiện đạt hơn 2,5 tỷ người dùng hoạt động hằng tháng, trong khi "Chế độ AI" (AI Mode) cũng chính thức vượt mốc 1 tỷ người dùng chỉ sau một năm ra mắt. Đáng chú ý, ứng dụng Gemini đã tăng hơn đôi lượng người dùng trong năm qua, đạt mốc 900 triệu người hoạt động hằng tháng với số lượng yêu cầu xử lý hằng ngày tăng trưởng hơn 7 lần.
Tại sự kiện lần này, Google tập trung nâng cấp trải nghiệm tương tác dạng hội thoại tự nhiên lên nhiều dòng sản phẩm lớn. Tính năng "Ask YouTube" đang được thử nghiệm để triển khai rộng rãi tại Mỹ vào mùa hè này, cho phép người dùng đặt câu hỏi và chuyển hướng thẳng đến phân đoạn video chứa câu trả lời. Trong khi đó, tính năng "Docs Live" sắp ra mắt trên Google Docs cho phép người dùng khởi tạo và chỉnh sửa tài liệu hoàn toàn bằng giọng nói theo thời gian thực nhờ những bước nhảy vọt của mô hình âm thanh.
Để đáp ứng quy mô vận hành khổng lồ này, Google đã tăng chi phí vốn đầu tư cho cơ sở hạ tầng lên khoảng 6 lần so với năm 2022, dự kiến đạt mức từ 180 tỷ đến 190 tỷ USD trong năm nay. Điểm nhấn hạ tầng là thế hệ chip tùy chỉnh thế hệ thứ 8 với kiến trúc chip kép chuyên biệt: TPU 8t tối ưu hóa cho tiền huấn luyện (hiệu năng mạnh gấp 3 lần thế hệ trước, cho phép phân phối linh hoạt qua nhiều địa điểm để tạo ra cụm huấn luyện lớn nhất thế giới gồm 1 triệu chip) và TPU 8i thiết kế riêng cho quá trình suy luận tốc độ cao. Cả hai dòng chip mới này đều tối ưu năng lượng với hiệu suất trên mỗi watt tốt hơn tới hai lần.
Nền tảng hạ tầng mạnh mẽ này là bệ phóng để Google công bố một loạt mô hình và công cụ AI thế hệ mới:
Gemini Omni: Mô hình đa phương thức có khả năng tiếp nhận bất kỳ định dạng đầu vào nào và xuất ra dữ liệu ở nhiều định dạng khác nhau. Phiên bản đầu tiên - Gemini Omni Flash - xử lý đầu ra dạng video hiện đã được triển khai trên ứng dụng Gemini, Google Flow và YouTube Shorts.
Gemini 3.5 Flash: Mô hình tiên phong kết hợp giữa trí thông minh vượt trội và năng lực hành động thực tế. Ở phiên bản này, tốc độ đầu ra của mô hình nhanh gấp 4 lần so với các đối thủ cùng phân khúc nhưng mức giá chỉ bằng một nửa, giúp các doanh nghiệp tối ưu hóa chi phí vận hành ở quy mô lớn.
Antigravity 2.0: Nền tảng phát triển ưu tiên tác nhân vừa được cải tiến toàn diện thành một ứng dụng độc lập dành cho máy tính để bàn, cho phép người dùng điều phối các nhóm tác nhân AI tự vận hành xử lý chuỗi tác vụ dài hạn.
Gemini Spark: Trợ lý AI cá nhân thế hệ mới hoạt động liên tục 24/7 trên các máy ảo của Google Cloud. Spark có khả năng tự chủ thực hiện các tác vụ phức tạp chạy ngầm, tích hợp sâu vào hệ sinh thái Google lẫn các công cụ của bên thứ ba thông qua giao thức MCP. Người dùng Android có thể theo dõi tiến độ của Spark qua giao diện mới mang tên Android Halo vào cuối năm nay.
Nâng cấp Tìm kiếm (Search): Tích hợp các "tác nhân thông tin" hoạt động 24/7 để chủ động tìm kiếm và xử lý dữ liệu theo yêu cầu cá nhân. Đồng thời, công cụ Tìm kiếm cũng sẽ tự động xây dựng các giao diện trải nghiệm tùy chỉnh (giao diện tạo sinh) phù hợp cho từng câu hỏi của người dùng.
Bên cạnh đó, Google cũng mở rộng hệ sinh thái tác nhân AI qua các công cụ chuyên biệt khác bao gồm: "Daily Brief" - tác nhân tổng hợp và phân loại thông tin buổi sáng trong ứng dụng Gemini; "Google Flow" - hỗ trợ lên kế hoạch và lập luận dự án phức tạp; "Google Pics" - công cụ sáng tạo hình ảnh xây dựng trên mô hình Nano Banana xử lý các chi tiết ảnh như các đối tượng độc lập; và dự án "Gemini cho Khoa học" (Gemini for Science) giúp kết nối các nền tảng tác nhân với hơn 30 cơ sở dữ liệu khoa học đời sống để tăng tốc nghiên cứu.
Đặc biệt, trong bối cảnh AI tạo sinh bùng nổ, Google nhấn mạnh cam kết về tính minh bạch khi tích hợp công cụ đóng dấu mờ kỹ thuật số vô hình SynthID và Chứng chỉ Nội dung (Content Credentials) lên Tìm kiếm và Chrome để xác thực nguồn gốc nội dung. Công nghệ này đã nhận được sự đồng hành từ các đối tác lớn trong ngành như NVIDIA, OpenAI, Kakao và ElevenLabs nhằm thiết lập tiêu chuẩn an toàn cho toàn bộ kỷ nguyên AI.
Ở mảng thiết bị phần cứng, Google cũng hé lộ dòng kính mắt thông minh tích hợp trợ lý Gemini, bao gồm kính âm thanh hỗ trợ giọng nói trực tiếp (dự kiến ra mắt vào mùa thu này) và kính màn hình hiển thị thông tin trực quan, giúp người dùng tương tác rảnh tay trong mọi hoạt động hằng ngày.
PV