Google A2A: Giao thức cho phép các AI Agent làm việc cùng nhau
Google vừa công bổi Giao thức Agent-to-Agent (A2A) — một tiêu chuẩn mở cho phép các hệ thống AI giao tiếp và hợp tác với nhau như một nhóm chuyên gia hợp tác hiệu quả. Tưởng tượng như một văn phòng nơi các chuyên gia từng ngành tự động hóa kết nối để giải quyết vấn đề phức tạp.
Tại sao AI Agent cần nói chuyện với nhau?
Hôm nay, bản đồ AI giống như các hòn đảo tri thức rời rắt. Một agent giỏi đặt lịch, một agent giỏi phân tích dữ liệu, một agent giỏi viết sáng tạo. Nhưng chúng hoạt động độc lập — thường không thể kết hợp sức để giải quyết bài toán phức tạp.
Ví dụ: yêu cầu "Lên kế hoạch cho chuyến công tác đến Chicago tháng tới" cần kết hợp nhiều chuyên môn — quản lý lịch, đặt vé máy bay khách sạn, tối ưu ngân sách, lên lộ trình.
Xây dựers một "siêu agent" thông minh mọi thứ khó khăn và tốn kém. Thay vào đó, A2A cho phép agent bạn kết nối với các agent chuyên biệt khác — bạn tập trung nhữu gì mình giỏi, và giao phần còn lại cho các chuyên gia khác. Cách tiếp cận kiến trương này giúp mỗi nhóm chỉ cần xây dựng một phần, thay vì phải tái tạo lại khả năng đã tồn tại ở nơi khác.
A2A: Một ngôn ngữ chung cho AI
A2A thiết lập giao thức giao tiếp mời bất kỳ ai agent nào nói chuyện được — bất kể ai tạo ra, hoặc kiến trúc nội bộ ra sao. Như thiết lập tiếng Anh như ngôn ngữ chung trong công ty đa quốc gia — ngay khi mọi người nói được, sự hợp tác trở thành khả thi.
Quan trọng hơn cả truyền thông lẫn nhau, A2A định nghĩa cơ chế phối hợp công việc theo thời gian:
Các nguyên tắc thiết yếu của A2A
Giao thức giới thiệu (Introduction Protocol): Các agent khám phá khả năng lẫn nhau qua "Thẻ Agent" (Agent Cards) — hồ sơ kỹ năng liệt kê chức năng và cách tiếp cận từng agent.
Quản lý nhiệm vụ (Task Management): Các agent giao việc và theo dõi tiến độ. Khi agent lịch nhận yêu cầu từ agent du lịch, nó gửi yêu cầu HTTP đến endpoint A2A của agent du lịch, nhận ID nhiệm vụ, và theo dõi trạng thái.
Truyền thông giàu nghĩa (Rich Communication): Trao đổi không chỉ văn bản mà còn hình ảnh, dữ liệu có cấu trúc JSON, tệp tin và các định dạng khác cần thiết cho cùng hợp tác hiệu quả.
Cơ chế yêu cầu thông tin (Clarification Mechanism): Khi cần thêm thông tin để hoàn thành nhiệm vụ, một agent có thể tạm dừng và yêu cầu bổ sung — giống như đồng nghiệp nhờ câu hỏi bổ sung trước khi thực hiện.
Quy trình hoạt động A2A — một ví dụ thực tế
Giả sử bạn yêu cầu AI trợ lý cá nhân: "Lên kế hoạch cho bữa tiệc sinh nhật con gái tôi vào cuối tuần tới."
Assistant Alex (trợ lý của bạn) nhận diện rằng việc này cần sự chuyên môn. Sử dụng A2A, Alex thực hiện:
-
Tìm kiếm Thẻ Agent cho trang trí, catering và thiết kế thiệp — tải JSON từ endpoint chuẩn như
https://agent-domain/.well-known/agent.json. -
Tạo nhiệm vụ riêng cho từng chuyên gia qua HTTP:
- Gửi cho chuyên gia sự kiện: "Cần đề xuất địa điểm và hoạt động cho bữa tiệc sinh nhật 8 tuổi vào thứ Bảy tới."
- Gửi cho chuyên gia ẩm thực: "Cần gợi ý bánh ngọt và thực đơn cho 12 trẻ em + 6 người lớn."
- Gửi cho chuyên gia thiết kế: "Tạo mẫu thiệp sinh nhật vui nhộn."
-
Mỗi nhiệm vụ nhận ID riêng và tuân quy trình vòng đời: gửi → đang thực hiện → hoàn thành/thất bại/cần thông tin.
-
Chuyên gia sự kiện chuyển sang trạng thái "input-required" hỏi: "Ngân sách bao nhiêu?" — Alex trả lời từ dữ liệu đã biết hoặc hỏi trực tiếp.
-
Chuyên gia ẩm thực gửi DataPart (JSON) với lưu ý giá, tuỳ chọn thực đơn — task được đánh dấu "completed".
-
Chuyên gia thiết kế gửi FilePart (ảnh mẫu thiệp) — Alex trình bày trực quan.
Trong suốt, nhiệm vụ kéo dài có thể cập nhật tiến độ thời gian thực qua Server-Sent Events (SSE), và xác thực giữa các agent dùng OAuth 2.0, API keys, JWT — theo chuẩn TLS.
Bạn chỉ tương tác với Alex — không nhận ra bằng trải hợp âm nhạc đa agent diễn ra phía sau.
A2A trong sinh thái AI rộng lớn
A2A không tồn tại độc lập. Là một phần của xu hướng chuyển hướng AI từ mô hình độc quyền sang hệ sinh thái thành phần hợp tác, nó đi bên cạnh Model Context Protocol (MCP) — giao thức tập trung vào cách agent sử dụng công cụ và bối cảnh.
| MCP | A2A |
|—|—|
| Trang bị mỗi agent với "công cụ và ngữ cảnh" | Thi establishes how worker — communicate and collab |
| Cung cấp truy cập tài nguyên cá nhân | Cho phép đồng bộ nhiệm vụ xuyên agent |
Một agent có thể dùng MCP để truy cập công cụ cần thiết, rồi dùng A2A để phối hợp với agent khác tính năng bổ sung. Hai giao thức bổ trợ nhau — MCP chăm sóc "bộ dụng cụ cá nhân", A2A chăm sóc "giao tiếp nhóm".
Kiến trúc kỹ thuật của A2A
Được thiết kế trên các công nghệ web quen thuộc, A2A bao gồm:
-
Mô hình Client-Server: Một agent là client (khởi nguồn), một agent khác là server (đáp ứng). Vai trò linh hoạt, có thể đổi chiều theo ngữ cảnh.
-
Agent Cards: Tệp JSON chứa khả năng, URL endpoint, xác thực, định dạng tin nhắn — công bố tại endpoint chuẩn
/.well-known/agent.json. -
Quản lý nhiệm vụ có trạng thái: Mỗi nhiệm vụ có ID, trạng thái máy trạng (submitted, working, input-required, completed, failed, canceled), metadata thời gian và thông tin quyền sở hữu.
-
Cấu trúc tin nhắn: Mỗi Message chứa một hoặc nhiều Part:
- TextPart: văn bản thường hoặc định dạng
- DataPart: dữ liệu có cấu trúc (JSON)
- FilePart: dữ liệu nhị phân hoặc tham chiếu tệp
- Mỗi Part có MIME type xác định định dạng
-
Lớp vận chuyển: REST API cho tạo/cập nhật nhiệm vụ, SSE streaming cho tiến độ thời gian thực, webhook tùy chọn cho thông báo bất đồng bộ.
-
Lớp bảo mật: OAuth 2.0, API keys, JWT tokens — doanh nghiệp đảm bảo truy cập điều khiển.
Kiến trúc này xử lý từ trò chuyện nhanh đến quy trình phức tạp kéo dài hàng giờ — hoặc cả ngày.
Tương lai: Mạng lưới kiến thức hành động
Sức mạnh thực sự của A2A xuất hiện khi chúng ta ngừng suy nghĩ về từng khả năng AI đơn lẻ — mà hình dung nền tảng các chuyên môn hóa hợp tác. Như nhân loại tiến bộ khi có sự phân chia lao động chuyên ngành, AI sẽ bứt phá hơn khi các agent hiệu quả hợp tác.
Lợi thế chính
- Cải tiến mô-đun: Agent lịch tốt hơn → thay thế dễ dàng, không làm gián đoạn hệ thống.
- Tự động hoá dần dần: Quy trình cần con người đi phối hợp → ngày càng chạy tự động giữa các agent.
- Uống tích cực: Thay vì một AI toàn năng, chúng ta có các agent tinh xảo trong từng miền.
Tương lai không phải một siêu AI đơn lẻ, mà là mạng lưới các agent chuyên biệt hợp tác — giống như tổ chức con người kết hợp vai trò để tạo giá trị. A2A cung cấp hạ tầng giao tiếp để sự hợp tác này trở thành hiện thực — gần hơn với AI có khả năng thực sự giải quyết độ phức tạp thực tế của đời thường.
A2A được Google phát hành tháng 4/2025 dưới Giấy phép Apache 2.0. Nguồn: Google Developers Blog
Để lại một bình luận