A2A là một tiêu chuẩn giao tiếp cho phép các AI agent khác nhau ủy thác và hợp tác thực hiện các nhiệm vụ thông qua một giao thức chuẩn. Các agent có thể làm việc cùng nhau một cách tự chủ và xử lý các quy trình công việc phức tạp theo cách phân tán.
A2A (Agent-to-Agent) là một giao thức mở được Google phát triển vào năm 2025, cho phép các AI agent từ các nhà cung cấp và khuôn khổ khác nhau giao tiếp và cộng tác theo cách tiêu chuẩn hóa. Mỗi agent thể hiện các khả năng và điểm cuối của mình trong siêu dữ liệu JSON được gọi là "AgentCard" và ủy quyền các nhiệm vụ cũng như chuyển kết quả thông qua HTTP và SSE (Sự kiện do máy chủ gửi). Trong khi MCP (Giao thức bối cảnh mô hình) là một "kết nối dọc" kết nối các AI agent với các công cụ và nguồn dữ liệu thì A2A được định vị là "kết nối ngang" kết nối các AI agent với nhau.
Trong các hoạt động thực tế vào năm 2026, trong khi các cấu hình đa agent áp dụng A2A sẽ tăng lên nhanh chóng, thì những cạm bẫy trong lĩnh vực này cũng đã trở nên rõ ràng. Thách thức lớn nhất là sự phức tạp của việc xác thực và ủy quyền cũng như nguy cơ leo thang đặc quyền nếu mã thông báo được chuyển không chính xác giữa các AI agent. Ngoài ra, độ trễ của cuộc gọi sẽ tích lũy và trong nhiều trường hợp, thời gian phản hồi lên tới hàng chục giây đối với các chuỗi có năm giai đoạn trở lên. Về giá thị trường, tôi nghĩ rằng giá token sẽ cao hơn từ 2 đến 4 lần so với giá của một agent vì số lượng cuộc gọi LLM cho các AI agent trung gian sẽ tăng lên. Khi chọn địa điểm, cách tiếp cận từng bước sẽ có hiệu quả, trước tiên là củng cố tích hợp công cụ với MCP và sau đó giới thiệu A2A ở giai đoạn thực sự cần sự phối hợp giữa các AI agent.