Phát triển AI agent

AI agent là hệ thống tự quyết định các bước cần làm và gọi công cụ của bạn để thực hiện, thay vì sinh ra văn bản để con người hành động theo. Điều đó khiến nó hữu ích cho công việc nhiều bước và rủi ro đúng ở mức tương đương — một agent có quyền ghi có thể gây thiệt hại thật rất nhanh. Chúng tôi xây agent với quyền hạn hẹp, dấu vết kiểm toán đầy đủ, và bước xác nhận của con người trước mọi hành động tốn kém hoặc không thể hoàn tác.

Agent thực sự xứng đáng ở đâu

Agent hợp với công việc có mục tiêu rõ, nhiều bước, và chấp nhận được việc thử lại. Nó ít hợp hơn nhiều với xử lý giao dịch lưu lượng lớn không cho phép sai sót.

  • Phân loại và định tuyến: đọc một mục đến, phân loại, xử lý hoặc chuyển lên.
  • Tra cứu và tóm tắt xuyên nhiều hệ thống nội bộ.
  • Công việc hậu cần nhiều bước mà hiện tại là một người chép qua lại giữa các công cụ.
  • Soạn thảo bản nháp để con người xem và duyệt trước khi gửi đi.

Phân quyền và phạm vi thiệt hại

Câu hỏi thiết kế không phải là agent làm được gì khi nó chạy đúng, mà là nó làm được gì khi nó sai. Chúng tôi trả lời câu đó trước khi xây bất cứ thứ gì.

  • Truy cập công cụ theo quyền tối thiểu — mặc định chỉ đọc, quyền ghi cấp theo từng trường hợp.
  • Bắt buộc con người xác nhận với các thao tác chi tiền, gửi đi, hoặc xóa.
  • Giới hạn tần suất và ngân sách cho mỗi lần chạy, để một vòng lặp không biến thành hóa đơn.
  • Trace đầy đủ từng bước, để mọi hành động đều giải thích lại được.

Làm cho agent kiểm thử được

Một agent hành xử khác nhau mỗi lần chạy thì không thể bảo trì. Chúng tôi cố định những gì cố định được: công cụ tất định có kiểm thử riêng, trace đã ghi được phát lại làm ca hồi quy, và đánh giá trên cả lượt chạy thay vì từng câu trả lời. Không có những thứ đó thì mỗi thay đổi là một canh bạc, và sẽ không ai tin hệ thống đủ để nới quyền cho nó.

Câu hỏi thường gặp

Agent khác chatbot ở chỗ nào?
Chatbot sinh ra văn bản để con người hành động theo. Agent tự thực hiện hành động bằng cách gọi công cụ — truy vấn cơ sở dữ liệu, mở phiếu hỗ trợ, gửi tin nhắn. Khác biệt đó là lý do phân quyền và dấu vết kiểm toán quan trọng hơn hẳn so với một giao diện chat.
Nếu agent làm sai thì sao?
Hãy giả định là nó sẽ sai, và thiết kế sao cho hậu quả có giới hạn. Các hành động không hoàn tác được và tốn kém đều nằm sau bước xác nhận của con người, quyền truy cập công cụ ở mức tối thiểu, và mọi bước được ghi log đủ chi tiết để dựng lại và đảo ngược.
Nó làm việc được với công cụ hiện có của chúng tôi không?
Được — agent hành động qua chính các API bạn đang có. Với hệ thống không có API, vẫn dùng các đường tệp, hàng đợi hoặc cơ sở dữ liệu như khi tích hợp thông thường.
Bây giờ đã đáng làm chưa?
Với công việc có giới hạn và xem lại được thì thường là đáng. Với xử lý không người giám sát, rủi ro cao, lưu lượng lớn thì thường là chưa. Chúng tôi thà nói vậy còn hơn xây một thứ mà một tháng sau bạn phải tắt đi.

Cho chúng tôi biết bạn đang xây gì

Gửi mô tả ngắn về hệ thống và điểm nghẽn bạn đang gặp. Chúng tôi trả lời trong vòng một ngày làm việc.

Đặt lịch tư vấn