Chuyển tới nội dung chính

1 bài viết được gắn thẻ "Context Engineering"

Quản lý context của AI agent như một tài nguyên hữu hạn — compaction, ghi chú có cấu trúc, sub-agent và ngân sách attention.

Xem tất cả thẻ

Loop engineering: vận hành một đội agent làm hơn 100 việc

· 13 phút để đọc
ManhPT
Just another developer!

Loop engineering — đội agent vận hành theo vòng lặp

Sáu ngày vừa rồi, một đội agent của tôi làm xong hơn 100 việc: thu thập và kiểm tra toàn vẹn 156.404 văn bản pháp luật, làm sạch metadata cho 3,19 triệu bài báo khoa học, dựng một kho tri thức ba tầng có vector, và sao lưu 26 GB mỗi ngày. Tôi làm việc này trong một gói thuê bao khoảng 10 đô một tháng. Trong sáu ngày đó, hệ thống dùng khoảng 2 tỷ token, và 97% là đọc lại từ cache.

Nhưng mấy con số đó chưa phải phần khó. Cái khó là giữ cho nhiều agent chạy đều, tốn ít, không kẹt, và biết dừng đúng lúc.

Kỹ thuật viết prompt (prompt engineering) chỉ giải quyết một lần gọi model. Loop engineering giải quyết cả vòng vận hành: cái gì chạy, bao lâu chạy một lần, mỗi vòng tốn bao nhiêu token, và khi nào thì dừng. Bài này kể lại cấu trúc đội agent của tôi, cách tôi thiết kế từng vòng lặp, số liệu thật, kể cả phần chưa tốt — vì đó mới là phần đáng nói.