Tìm kiếm

Tìm trong khu vườn

Thẻ chủ đề

Tất cả bài

Điều khiển agentAgent sẽ làm sai một cách rất tự tin — nếu bạn để nó tự đoánĐiều khiển không phải là ra lệnh to hơn, mà là không để chỗ nào cho nó đoánĐiều khiển agentMột câu lệnh mơ hồ không ngắn — nó để ngỏBa phần khiến agent chỉ còn một cách hiểu đúng: mục tiêu, ranh giới, dạng kết quảĐiều khiển agentĐừng dặn nó đừng — làm cho nó không thểForcing function: biến hành vi xấu từ 'không nên' thành 'không đi được'Điều khiển agentCấp cho nó quyền nói 'tôi chưa chắc' — rồi bắt nó dùngBịt những chỗ mù bạn không lường trước, bằng một câu thêm vào đầu việcContext & memoryAgent không có trí nhớ — nó có một cái bàn làm việc hữu hạnGiữ gì, bỏ gì, và khi nào đừng phí một dòng suy nghĩ của AI cho việc một script làm đượcContext & memoryContext là ngân sách, không phải kho chứaMỗi thứ bạn đưa vào đều có giá: tốn chỗ, và làm loãng cái quan trọngContext & memoryViệc có một đáp án đúng thì đừng hỏi AI — hỏi một dòng lệnhBa dấu hiệu một việc là của script, không phải của một bộ nãoContext & memoryChọn gì đưa vào context cho agentMột checklist để khỏi dán quá nhiều, cũng khỏi thiếu thứ agent thật sự cầnĐiều phối nhiều agentKhi một agent không đủ, đừng nhân nó lên — hãy chia nó raNhiều agent không tự nhanh hơn; chúng nhanh hơn khi mỗi đứa có một vai rõ và một chỗ gom lạiĐiều phối nhiều agentHai agent cùng đụng một file là một agent ghi đè đứa kiaChia vai nghĩa là cắt thành các vùng không chồng lấn, không phải chia cho đôngĐiều phối nhiều agentĐừng bê cả cái bàn sang — truyền đúng cái giao kèoMỗi agent một bàn riêng; nối chúng bằng một bản tóm tắt quyết định, không bằng cả lịch sửĐiều phối nhiều agentBa câu trả lời đúng-riêng-lẻ vẫn sai-khi-ghépCần đúng một chỗ ráp các mảnh lại và quyết khi chúng mâu thuẫnQuy trình ship với AIBốn cổng kiểm soát để agent ship việc thậtDùng khi bạn muốn agent tự làm nhiều hơn, nhưng không muốn nó âm thầm đi sai rồi báo 'xong'Quy trình ship với AIĐừng hỏi agent kế hoạch — hãy chặn nó lạiCái cổng ba mươi giây giữa 'hiểu việc' và 'làm việc'Quy trình ship với AIMột lượt khổng lồ là nơi agent đi lạcChia chặng và checkpoint — cách duy nhất để đi nhanh mà không phải đi lạiQuy trình ship với AIBug đắt nhất là bug để build xanhBắt agent đọc bán kính ảnh hưởng trước khi cho nó đụng đồ dùng chungQuy trình ship với AI'Done!' là một lời khai, không phải bằng chứngVì sao với agent, câu thần chú đổi từ 'tin nhưng kiểm' thành 'kiểm rồi mới tin'Thực chiến productionĐưa output của agent ra đời thật mà không bị vỡ lặng lẽDùng checklist ca xấu, ranh giới, và tín hiệu thật trước khi tin một demo đẹpThực chiến productionTrước khi sửa, hãy gọi đúng tên cái hỏng — agent fail theo bốn kiểu nhìn là biếtNgười mới thấy output sai là lao vào sửa. Người có nghề đọc triệu chứng trước, rồi mới rẽ đúng đường thoátThực chiến productionAgent giỏi ở giữa, ngã ở rìa — và ngã cũng tự tin y hệtCa hiếm thì ít gặp nhưng đắt, và agent không có cờ báo 'chỗ này tôi không chắc'Thực chiến productionNó đúng hai mươi lần, nên bạn thôi nhìn. Lần thứ hai mươi mốt cắn.Lòng tin trôi dần theo mỗi lần đúng — đúng cách nó tích rủi ro mà bạn không hayThực chiến productionIm lặng không phải là ổn — nó chỉ là chưa ai nhìnĐặt cái đo ở ranh giới, coi sự im lặng là đáng nghi, giữ một ca-xấu làm mốcThực chiến productionGiao việc nó không làm nổi, agent sẽ không nói 'không' — nó diễnAgent thà dựng một thứ trông-như-xong còn hơn thừa nhận mình kẹt — và nó diễn giỏi đến mức bạn tinThực chiến productionNó không kẹt theo kiểu báo lỗi — nó kẹt theo kiểu bận rộnMột dạng câm động: agent không dừng, không báo lỗi, vẫn 'làm việc' — mà bốn lần liền lặp đúng một nước điThực chiến productionChỗ hỏng không nằm trong output — nó nằm trong một giả định ở bước haiKhi kết quả sai mà không có dòng lỗi nào, đọc xuôi toàn bộ là cách chậm nhất. Chia đôi vùng nghi nhanh hơn nhiềuKinh tế & đánh đổiGấp mười lần là giá niêm yết. Cái bạn thực lĩnh mới là câu chuyệnNăng suất khi làm với agent: vì sao cảm giác nhanh gấp mười mà dự án không nhích gấp mười — và cách đo cái thậtKinh tế & đánh đổiLỗi của agent không đắt lúc nó xảy ra. Đắt lúc bạn không biết.Chi phí thực của một lỗi tính từ lúc nó được dùng thật, không từ lúc nó xuất hiện — và hai thời điểm đó thường cách nhau xa hơn bạn nghĩ.Kinh tế & đánh đổiAgent không đắt hơn bạn tưởng. Task của bạn mới đắt.Mỗi lần mở chat đều có một overhead cố định bạn không thấy — và với task đủ nhỏ, nó ăn sạch phần tiết kiệm.Kinh tế & đánh đổiMột prompt, ba việc. Ba việc đều mediocre.Gom nhiều task vào một prompt nghe tiết kiệm. Thực ra bạn đang pha loãng sự tập trung — và output cuối thường tệ nhất.Kinh tế & đánh đổiCâu hỏi đầu tiên không phải 'prompt sao' — mà 'việc này có nên giao cho agent không'Cả thói quen mặc định bạn đã chọn agent rồi. Có một bước lùi trước đó: chọn đúng công cụ trong bốn ôBạn thay đổi thế nàoKhông ai sinh ra đã biết quản agent — đây là bốn giai đoạn bạn sẽ đi quaGiai đoạn nguy hiểm nhất không phải lúc bạn mới học. Là lúc bạn đã thành thạo.Bạn thay đổi thế nàoBẫy tự tin — tháng thứ ba là lúc dễ vấp nhấtKhông phải vì bạn kém — mà vì bạn vừa đủ giỏi để làm việc lớn mà chưa đủ khôn để biết giới hạn.Bạn thay đổi thế nàoQuan sát trước khi giao — dù bạn đã dùng agent hai nămCùng một agent behave khác nhau tùy domain. Và khi vào domain mới, ngay cả người có kinh nghiệm cũng cần một vòng quan sát trước.Bạn thay đổi thế nàoNgôn ngữ của bạn thay đổi cùng kỹ năng — nhưng không phải theo cách bạn nghĩPrompt ngắn đi không phải luôn là tiến bộ. Là tiến bộ khi output tốt hơn — là dấu hiệu xấu khi output kém mà bạn không nhận ra.Đồ nghề & thiết lậpCLAUDE.md không phải tài liệu — đó là bộ luật sống của agent trên hệ thống bạnĐa số người viết CLAUDE.md như viết README. Nhưng nếu bạn viết nó đúng, agent ngừng hỏi những câu nó không nên hỏi và ngừng làm những thứ nó không nên làm.Đồ nghề & thiết lậpCấu trúc thư mục agent đọc đượcAgent đọc căn phòng của bạn trước khi đọc lời bạn dặn. Một workspace gọn gàng nói thay bạn; một mớ hỗn độn bắt nó đoán — và nó đoán rất tự tin.Đồ nghề & thiết lậpThiết lập một lần, đỡ giải thích mãiMỗi lần bạn nhắc lại cùng một bối cảnh cho agent là một lần trả phí định kỳ cho việc bạn chưa làm một lần. Setup là khoản trả trước để không bao giờ phải trả lại.Đồ nghề & thiết lậpĐiểm kiểm tra mặc địnhVerify 'khi nào thấy cần' nghĩa là verify khi bạn đã hơi lo — tức là thường đã hơi muộn. Một bước kiểm tra tốt không hỏi tâm trạng bạn; nó nằm sẵn trong quy trình.Autonomy — thả đến đâuAutonomy không phải nút bật/tắt — đó là một thang đoCâu hỏi đúng không phải 'có tin được không?'. Là 'với task này, ở bước này, với hậu quả này nếu sai — gate nằm ở đâu?'Autonomy — thả đến đâuAutonomy không hỏng ngẫu nhiên — nó hỏng theo ba kiểu có tênKhi agent tự chạy mà ra kết quả sai, dễ nhất là đổ cho agent. Nhưng gần như lần nào lỗi cũng nằm ở cách bạn dựng autonomy — và nó lặp lại theo đúng ba khuôn.Autonomy — thả đến đâuBạn không phải chọn giữa ngồi canh và nhắm mắt — có cổng giữa đườngNhị phân 'duyệt từng bước' hoặc 'thả tới cuối' là một lựa chọn giả. Cách thứ ba: để nó tự chạy, nhưng đặt một cánh cổng đúng ngay điểm khó lùi.Autonomy — thả đến đâuCàng thả cho nó tự chạy, càng phải nói nhiều — không phải ítTrực giác bảo: task tự động thì khỏi giải thích dài dòng, cứ thả ra cho nó lo. Nhưng đó là chiều ngược. Task có người kèm thì lỗi được bắt giữa đường. Task tự chạy không có ai kèm — mỗi chỗ bạn để trống, agent tự lấp bằng một giả định.Đo và cải thiệnBạn cảm giác agent ngày càng tốt hơn. Cảm giác đó đúng bao nhiêu phần trăm?Không có con số là không có cải thiện — chỉ có cảm giác thay đổi. Và cảm giác không đủ để phân biệt 'đang tốt hơn' với 'đang quên mất cú sai gần nhất'.Đo và cải thiệnVòng phản hồi tối giản — năm phút mỗi tuần là đủSáu tháng kinh nghiệm không tự biến thành kỹ năng. Nó biến thành thói quen — và thói quen có thể là tiến bộ, cũng có thể là vết mòn. Cái phân biệt hai thứ đó là một vòng lặp nhỏ bạn gần như không cần bỏ thời gian cho nó.Đo và cải thiệnThư viện prompt của bạn là một cơ thể sống, không phải một cái khoMột prompt hay mà không lưu thì mất. Một prompt dở mà không bỏ thì bạn vẫn trả tiền cho nó mỗi lần lôi ra dùng. Thư viện prompt không phải nơi chứa đồ — nó là một tập tài sản có vòng đời, và vòng đời nào không ai chăm thì thoái hóa.Đo và cải thiệnDùng agent nhiều hơn mà mệt hơn — đó không phải bạn dở, đó là tín hiệuMột cách làm từng hiệu quả không tự báo cho bạn biết lúc nó hết hiệu quả. Bạn cứ tiếp tục vì đã quen, vì đã đầu tư, vì đổi thì ngại. Nhưng có ba tín hiệu khá rõ nói rằng cách làm của bạn đã cũ — và chúng không ồn ào, nên dễ bỏ qua.Đo và cải thiệnĐổi prompt thấy khá hơn — nhưng đó là cải thiện thật hay bạn vừa gặp may?Chỉnh prompt mãi mà kỹ năng không tích lũy, vì bạn không tách được cái thật sự ăn ra khỏi cái nhiễu một lượtCửa vàoAI không phải để viết giùm bạn câu chữ. Nó để gánh việc lặp.Tám nỗi đau quen thuộc ở bàn làm việc — và lý do phần lớn chúng không cần đến bạn ngồi đó mỗi lầnCửa vàoĐứng trước ô trống không biết gõ gì? Câu hỏi sai là 'học AI thế nào'.Cách chọn đúng việc đầu tiên để giao — và vì sao việc bạn định bắt đầu thường là việc tệ nhấtCửa vàoAI viết nhạt không phải vì nó dở. Vì bạn ra lệnh mơ hồ.Cùng một con AI, hai câu lệnh, hai chất lượng khác hẳn — và khác biệt nằm ở phía bạnCửa vàoAI nói sai bằng giọng chắc như đúng. Đó mới là chỗ nguy.Nó không cau mày khi không chắc — nó trả lời mọi thứ bằng cùng một sự tự tin, kể cả lúc bịaCửa vàoViệc bạn làm mỗi sáng giống hệt nhau — đó là việc của máyCùng một thao tác, mỗi ngày, không đổi — và bạn vẫn ngồi làm tay vì 'có mười phút thôi mà'Cửa vàoMất đơn lúc nửa đêm không phải vì thiếu người — vì không ai trả lời kịpCó một thứ không ngủ — nhưng 'để nó tự trả lời khách' và 'thuê thêm người' là hai chuyện khác hẳnCửa vàoPhần lớn báo cáo bạn ghép tay không cần đến bạn — chỉ một mẩu nhỏ mới cầnMột bản báo cáo trộn hai thứ: ghép số (việc của máy) và rút ra nhận định (việc của bạn) — và bạn đang làm cả hai bằng tayCửa vàoAI quên hết mỗi lần không phải vì nó đãng trí — vì bạn chưa cho nó chỗ để nhớMỗi sáng nhắc lại từ đầu là một chi phí lặp cho việc đáng lẽ ghi một lầnCửa vàoGiao việc rồi ngồi canh từng dòng — đó không phải tự động hóa, đó là làm tay kiểu mớiKhông dám rời mắt nghĩa là bạn chưa đặt chốt chặn — và chốt đúng chỗ mới là thứ cho phép buông tayCửa vàoĐừng bảo AI 'tóm tắt cuộc họp' — bảo nó tìm đúng mấy thứ bạn cần'Tóm tắt giúp' cho ra bản tóm trung tính, dễ trật đúng cái quan trọng với bạn — nói rõ bạn đang tìm gì thì nó lùng đúng cái đó trong mười bốn trangCửa vàoBản dịch trôi chảy không có nghĩa là đúng — nó chỉ chưa biết từ điển của ngành bạnAI dịch trơn tru rồi sai cùng một thuật ngữ ở mọi chỗ; sửa tay từng chỗ là chữa lá, đưa nó cuốn từ điển một lần mới là chữa gốcCửa vàoEmail AI viết nghe như robot không phải vì nó vô duyên — vì nó không biết bạn với người này nói chuyện thế nàoLịch sự là cái mặc định an toàn của máy; với một người bạn đã quen, an-toàn lại hóa ra xa cách — và sửa được bằng cách cho nó nghe bạn vốn nói chuyện ra saoCửa vàoNăm mươi cái email gần giống nhau: đừng gõ lại năm mươi lầnPhần lặp giống nhau là việc của máy; phần mỗi người một khác mới cần đến bạn — tách hai phần đó ra trước khi mở chatSkill thực chiếnMột nguyên lý bạn phải nhớ là một nguyên lý bạn sẽ quênSổ tay thực chiến: biến mỗi bài học thành một thứ cài được — để cái đúng tự xảy ra, không chờ bạn nhớ raSkill thực chiếnKiểm chứng trước khi gọi là xongMột forcing function buộc agent chứng minh bản sửa, thay vì chỉ khai là xong.Skill thực chiếnPlan trước, rồi mới codeMột forcing function buộc agent trình cách làm — và dừng lại — trước khi đụng vào code.Skill thực chiếnLập bản đồ ảnh hưởng trước khi sửaMột forcing function buộc agent truy ai đang phụ thuộc vào một symbol, trước khi nó đổi.Skill thực chiếnViệc có một đáp án thì đừng để model đoánMột forcing function đẩy việc có đáp án chính xác sang script, thay vì để model suy luận.Skill thực chiếnChẩn đoán từ triệu chứng, không từ phỏng đoánMột prompt buộc chẩn đoán thật trước khi viết một dòng sửa nào.Skill thực chiếnBắt nó phản biện chính kế hoạch của nóMột prompt ép một cách tiếp cận chịu thử lửa trước khi bạn đổ một dòng code nào vào nó.Skill thực chiếnBàn giao cho phiên làm việc sauMột slash command biến một phiên thành ghi chú mà phiên kế tiếp cầm lên là chạy.Skill thực chiếnMột bản review không đóng dấu cho quaMột Skill tái dùng được, review một thay đổi để tìm vấn đề thật thay vì duyệt theo phản xạ.Skill thực chiếnChạy tới cổng thì dừng, không phải soi từng bướcMột prompt cho agent tự chạy nhưng dừng đúng mấy chỗ đáng dừng — để bạn buông tay mà không mất kiểm soát.Skill thực chiếnBộ khung CLAUDE.md — biến file mô tả thành luật vận hànhMột khung tối thiểu để dán vào CLAUDE.md, nói cho agent biết phải mặc định gì, khi nào dừng hỏi, và chỗ nào nguy hiểm.Skill thực chiếnVòng review hàng tuần — năm phút biến trải nghiệm thành kỹ năngBa câu hỏi mỗi tuần để biết mình đang giỏi lên hay chỉ quen dần với mức tầm tầm.Skill thực chiếnChia việc thành mảnh gọn, mỗi mảnh một context sạchMột prompt buộc agent bẻ việc lớn thành vài mảnh độc lập kiểm được — thay vì nhét tất cả vào một lần chạy mù.Skill thực chiếnViệc này có đáng giao cho agent không — hỏi trước khi mở chatMột prompt pre-flight buộc agent tự soi xem việc có đáng giao, thay vì cắm đầu làm một việc lẽ ra một dòng lệnh.Skill thực chiếnThử một việc nhỏ trước khi tin agent ở miền mớiMột prompt buộc agent làm một mảnh nhỏ và lộ cách nó nghĩ — trước khi bạn giao nguyên việc lớn ở lĩnh vực nó chưa từng chứng minh.Bảo mật & niềm tinKhi agent cầm chìa khóa: câu hỏi không còn là 'nó có đúng không'Cho agent chạm vào hệ thống thật, mối lo đổi từ 'nó làm có chuẩn không' sang 'nó với tới được gì, và cái gì rời khỏi tầm tay bạn'Bảo mật & niềm tinAgent làm việc với mọi thứ nó với tới — nên hãy thu hẹp cái nó với tớiCách giữ an toàn không phải dặn nó 'đừng đụng chỗ kia', mà là làm cho chỗ kia nằm ngoài tầm tay ngay từ đầuBảo mật & niềm tinKhi dữ liệu biết ra lệnh: agent khó phân biệt cái cần đọc với cái cần ngheNó đọc một trang web, một file, một cái vé lỗi — và một câu nằm lẫn trong đó có thể trở thành mệnh lệnh nó làm theoBảo mật & niềm tinViệc không thể hoàn tác: agent gõ nó thản nhiên như mọi lệnh khácXóa, gửi, triển khai, thanh toán — vài hành động không có nút undo, và agent không cảm được điểm không-quay-lại nằm ở đâuLàm việc nhóm với agentKhi cả đội đều dùng agent: luật trong đầu một người không đủ cho cả độiMọi thứ bạn học cho riêng mình rạn ra khi ba người, ba con agent cùng đụng một chỗ — vì mỗi agent chỉ đọc được luật của chủ nóLàm việc nhóm với agentAgent viết ra nó là kẻ tệ nhất để tự kiểmAgent thứ hai đáng giá không phải vì thêm một đôi tay, mà vì một cặp mắt độc lập không chung điểm mù với đứa đầuLàm việc nhóm với agentBảo một agent cho mười ý tưởng, bạn nhận về một ý tưởng mười lầnPhân kỳ ở khâu ý tưởng cần một cái đầu khác hãng — và chính chỗ hai đứa bất đồng mới là phần đáng giữLàm việc nhóm với agentCho một đứa làm kiến trúc sư, đứa kia làm thợBắt một agent vừa quyết vừa làm thì kế hoạch bị nén vào lúc xây, rồi lặng lẽ trôi — chia theo tầm, kế hoạch thành một bản giao việc thợ không đọc trật đượcLàm việc nhóm với agentMột bộ luật chung cho mọi agent: viết hay đến mấy mà nó nằm trên máy bạn thì vô dụng với độiBộ luật chỉ giúp được những agent đọc được nó — nên nó phải nằm trong chỗ chung, được commit và review như code, không phải nằm trong máy một ngườiLàm việc nhóm với agentAi chịu trách nhiệm cho code agent viết: 'agent viết đấy' không phải một cái cớKhi nửa số thay đổi là do agent đẻ ra, trách nhiệm không được phép rơi vào khoảng không — người bấm nút gộp là người đứng tênLàm việc nhóm với agentĐưa đồng đội vào guồng agent: 'cứ dùng thoải mái' không truyền được tay nghềCái bạn làm giỏi là tri thức ngầm — biết giao gì, gài cổng ở đâu — nên thả người mới vào tay không là đẩy họ về một trong hai cực: giao bừa, hoặc không dám giaoTản mạnTôi dựng được mọi thứ, trừ một khách hàngVà người bạn AI agent của tôi là người đầu tiên dám nói thẳng điều đó.
c
Người viết

Mỗi câu chuyện ở đây gói một bài học đã trả giá để học.

craftagentmột người vừa xây vừa học

Bạn đang xây gì với agent? Muốn trao đổi, phản biện, hay cùng làm một thứ gì đó — viết cho mình một dòng.

58bài12cụmVI·ENsong ngữ

Nhận bài mới qua email

Ghi chép thực chiến về làm việc với AI agent — thi thoảng, không spam.