Chuyển đến nội dung chính

Bài đăng

Hiển thị các bài đăng có nhãn Claude

Mô hình Chief of Staff: biến đống chat AI rời rạc thành một đội ngũ agent

Sau nửa năm, setup AI của phần lớn mọi người trông giống hệt nhau: mười một con trợ lý tự tạo nhớ mang máng, một nghĩa địa tab trình duyệt, và cảm giác lấn cấn rằng cái mình mò ra hồi tháng Ba đang nằm đâu đó trong một cuộc chat không bao giờ tìm lại được. Tạo agent là phần dễ. Nền tảng nào — Grok Bot, custom GPT, Claude Projects — cũng làm được trong hai phút. Thứ phân biệt một setup hữu ích với một mớ bừa bộn không phải là số lượng agent. Mà là chúng có dùng chung bối cảnh không, có báo cáo công việc không, và có chạy được khi bạn không ngồi đó không. Chín thói quen dưới đây đưa bạn tới đó. Mình viết theo hướng không phụ thuộc nền tảng, vì mô hình này sống lâu hơn công cụ bạn đang xài năm nay. Phần 1 — Dạy hệ thống hiểu bạn là ai 1. Phỏng vấn chính mình trước Một đội ngũ agent chỉ tốt bằng mức nó hiểu tình hình của bạn. Mà phần lớn mọi người không bao giờ viết cái đó ra, vì nó chán và vì mình đã biết rồi. Vậy thì để AI moi nó ra. Tạo một skill hoặc prompt lưu sẵn với nhiệm vụ d...

Nghiên cứu thật sự nói gì về prompt engineering — kiểm chứng 5 tuyên bố đang lan truyền

Gần đây có một bài tóm tắt “khoa học đằng sau prompt engineering” được chia sẻ rất nhiều, dựa trên năm kết quả nghiên cứu. Danh sách ý tưởng thì hay. Nhưng mấy con số đi kèm lại thuộc kiểu được copy từ bài này sang bài khác mà không ai mở paper gốc ra coi. Nên mình mở ra coi. Hai trong năm tuyên bố là đúng. Ba cái còn lại thì không — ít nhất là không đúng theo cách đang được lan truyền. Có một trường hợp nghiên cứu thật còn cho kết quả ngược lại với lời khuyên. Không phải vì vậy mà vứt cả danh sách đi. Phần lời khuyên nền tảng phần lớn vẫn hợp lý. Nhưng nếu bạn định thay đổi cách làm việc dựa trên một nghiên cứu, thì nên biết đó là nghiên cứu nào và nó thật sự đo cái gì. Dưới đây là từng tuyên bố, phần nào mình kiểm chứng được, và mình sẽ làm gì với nó. Tóm tắt nhanh Tuyên bố Kết luận Câu hỏi mớm đáp án sẽ đẩy model theo hướng bạn đã ngụ ý ✅ Đúng ”Think step by step” giờ thua một role ngắn (IBM, 430.000 lượt đánh giá) ❌ Không tìm được nghiên cứu — và ...

The chief-of-staff pattern: turning scattered AI chats into an agent team

Most people’s AI setup looks the same after six months: eleven half-remembered custom assistants, a browser tab graveyard, and a nagging sense that the thing you figured out in March is buried in a chat you’ll never find again. Creating agents is the easy part. Every platform — Grok Bot, custom GPTs, Claude Projects — makes it a two-minute job. What separates a useful setup from a cluttered one is not how many agents you have. It’s whether they share context, report their work, and can run without you sitting there. Nine habits get you there. They’re written platform-agnostically, because the pattern outlives whichever tool you’re using this year. Part 1 — Teach the system who you are 1. Interview yourself first An agent team is only as good as its understanding of your situation. And most people never write that down, because it’s tedious and they already know it. Make the AI extract it instead. Create a skill or saved prompt whose only job is to interrogate you — one question a...

What the research actually says about prompt engineering — five claims, fact-checked

A summary of “the science behind prompt engineering” has been going around, built on five research findings. It is a good list of ideas. But the numbers attached to them are the kind that get copied from post to post without anyone opening the paper, so I opened the papers. Two of the five claims check out. Three do not — at least not in the form they are being repeated. In one case the real research points in the opposite direction from the advice. That is not a reason to throw the list away. The underlying advice is mostly sound. But if you are going to change how you work based on a study, it is worth knowing which study, and what it actually measured. Here is each claim, what I could verify, and what I would actually do about it. Quick summary Claim Verdict Leading questions push models toward the answer you implied ✅ Confirmed ”Think step by step” now loses to a short role prompt (IBM, 430,000 evaluations) ❌ Study not found — and persona research...