blog.dopana

Back

Trong thời đại dùng AI coding assistant như Claude Code, Codex, Cursor, một vấn đề ngày càng rõ: AI nói quá nhiều.

Một câu trả lời kỹ thuật đáng lẽ chỉ cần:

Bug: object tạo mới mỗi render.
Fix: dùng useMemo.
plaintext

nhưng AI thường trả về:

Great question! The reason this happens is because React's rendering system...
plaintext

Rất nhiều chữ, nhiều token, nhưng thông tin không tăng tương ứng.

Caveman ra đời để giải quyết vấn đề này.

Caveman Là Gì?#

Caveman là skill/plugin cho AI coding agent. Nó không phải model mới, không thay đổi khả năng suy luận — nó chỉ thay đổi cách AI giao tiếp:

  • Bỏ câu mở đầu thừa
  • Bỏ giải thích lặp lại
  • Dùng câu ngắn
  • Giữ thông tin kỹ thuật quan trọng

Ví Dụ#

Bình thường#

Great question! React components can re-render for several reasons.
One common reason is that when you create a new object inline,
React sees it as a different reference...
plaintext

Caveman style#

New object reference every render.
Inline object prop = new reference = re-render.
Use useMemo.
plaintext

Cùng ý nghĩa, ít hơn 70% token.

Vì Sao Giảm Token Quan Trọng?#

Một session AI coding agent có thể gồm nhiều lượt:

  • User hỏi → AI trả lời → Tool call → Đọc file → AI trả lời → Fix code → AI trả lời

Nếu mỗi response 1000 token × 50 lượt = 50,000 token. Giảm còn 300 token × 50 lượt = 15,000 token.

Context dùng được lâu hơn, ít bị giới hạn context window hơn.

Cài Đặt#

curl -fsSL https://raw.githubusercontent.com/JuliusBrussee/caveman/main/install.sh | bash
bash

Yêu cầu Node.js ≥ 18. Sau cài, dùng lệnh:

/caveman
plaintext

để bật chế độ Caveman.

Các Mode#

ModeMức nén
/caveman liteNhẹ, vẫn dễ đọc
/caveman fullNgắn hơn
/caveman ultraCực kỳ cô đọng

Ngoài Trả Lời Ngắn#

Commit message:

fix auth session handling
plaintext

Review code:

L42 🔴 null possible. Add guard.
plaintext

Compress memory/context: caveman-compress rút gọn CLAUDE.md, project notes — agent start với context nhỏ hơn.

So Sánh#

Bình thườngCaveman
Độ dàiDàiNgắn
TokenNhiềuÍt
Giải thíchNhiềuTối giản
Coding qualityTốtTốt
Đọc nhanhTrung bìnhCao

Kết Luận#

Caveman không làm AI thông minh hơn — nó làm AI ít nói hơn. Trong workflow coding với AI agent, thứ đắt giá không chỉ là suy luận mà còn là context window, token cost, và tốc độ đọc.

Caveman biến AI từ “giải thích dài” thành “nói chuyện ngắn gọn”. Ít chữ hơn, vẫn làm được việc.

Tài liệu tham khảo#