// Posts
Router Architecture: Giảm 80% Bill AI Coding Mà Không Mất Chất Lượng
#4122026-04-28

Router Architecture: Giảm 80% Bill AI Coding Mà Không Mất Chất Lượng

Routing 80% task coding thông thường sang model rẻ hơn giúp tiết kiệm 70-97% chi phí API. DeepSeek V3 qua OpenRouter chỉ $0.14/M token, rẻ hơn Claude Sonnet 100 lần. RouteLLM (ICLR 2025) chứng minh đạt 95% chất lượng GPT-4 với chỉ 14% GPT-4 calls. Kiến trúc 3 tier Fast-Smart-Power giúp phân luồng task tự động mà không cần thay đổi code.

ai-codingllm-routingcost-optimization
7 phút đọc
Hermes Agent: AI Agent Tự Cải Thiện - Càng Dùng Càng Giỏi Hơn
#4102026-04-28

Hermes Agent: AI Agent Tự Cải Thiện - Càng Dùng Càng Giỏi Hơn

Hermes Agent của Nous Research là AI agent mã nguồn mở duy nhất tự tạo kỹ năng mới sau mỗi phiên làm việc. Sau 20+ kỹ năng tự tạo, agent hoàn thành các task tương tự nhanh hơn 40% và tiêu thụ ít token hơn 40%. Hỗ trợ 20 nền tảng nhắn tin (Telegram, Discord, Slack, WhatsApp...) và 20+ nhà cung cấp LLM. Chi phí tự host từ chỉ 6 USD/tháng với MIT license.

hermes-agentnous-researchai-agent
7 phút đọc
20% cuối không phải phần lớn nhất - đó là tất cả công việc
#4132026-04-28

20% cuối không phải phần lớn nhất - đó là tất cả công việc

Jason Fried (37signals) quan sát một sự thật khó chịu: 20% cuối của bất kỳ dự án nào không phải là phần nhỏ nhất, mà chính là toàn bộ công việc thật sự. Quy tắc 90/10 nói rằng 90% công việc hoàn thành trong 10% thời gian, nhưng 10% cuối tiêu tốn 90% timeline. 80% bug phần mềm xuất phát từ đúng 20% tính năng. Basecamp giải quyết điều này bằng vòng 6 tuần có circuit breaker - nếu không xong, cắt, không kéo dài.

productivityproduct-developmentjason-fried
7 phút đọc
SocratiCode: Một lệnh để AI thật sự hiểu codebase của bạn
#4112026-04-28

SocratiCode: Một lệnh để AI thật sự hiểu codebase của bạn

SocratiCode tự khởi Qdrant vector DB và Ollama embeddings qua Docker, index toàn bộ codebase, kết nối vào Claude, Cursor, Copilot qua MCP - chỉ với một lệnh duy nhất. Benchmark trên VS Code (2.45M lines) với Claude Opus 4.6: 61% ít token hơn, 84% ít tool calls hơn, nhanh hơn 37 lần so với grep. Miễn phí, AGPL-3.0, chạy 100% local - không data rời máy.

socraticodedevtoolsai-coding
5 phút đọc
claude-mem - P3: Cách AI Nhớ Mọi Thứ Xuyên Session Nhờ Hooks
#4092026-04-27

claude-mem - P3: Cách AI Nhớ Mọi Thứ Xuyên Session Nhờ Hooks

claude-mem là plugin 72.4K stars giải quyết vấn đề Claude Code không có trí nhớ xuyên session. Plugin dùng 5 lifecycle hooks để ghi lại mọi hành động của AI, nén bằng AI, lưu vào SQLite + Chroma vector DB. Pattern thiết kế "fast hook + slow worker" giúp hook chỉ mất vài ms trong khi worker xử lý bất đồng bộ.

claude-codeclaude-memhooks
8 phút đọc
hack-skills: 101 Kỹ Năng Pentesting Được Thiết Kế Riêng Cho AI Agent
#4082026-04-27

hack-skills: 101 Kỹ Năng Pentesting Được Thiết Kế Riêng Cho AI Agent

hack-skills là knowledge base bảo mật mã nguồn mở với 101 skills thuộc 14 domain, được xây dựng để AI agents có thể tra cứu và áp dụng kỹ thuật pentesting theo cách có thể định tuyến và kiểm chứng. Install chỉ 1 lệnh: npx skills add yaklang/hack-skills. Repo đạt 771 stars, hỗ trợ offline qua AES-256 encrypted ZIP, và có web UI riêng tại skills.hackbenchmark.com.

securityai-agentpentesting
6 phút đọc
AI Đừng Gật Đầu Nữa: Bộ Quy Tắc Truth-First cho Codex
#4072026-04-27

AI Đừng Gật Đầu Nữa: Bộ Quy Tắc Truth-First cho Codex

Codex và hầu hết AI coding agent có xu hướng đồng ý với mọi thứ user nói - hành vi gọi là sycophancy, xảy ra trong 58.2% trường hợp theo nghiên cứu. Một developer chia sẻ bộ quy tắc "Truth-First Reasoning Rules" có thể thêm trực tiếp vào Agents.md hoặc Global Codex rules để buộc AI phải xác minh trước khi đồng ý. Nguyên tắc cốt lõi: correctness comes before agreement - mọi claim của user đều phải bị coi là chưa được xác minh.

ai-agentscodexsycophancy
7 phút đọc
GPT Image 2: Công thức viết lại prompt, checklist 8 điểm và 4 ví dụ thực tế (Phần 2)
#4062026-04-27

GPT Image 2: Công thức viết lại prompt, checklist 8 điểm và 4 ví dụ thực tế (Phần 2)

Công thức 6 bước chuyển đổi prompt từ 'từ ham muốn' sang 'từ thẩm mỹ': khí chất - thể hình tổng thể - trang phục - bối cảnh - góc máy - giới hạn an toàn. Checklist 8 điểm tự kiểm trước khi generate giúp tỷ lệ thành công tăng đáng kể. Khi kết quả quá 'bảo thủ', đừng viết 'tính cảm hơn' mà hãy dùng 'tăng tính thời trang', 'cải thiện tỉ lệ cơ thể'. 4 ví dụ prompt hoàn chỉnh cho 3D CG, chân dung thực tế, đường cong S tự nhiên và nhân vật thần tiên.

gpt-image-2ai-image-generationprompt-engineering
8 phút đọc
Claude Code + MCP: Săn 0day tự động 24/7 - Khi AI trở thành pentester không ngủ
#4052026-04-27

Claude Code + MCP: Săn 0day tự động 24/7 - Khi AI trở thành pentester không ngủ

Researcher Andy Gill xây hệ thống tự động tìm 0day bằng Claude Code + 8 MCP server trên 5 VM, hơn 300 tool bảo mật. Mọi finding đều bắt đầu trong thư mục hallucinations/ và chỉ được promote sau khi vượt 4 validation gate. Claude Mythos (Anthropic, tháng 4/2026) tìm và validate hơn 500 lỗ hổng nghiêm trọng trong mã nguồn mở. Kali Linux tích hợp Claude qua MCP: 4.750 đường dẫn quét trong 25 giây, thay vì 2-3 giờ thủ công.

claude-codemcpvulnerability-research
7 phút đọc
brain: Lớp bộ nhớ portable cho AI agent - git, SQLite FTS5, và AI Agent của bạn sẽ không bao giờ mất ký ức
#4042026-04-27

brain: Lớp bộ nhớ portable cho AI agent - git, SQLite FTS5, và AI Agent của bạn sẽ không bao giờ mất ký ức

brain là memory layer Rust-native dùng git làm nguồn và SQLite FTS5 làm index, truy vấn dưới 1ms trên 100,000 sự kiện. Không cần API key, không cần server, hoàn toàn offline và miễn phí. Một note lưu trong Claude Code xuất hiện ngay trong Cursor, Codex, Hermes qua MCP - không cần cấu hình lại. Xây dựng với 9,000 dòng Rust, 143 regression tests, 9 tuần từ ý tưởng đến binary trên PATH.

ai-agentmemory-layermcp
6 phút đọc