Recent

17
#18

Rate limiter không phải bài toán chọn thuật toán — một buổi phỏng vấn đào mãi không đáy

Mình vào phỏng vấn architect, được hỏi "thiết kế một rate limiter", và bắt đầu kể tên thuật toán. Nhưng người phỏng vấn chẳng quan tâm mình chọn cái nào — mỗi câu trả lời chỉ mở ra một câu hỏi sâu hơn: hai mươi server thì đếm ở đâu, lấy đồng hồ của ai, Redis chết thì cho qua hay chặn, và rate limiting có phải là tất cả không.

~13 phút
#17

Con Redis không cho không cái gì — cái giá ẩn sau mỗi lớp cache

Hồi mới đi làm, với mình caching là "API chậm thì quăng con Redis vào". Ôn phỏng vấn architect mình mới thấy cái "quăng vào" đó kéo theo cả chuỗi bài toán — invalidation, ba kiểu làm DB gục, nhất quán cache–DB — và hoá ra nó chính là Dual Write Problem đội lốt.

~12 phút
#16

Từ monolith đến idempotency: một sợi dây, không phải sáu flashcard

Ngồi ôn phỏng vấn vị trí architect, mình nhận ra lên level không phải viết code giỏi hơn mà thấy được cả hệ thống. Sáu chủ đề từng học vẹt — microservices, 2PC, Saga, CAP, Outbox, idempotency — hoá ra là một sợi dây nhân quả: lời giải này đẻ ra vấn đề kia.

~13 phút
#15

Hai người thợ trong cỗ máy AI

Mỗi lần AI trả lời, có hai người thợ tính cách trái ngược thay nhau làm việc — và gần như mọi thủ thuật tăng tốc inference đều sinh ra từ mâu thuẫn giữa họ. Một chuyến đi vào bên trong cỗ máy suy luận: prefill, decode, KV cache, batching, quantization.

~14 phút
#13

Claude Code trong codebase lớn: cách nó hoạt động và bắt đầu từ đâu

Claude Code vận hành trong monorepo nhiều triệu dòng bằng agentic search thay vì index. Bài này tóm tắt cách nó hoạt động, các lớp harness cần dựng để mở rộng, và một lộ trình bắt đầu cụ thể cho codebase lớn.

~10 phút
#12

Đừng prompt agent nữa — hãy thiết kế cái vòng lặp prompt nó

Một câu của Peter Steinberger đạt 2.2 triệu view khiến cả giới dev cãi nhau cả tuần. Đọc xong mình nhận ra mình vẫn đang kẹt ở thời "chat" — và cái giá thật sự không nằm ở token.

~9 phút
#11

Hầu hết note của tôi chết trong một cái folder — và tôi đã sửa nhầm vấn đề suốt hai năm

Đọc một guide xây hệ thống Obsidian thiết kế từ phía ngược lại: không tối ưu cho lúc lưu, mà cho lúc dùng. Đọc xong mình hiểu tại sao cái vault mấy trăm note của mình chưa bao giờ trả lại cái gì.

~9 phút
#10

Những thứ tôi học được sau 5 năm làm engineer — viết lúc hơi ngà ngà

Đọc một bài Reddit cũ của data engineer say rượu viết thật thà về 10 năm đi làm. Mình ngồi viết lại theo góc nhìn của mình — đồng ý khoảng 80%.

~10 phút
#09

Prompt engineering không khó như bạn nghĩ — và không dễ như người ta nói

Có hàng trăm bài về prompt engineering, hầu hết giải thích lại cùng những khái niệm. Bài này nói thứ không bài nào nói thẳng: tại sao advice không apply được vào production.

~9 phút
#08

Tôi đọc source code bị leak của Claude Code và nhận ra mình đang build agent sai từ đầu

12 patterns mình rút ra từ harness của Claude Code, chia thành bốn nhóm — memory, workflow, tools, automation. Ba cái khiến mình phải dừng lại suy nghĩ lại.

~12 phút
#07

Karpathy vừa mô tả đúng thứ tôi đã thất bại khi xây và lý do tôi sẽ thử lại

Andrej Karpathy post một gist về pattern xây personal knowledge base bằng LLM. Đọc xong mình ngồi im — ông đặt tên đúng cho vấn đề mình loay hoay hai năm trước.

~7 phút
#06

Claude không đếm tin nhắn — nó đếm token. Và tôi đã dùng sai từ đầu.

10 thói quen giúp hết cảnh bị limit giữa chừng — đọc xong mình nhận ra mình đang lãng phí token theo ít nhất ba cách khác nhau.

~6 phút
#05

Hai dòng code ẩn khiến Claude Code ngốn token gấp bốn lần

Một người dùng Reddit reverse-engineer minified source, tìm ra bug caching khiến token drain, và patch bằng đúng hai dòng.

~5 phút
#04

AI không phải phép màu nhưng ai đó đang cố làm bạn quên điều đó

Đọc một bài khá nặng tay về hype AI, có chỗ đồng ý, có chỗ không. Viết lại theo góc nhìn của người đang xây sản phẩm thật.

~6 phút
#03

Claude không biết mình đang nghĩ gì và điều đó đáng lo hơn bạn nghĩ

Anthropic vừa công bố loạt nghiên cứu về cách Claude thực sự vận hành bên trong. Không phải cách nó tự mô tả. Mà là cách nó thực sự hoạt động.

~9 phút
#02

RAG thông thường đang nói dối bạn và bạn chưa nhận ra

Sau một thời gian build chatbot nội bộ bằng RAG, mình nhận ra mình đã hiểu nhầm vấn đề cốt lõi ngay từ đầu.

~8 phút
#01

Tôi đã dùng AI sai cách suốt gần một năm

Đọc một bài viết của kỹ sư bên Mỹ, giật mình nhận ra mình đang mắc đúng cái bẫy họ mô tả.

~6 phút