Cộng đồng AI đang phát cuồng! Mới đây, một tài khoản X tên Chaofan Shou đã đăng tải thông tin "Mã nguồn của Claude Code đã bị rò rỉ thông qua một file ánh xạ trong kho lưu trữ npm của nó!" Chỉ trong thời gian ngắn, bài đăng đã thu hút hàng triệu lượt xem. Một lượng lớn cư dân mạng đã nhanh chóng theo dõi, điên cuồng sao chép dự án và phân tích mã nguồn. Link: https://github.com/sanbuphy/claude-code-source-code Một số cư dân mạng bình luận: "Đây dường như là một sự cố ngoài ý muốn của nhóm Claude Code, họ đã vô tình tải mã nguồn phiên bản 2.1.88 trực tiếp lên gói npm. Cấu trúc mã tổng thể rất hoàn thiện, và toàn bộ kho lưu trữ..." Quy trình rất chi tiết, với quy trình làm việc chính bao gồm khởi động REPL, QueryEngine, đăng ký công cụ, lệnh Slash, hệ thống quyền hạn, hệ thống tác vụ và quản lý trạng thái đa lớp — một thiết kế khung sườn tác nhân AI cấp độ sản xuất rất điển hình. Tất cả các công cụ đều có thể xem được. [Link: https://x.com/sanbuphy/status/2038912992457408838] Theo nhiều người dùng Twitter, vụ rò rỉ này "không phải do hack gây ra, mà chính Anthropic đã đóng gói source map vào phiên bản sản xuất khi phát hành trên npm." Vụ rò rỉ này bắt nguồn từ một tệp cli.js.map có dung lượng khoảng 57MB, chứa toàn bộ nội dung của 4756 tệp nguồn: trong đó 1906 tệp là mã nguồn TypeScript/TSX của chính Claude Code, và 2850 tệp còn lại đến từ các phụ thuộc node_modules. Quan trọng hơn, phương pháp trích xuất hầu như không tốn công sức. `cli.js.map` về cơ bản là một tệp JSON, chứa hai mảng cốt lõi: `sources`: một danh sách các đường dẫn tệp; `sourcesContent`: mã nguồn hoàn chỉnh tương ứng. Hai mảng này được khớp một-một theo chỉ mục. Nói cách khác, không cần dịch ngược hoặc giải mã; `sourcesContent` lưu trữ trực tiếp nội dung nguyên văn của mã nguồn gốc. Việc khôi phục hàng loạt có thể được thực hiện bằng một đoạn mã đơn giản. Từ mã được khôi phục, kiến trúc tổng thể của Claude Code có thể được nhìn thấy rõ ràng: Giao diện dòng lệnh (CLI) được xây dựng trên React + Ink. Cốt lõi là một vòng lặp REPL hỗ trợ nhập liệu bằng ngôn ngữ tự nhiên và các lệnh gạch chéo. Lớp nền tương tác với API mô hình lớn thông qua một hệ thống công cụ. Các chi tiết triển khai chính, bao gồm thiết kế kiến trúc, lời nhắc hệ thống và logic gọi công cụ, đều được công khai hoàn toàn.


Cơ chế Daemon nền KAIROS—Hiện tại, Claude Code vẫn là một công cụ dòng lệnh chỉ phản hồi một yêu cầu nhỏ, nhưng mã bị rò rỉ tiết lộ tham vọng tiếp theo của Anthropic: giữ cho Agent luôn trực tuyến. Mã bao gồm một mô-đun tính năng được ẩn bởi Feature Flag (cờ xây dựng), có tên mã là KAIROS. Đây là một daemon nền tự động. Sau khi được kích hoạt, Agent có khả năng phiên nền và có thể trực tiếp đăng ký webhook của GitHub (ví dụ: nó sẽ tự động sửa lỗi mới trong nền). Điều thú vị hơn nữa là nó bao gồm một cơ chế nén bộ nhớ gọi là "dream", được sử dụng để nén và hợp nhất bộ nhớ dài hạn trong thời gian nhàn rỗi. Mô hình "Capybara" bí ẩn — Mô hình Capybara thực sự tồn tại. Các bình luận mã bị rò rỉ liên tục đề cập đến tên mã của một mô hình chưa được phát hành, "Capybara" (gần đây, các tài liệu nội bộ cũng tiết lộ rằng tên chính thức của nó là Claude Mythos, một mô hình thế hệ mới mạnh mẽ được định vị cao hơn Opus). Mã bị rò rỉ bao gồm thông tin về phiên bản capybara-fast, cũng như nhật ký gỡ lỗi nội bộ từ các nhà phát triển liên quan đến việc "đưa ra tuyên bố sai" về mô hình. **Giám sát cảm xúc** Hệ thống đo từ xa cơ bản cho thấy Anthropic rất nhạy cảm với sự thất vọng của các nhà phát triển. Hệ thống theo dõi cụ thể xem người dùng có chửi rủa Claude trong terminal hay không và tần suất gõ liên tục "continue" (một hành vi thất vọng thường do đầu ra của mô hình bị gián đoạn). Sau đó, Anthropic đã nhận ra vấn đề và xóa bản đồ nguồn; kho lưu trữ trên GitHub được sử dụng để trích xuất mã nguồn cũng đã bị xóa bởi DMCA. Tuy nhiên, do các gói npm ban đầu đã được lưu vào bộ nhớ cache và sao chép, mã nguồn này đã lan truyền rộng rãi trong cộng đồng, khiến việc thu hồi hoàn toàn trở nên khó khăn. Một số cư dân mạng cũng chỉ ra rằng đây là lần thứ hai Anthropic mắc phải sai lầm cơ bản như vậy. Hồi tháng 2 năm 2025, nó lại bị rò rỉ, lúc đó Anthropic đã khẩn trương gỡ bỏ và sửa chữa, nhưng giờ lại vấp phải cùng một chỗ. Hiện tại, một số kho lưu trữ sao chép hoàn chỉnh đã xuất hiện trên GitHub (như leeyeel, dnakov, ghuntley, v.v.), với mã nguồn được sắp xếp gọn gàng, cho phép bất kỳ ai cũng có thể trực tiếp nghiên cứu hoặc thậm chí sao chép nó. Chỉ trong một giờ, một trong những dự án sao chép Claude Code đã vượt qua 12.000 lượt đánh dấu sao trên GitHub và hơn 18.000 lượt sao chép. Địa chỉ dự án: https://github.com/instructkr/claude-code Về vụ rò rỉ Claude Code, một số người đã nói đùa rằng, "Đây là món quà sinh nhật tuyệt vời nhất từ trước đến nay." Lần này, Claude Code thực sự đã được công khai mã nguồn, và các sản phẩm quan trọng của công ty AI nổi tiếng này đã bị phơi bày hoàn toàn. Đối với ngành công nghiệp, điều này cung cấp một số tài liệu tham khảo cho nhiều vấn đề. Giờ đây, "các phương pháp tốt nhất" từ các công ty AI hàng đầu trong ngành đã có sẵn cho tất cả mọi người. Làm thế nào để thực hiện nén ngữ cảnh? Làm thế nào để quản lý bộ nhớ dài hạn của các tác nhân thông minh? Làm thế nào để lên lịch giao thức MCP một cách an toàn? Những điều này, trước đây được coi là khá bí mật, giờ đây đã có các tài liệu tham khảo công khai. Sẽ không có gì đáng ngạc nhiên nếu các tác nhân của nhiều công ty khác nhau nhận được các bản cập nhật phiên bản lớn trong vài ngày tới.