Hoán não Claude Code bằng GPT-5.6 Sol: Bài học modular từ cuộc chiến AI
Một giám đốc sản phẩm của OpenAI công khai hướng dẫn developer: giữ nguyên vỏ Claude Code, thay ruột bằng GPT-5.6 Sol. Vài giờ sau, hàng loạt tài khoản Anthropic bị khóa. Lý do chính thức: "cơ chế chống rủi ro kích hoạt nhầm". Nhưng thông điệp kỹ thuật đã rõ ràng: bộ não của AI có thể thay thế, lớp vỏ thì đứng im. Và với người theo dõi blockchain, sự kiện này không hề mới mẻ.
Chúng ta đã thấy kiến trúc này ở đâu rồi. Nhưng trước khi đi sâu, hãy đọc kỹ câu chuyện từ đầu.
Claude Code là công cụ lập trình Agent của Anthropic, có khả năng đọc codebase, sửa file, thực thi lệnh terminal, tổ chức luồng công việc của developer. Trong giới lập trình, đây là một trong những sản phẩm AI coding được đánh giá cao nhất hiện nay. GPT-5.6 Sol là mô hình ngôn ngữ mới nhất của OpenAI, được định vị là "mô hình có thể chạy hầu như ở mọi nơi". Nghe có vẻ đơn giản, nhưng câu chuyện đằng sau lại phức tạp hơn nhiều.
Thông thường, mỗi công ty AI bán một hệ sinh thái khép kín. OpenAI có ChatGPT với GPT. Anthropic có Claude với Claude Code. Người dùng chọn một bên, trả tiền cho một bên, sống trong hệ sinh thái của bên đó. Đó là mô hình tích hợp dọc - vertical integration - và nó được coi là nền tảng của ngành.
Tuần trước, Tibo - giám đốc sản phẩm của OpenAI - đã phá vỡ quy ước này bằng một bài đăng hướng dẫn kỹ thuật cụ thể: giữ Claude Code làm giao diện điều khiển, chuyển toàn bộ xử lý ngôn ngữ sang GPT-5.6 Sol. Không phải lời khuyên vô thưởng vô phạt. Hàng loạt developer làm theo, kiểm chứng, và nó hoạt động. Ngay sau đó, các tài khoản Anthropic bị khóa hàng loạt. Người đứng đầu Claude Code, Boris Cherny, đáp lại: "gần như chắc chắn là cơ chế chống rủi ro khác kích hoạt nhầm".
Với tôi, một người dành 16 năm nhìn vào dữ liệu giao thức, câu trả lời đó giống hệt một giao thức tài chính nói "lỗi từ phía ví người dùng" khi thực ra họ đã đổi quy tắc mà không thông báo.
Bạn có biết điều gì xảy ra khi hai ông lớn AI bắt đầu bán "não" và "vỏ" một cách độc lập? Tôi thì biết. Tôi đã nhìn thấy chính xác kiến trúc này trong DeFi từ năm 2020.
Hãy bóc tách sự kiện bằng khung phân tích của một người làm blockchain. Bởi vì câu chuyện "thay não" này, ở cấp độ kiến trúc, chính là câu chuyện tách lớp modular mà Ethereum và các rollup đã thực hiện nhiều năm trước.
Trong blockchain, chúng ta có khái niệm execution layer - tầng thực thi - và settlement layer - tầng thanh toán. Ethereum giữ vai trò tầng thanh toán: đảm bảo tính cuối cùng, giải quyết tranh chấp, giữ tài sản gốc. Các rollup như Arbitrum, Optimism là tầng thực thi: xử lý giao dịch nhanh, rẻ, với thông lượng hàng nghìn giao dịch mỗi giây. Chúng kết nối qua chuẩn giao thức, không phải qua quan hệ sở hữu.
Bây giờ nhìn vào Claude Code. Sản phẩm này đang ở vị trí tầng thực thi: nó tương tác trực tiếp với developer, đọc file, chạy lệnh, tổ chức toàn bộ luồng công việc. GPT-5.6 Sol, cùng với Claude của Anthropic, đóng vai tầng thanh toán của năng lực ngôn ngữ: đưa ra quyết định, sinh mã, phân tích logic, trả lời câu hỏi. Giữa hai tầng này có một lớp adapter - có thể là một API client, một proxy layer, hoặc xa hơn là MCP - Model Context Protocol - đóng vai trò giống như chuẩn ERC-20 trong hệ sinh thái Ethereum.
Điều gì xảy ra khi các tầng này tách rời? Chúng ta vừa chứng kiến chính xác điều đó. Developer không còn bị khóa cứng trong hệ sinh thái của một nhà cung cấp. Họ chọn công cụ tốt nhất cho từng lớp. Họ giữ Claude Code vì giao diện đã quen, vì tốc độ, vì hệ thống tool calling được tối ưu hóa. Nhưng họ chọn GPT-5.6 Sol cho các tác vụ cần khả năng suy luận vượt trội. Sự lựa chọn không còn là "hoặc OpenAI, hoặc Anthropic". Bây giờ là "giao diện từ công ty này, bộ não từ công ty kia".
Sự thật nằm ở số liệu, không phải ở lời hứa.
Người ta có thể nhìn vào sự kiện và nghĩ rằng đây chỉ là một trận khẩu chiến PR. Nhưng tôi nhìn vào ba lớp dữ liệu khác nhau.
Lớp thứ nhất: tín hiệu kỹ thuật. Việc Claude Code chấp nhận GPT-5.6 Sol không phải một cấu hình vô tình có được. Nó hoạt động. Điều đó nghĩa là kiến trúc của Claude Code đã có sẵn một lớp trừu tượng hóa để giao tiếp với nhiều mô hình khác nhau - dù thông qua chuẩn API, một giao thức tương thích, hay một cơ chế proxy mà cộng đồng tự phát triển. Điều này không xảy ra ngẫu nhiên.
Tôi nhớ lại năm 2017, khi tôi kiểm tra thủ công smart contract của Confido. Hợp đồng đó có một hàm rút tiền mà bất kỳ ai cũng có thể gọi. Không phải vì tác giả không biết code. Vì họ cố tình để hàm đó mở. Tôi phát hiện ra sau ba giờ audit thủ công, nhưng dự án vẫn huy động được 375.000 USD trước khi sập. Bài học tôi giữ đến hôm nay: hệ thống kỹ thuật không bao giờ ngẫu nhiên. Nếu Claude Code có thể chạy GPT-5.6 Sol, thì hoặc Anthropic đã xây dựng khả năng này có chủ đích, hoặc họ đã để tồn tại một lỗ hổng cấu trúc.
Điều thú vị là Anthropic không vội vàng vá lỗ hổng này. Họ chỉ khóa tài khoản. Điều đó đặt ra một câu hỏi lớn hơn: họ muốn giữ khả năng hoán đổi model ở mức độ kiểm soát được, hay đơn giản là họ không thể đóng nó nhanh chóng? Câu trả lời nằm trong telemetry - và đó là lớp dữ liệu thứ hai.
Cơ chế phòng chống rủi ro của Anthropic phát hiện hành vi bất thường khi người dùng đổi model. Để làm được điều đó, hệ thống phải thu thập telemetry từ client Claude Code: tần suất gọi API, đặc tính request, dấu vân tay của chuỗi token đầu ra, thời gian phản hồi. Không ai nói về chuyện này, nhưng nó hiển nhiên về mặt kỹ thuật. Boris Cherny có thể gọi đó là "kích hoạt nhầm", nhưng để kích hoạt nhầm thì hệ thống phải phát hiện được một tín hiệu khác lạ. Tín hiệu đó là gì? Chỉ có đội ngũ Anthropic biết.
Điều này dẫn đến một hệ quả quan trọng về quyền riêng tư trong hệ sinh thái AI. Khi bạn dùng Claude Code với GPT, bạn vẫn gửi toàn bộ mã nguồn, toàn bộ prompt, toàn bộ lịch sử phiên làm việc qua client của Anthropic. OpenAI nhìn thấy một phần. Nhưng Anthropic nhìn thấy tất cả. Và Anthropic biết chính xác bạn đã chuyển sang model nào, khi nào, và tần suất ra sao. Đây là một vị thế bất đối xứng về dữ liệu mà không ai trong cuộc tranh luận "mở so với đóng" đang thực sự đề cập.
Tôi từng viết một bot phát hiện cơ hội arbitrage giữa Compound và Aave vào tháng 8/2020. Mỗi lần gọi dữ liệu từ một giao thức, tôi để lại dấu vết. Giao thức biết tôi đang so sánh thanh khoản của họ với đối thủ. Không có gì vô hình cả. Claude Code cũng vậy. Mọi thứ đều là dữ liệu.
Lớp thứ ba: kinh tế học của sự tách rời. Hãy nhìn vào dòng tiền. Khi một developer chuyển Claude Code sang GPT-5.6 Sol, Anthropic mất doanh thu API từ một khách hàng đang hoạt động. Họ vẫn phải duy trì Claude Code: server, nhân lực hỗ trợ, chi phí vận hành client. Nhưng họ không thu được gì từ việc người dùng gọi model. Đây chính là sự lệch pha kinh tế kinh điển trong mô hình "vỏ - não tách rời".
Ngược lại, OpenAI nhận được doanh thu API từ một developer mà họ không phải bỏ chi phí thu hút. Không cần phát triển công cụ, không cần xây dựng client, không cần đầu tư giao diện. Chỉ cần cung cấp model. Đây là chiến lược "bán não, thuê vỏ" - một phiên bản AI của mô hình mà các giao thức thanh khoản trong DeFi đã dùng để tận dụng front-end của bên thứ ba.
Nhưng chưa dừng lại ở đó. Sau vụ việc, OpenAI lập tức reset toàn bộ giới hạn sử dụng cho người dùng trả phí ChatGPT Work và Codex. Truyền thông gọi đó là hào phóng. Tôi gọi đó là một khoản chiến lược. Khi hàng nghìn developer đổ xô thử nghiệm GPT trong Claude Code, OpenAI thu được dữ liệu sử dụng thực tế ở quy mô chưa từng có: mẫu prompt, cách gọi tool, cách debug, cách lập kế hoạch tác vụ. Những dữ liệu này không thể mua được từ phòng thí nghiệm. Khoản chi phí để reset giới hạn sử dụng chỉ là cái giá rẻ để đổi lấy một mỏ vàng dữ liệu.
Chạy nhanh không quan trọng bằng chạy đúng hướng.
Nói đến MCP, chúng ta đang nói đến một tầng quyền lực mới trong ngành AI. MCP là giao thức mở do Anthropic giới thiệu, cho phép các ứng dụng kết nối với nhiều mô hình và công cụ khác nhau. Về bản chất, nó là chuẩn giao tiếp giữa "vỏ" và "não". Nếu MCP được cả Anthropic lẫn OpenAI chính thức hỗ trợ, nó sẽ trở thành tiêu chuẩn de facto toàn ngành.
Dựa trên kinh nghiệm theo dõi giao thức blockchain của tôi, khi một chuẩn giao thức được áp dụng rộng rãi, giá trị không nằm ở chuẩn đó mà nằm ở nơi giá trị được tích lũy. Trong Ethereum, ERC-20 giúp hàng trăm nghìn token ra đời, nhưng giá trị tích lũy ở ETH - tài sản dùng để trả phí gas. Trong AI, câu hỏi tương tự đặt ra: giá trị sẽ tích lũy ở đâu? Ở model - nơi tạo ra output? Ở client - nơi thu thập dữ liệu người dùng? Hay ở tầng gateway - nơi định tuyến giữa các model? Sự kiện hoán não lần này đang phơi bày câu hỏi đó rõ hơn bao giờ hết.
Sẽ sớm có những model gateway đầu tiên, tương tự như 1inch trong DeFi: tổng hợp thanh khoản từ nhiều nguồn, định tuyến lệnh tối ưu. Trong AI, các gateway này sẽ định tuyến request đến model phù hợp nhất dựa trên giá, độ trễ, chất lượng phản hồi, thậm chí tùy chỉnh theo từng ngành nghề. Những công ty xây dựng tầng hạ tầng này sẽ nắm giữ một phần quyền lực đáng kể.
Bây giờ, hãy nhìn vào góc phản trực giác mà hầu hết bài phân tích bỏ qua.
Đa số cho rằng vụ này là thắng lợi của OpenAI. Lý do đưa ra: OpenAI dạy developer dùng model của mình ngay trong sản phẩm của đối thủ, thu về doanh thu, dữ liệu, sự chú ý. Anthropic bị đặt vào thế thủ. Nhưng tôi nhìn khác.
Anthropic không hề ngây thơ. Khi Boris Cherny nói "kích hoạt nhầm", ông không công nhận việc hoán đổi model là hợp lệ. Nhưng ông cũng không cấm nó. Đó là một vùng xám có chủ đích. Không ban hành quy tắc rõ ràng. Không đưa ra chính sách chính thức. Chỉ trả lời mơ hồ và để hệ thống phòng chống rủi ro tiếp tục hoạt động như một công cụ kiểm soát ngầm.
Chiến lược này quen thuộc đến mức tôi phải so sánh với một trường hợp khác. SEC trong nhiều năm dưới thời Gary Gensler không ban hành quy tắc rõ ràng cho thị trường tiền mã hóa. Nhưng họ liên tục ban hành lệnh trừng phạt và khởi kiện từng công ty. Mỗi vụ kiện là một luật mới được tạo ra trên thực tế, nhưng không được công bố trước. Tôi đã nói quan điểm này từ lâu: SEC không thiếu hiểu biết về công nghệ. Họ cố tình không ban hành quy tắc để giữ quyền lực tối đa bằng sự mơ hồ.
Anthropic đang làm điều tương tự. Họ cần duy trì hình ảnh "mở" để giữ chân developer. Nhưng song song đó, họ muốn kiểm soát ai được phép dùng model nào trong Claude Code. Thay vì công bố một bộ luật, họ để hệ thống phòng chống rủi ro làm việc đó. Mỗi tài khoản bị khóa là một thông điệp gửi đến cộng đồng. Không cần tranh cãi công khai. Không cần giải thích.
Còn một lớp nữa ít người để ý. OpenAI tưởng rằng mình đang dùng Claude Code làm kênh phân phối miễn phí. Nhưng Anthropic cũng đang tận dụng vụ này để chạy thí nghiệm miễn phí trên chính người dùng của đối thủ. Họ biết ai đã đổi model. Họ thấy được hành vi thay đổi ra sao. Họ có thể dùng dữ liệu đó để cải thiện cơ chế phòng chống rủi ro của chính mình, thậm chí thiết kế chiến lược sản phẩm tiếp theo. Trong trò chơi dữ liệu, cả hai bên đều đang thu thập. Câu hỏi là ai thu thập được nhiều hơn - chứ không phải ai công khai thắng thế.
Và nếu nhìn xa hơn nữa, người chiến thắng thực sự của câu chuyện này có thể không nằm trong hai công ty kia. Tầng hạ tầng trung gian - MCP, model gateway, nền tảng giám sát xuyên mô hình - sẽ hưởng lợi từ cả hai xu hướng. Giống như trong DeFi, cuộc chiến giữa các giao thức thanh khoản mở đường cho các aggregator bước vào và chiếm lấy vị trí trung tâm.
Sự kiện hoán não này không chỉ là câu chuyện của OpenAI và Anthropic. Nó là tín hiệu cho toàn bộ ngành AI rằng kỷ nguyên tích hợp dọc đang bị thách thức. Nhà phát triển không muốn bị trói buộc. Họ muốn lựa chọn. Họ muốn thay thế. Họ muốn so sánh giữa các model với nhau trên cùng một công cụ.
Đối với những người đang xây dựng trong lĩnh vực blockchain, tín hiệu này còn có ý nghĩa sâu hơn. Khi model trở thành một loại hàng hóa có thể trao đổi, khi quyền truy cập API được token hóa, khi dữ liệu huấn luyện trở thành tài sản có thể sở hữu và chuyển nhượng - blockchain chính là tầng thanh toán tự nhiên cho một hệ sinh thái như vậy. Mô hình "vỏ - não tách rời" có thể là bước đầu tiên hướng tới một thị trường mở cho năng lực AI.
Trong 12 tháng tới, tôi sẽ theo dõi ba tín hiệu cụ thể.
Một: Anthropic có chính thức phát hành SDK cho phép gắn model bên thứ ba vào Claude Code hay không. Nếu có, cuộc chơi mở thực sự bắt đầu. Nếu không, vùng xám được duy trì - và hệ thống phong tỏa ngầm sẽ tiếp tục là công cụ kiểm soát.
Hai: các model gateway đầu tiên sẽ xuất hiện, được cấp vốn ra sao, và liệu chúng có chiếm được niềm tin của developer. Đây sẽ là tầng hạ tầng mới, tương tự như 1inch hay Paraswap trong thời kỳ đầu DeFi.
Ba: liệu các dự án crypto tập trung vào AI - từ thị trường dữ liệu huấn luyện phi tập trung đến mạng lưới tính toán phân tán - có bước vào câu chuyện "model swap" này hay không. Vì nếu model có thể thay thế được, thì thị trường của chúng cũng cần được xây dựng.
Sự thật luôn nằm ở số liệu. Và số liệu của tuần này đang nói rằng AI đang bước vào con đường tách lớp mà blockchain đã vạch ra từ nhiều năm trước. Tách lớp. Mở giao thức. Trao quyền lựa chọn cho người dùng cuối.
Chạy nhanh không quan trọng bằng chạy đúng hướng. Và tôi tin rằng hướng đi đúng đang dần hiện rõ.