Hôm qua, tôi mở Twitter. Cùng lúc, cả Anthropic lẫn OpenAI đều tung ra một tính năng... cùng tên: 'Record a skill'. Ừ, không phải tôi nói đùa. Đây là lần đầu tiên tôi thấy hai gã khổng lồ AI copy paste ý tưởng của nhau một cách trắng trợn đến vậy. Và tự nhiên, tôi cảm thấy một cơn ngứa nghề – cái cảm giác của một thợ săn bản lề kỹ thuật đang đánh hơi thấy mùi 'hype' nhưng thiếu chất.
Trong bối cảnh thị trường crypto đang chìm trong bear, mọi thứ từ DeFi đến NFT đều im ắng, thì AI Agent bỗng nổi lên như một câu chuyện mới. Và đây, cái 'Record a skill' này chính là mồi câu. Hãy cùng tôi mổ xẻ nó dưới góc nhìn của một kẻ từng đào mã nguồn Gnosis, từng ngửi thấy mùi rủi ro trong từng dòng hợp đồng thông minh.
Context: 'Record a skill' là cái quái gì?
Cả Claude Cowork lẫn OpenAI Codex đều cho phép user quay màn hình, ghi lại các thao tác chuột, bàn phím và giọng nói, sau đó biến đoạn trình diễn đó thành một 'Skill' có thể tái sử dụng. Nghe có vẻ thần kỳ: bạn chỉ việc làm mẫu một lần, AI sẽ tự động học và lặp lại sau này. Nhưng với tôi, đó là cách nói hoa mỹ cho một thứ mà tôi gọi là 'kỹ thuật ghép nối': lấy màn hình ghi, nhận diện giọng nói, LLM, và code generation – ráp lại thành một pipeline. Chẳng có gì mới.
Core: Kỹ thuật đằng sau – Behavioral Cloning trong vỏ bọc đa phương thức
Hãy nhìn vào cơ chế: Claude 'ghi lại màn hình, click, bàn phím, giọng nói' và 'chuyển đổi trình diễn thành Skill'. Đây chính xác là Behavioral Cloning – một nhánh của học bắt chước. Thay vì dạy AI hiểu luồng logic của một tác vụ (ví dụ: kéo dữ liệu từ API), nó chỉ đơn giản ghi lại hành vi của con người trên GUI, rồi dùng LLM để parse và sinh ra một script có thể thực thi. Điểm mạnh duy nhất là giảm rào cản cho người không biết code. Nhưng điểm yếu chí mạng: khi giao diện thay đổi (một nút bị dời chỗ, một label đổi tên), Skill sẽ fail.

Tôi đã từng audit một smart contract dùng oracle feed bị trễ – mất hàng triệu đô. Cũng giống như vậy, cái 'Skill' này cực kỳ mong manh trước sự thay đổi môi trường. Bạn có dám giao phó toàn bộ quy trình vận hành doanh nghiệp cho một thứ mà chỉ cần Windows update là hỏng? Đừng cười. Tôi cá là trong vòng 6 tháng tới, sẽ có vô số bài post trên Reddit kiểu 'Claude Skill của tôi tự dưng không chạy được sau khi update Chrome'.
Contrarian: Góc nhìn phản trực giác – Thứ tưởng là 'đột phá' thực ra là 'vũ khí hủy diệt hàng loạt' cho quyền riêng tư
Mọi người đều bàn về sự tiện lợi. Nhưng với tôi, một Tiến sĩ Mật mã học, điều đầu tiên tôi thấy là một lỗ hổng bảo mật khổng lồ. 'Ghi lại màn hình, click, bàn phím, giọng nói' có nghĩa là AI sẽ thấy mọi thứ bạn làm: mật khẩu (nếu app không chặn), email nội bộ, secret key của ví crypto, thậm chí cả cuộc họp riêng tư. Dữ liệu này được gửi lên cloud của Anthropic hoặc OpenAI. Bạn có chắc họ không dùng nó để train model không? Tôi thì không. Và đừng quên, Skill sau khi tạo ra có thể chứa sẵn các thông tin nhạy cảm (đường dẫn file, tên tài khoản). Nếu Skill đó được chia sẻ (như một marketplace sau này), bạn đã vô tình leak toàn bộ quy trình làm việc của mình.
Đây không chỉ là vấn đề cá nhân. Với doanh nghiệp, việc đưa SOP (Standard Operating Procedure) lên cloud của Anthropic cũng giống như giao chìa khóa kho báu cho người lạ. Tôi đã từng chứng kiến cả một quỹ đầu tư sụp đổ vì một lỗ hổng oracle trong DeFi. Lần này, nếu một Skill leak ra ngoài, hậu quả có thể còn nặng nề hơn.

Takeaway: Cuộc chiến thực sự không phải là 'ai có AI mạnh hơn', mà là 'ai có ecosystem an toàn hơn'
Cả Claude và OpenAI đều đang chơi trò cạnh tranh đồng nhất (homogeneous competition). Họ đâm đầu vào cùng một hướng, với cùng một tính năng. Điều này có lợi cho người dùng trong ngắn hạn (giá rẻ hơn, nhiều lựa chọn hơn), nhưng về dài hạn, kẻ chiến thắng sẽ là kẻ giải quyết được bài toán bảo mật và độ tin cậy. Tôi không tin vào những bản PR hoa mỹ. Tôi tin vào mã nguồn, vào dữ liệu on-chain, và vào những bài test thực tế. Nếu bạn là một builder trong crypto, hãy nhìn vào đây: cơ hội đang nằm ở việc xây dựng các giải pháp 'Skill phi tập trung', nơi dữ liệu không bao giờ phải rời khỏi máy người dùng, và các Skill được xác thực bằng bằng chứng mật mã. Đó mới là câu chuyện đáng để săn.