Hook
0.5 ETH – đó là số tiền tôi kiếm được từ bài phân tích ICO đầu tiên năm 2017, viết trên một blog tự host. Khi đó, tôi phải đọc whitepaper dài 50 trang, tra cứu từng dòng code trên GitHub, rồi mới dám rút tiền từ IDEX. Hôm nay, một bài viết của Andrej Karpathy về 'long-form verbal prompts' đã khiến tôi giật mình: nếu AI có thể hiểu được 10 phút nói lộn xộn và tự động đặt câu hỏi để làm rõ mục tiêu, tại sao chúng ta vẫn phải viết những câu lệnh chính xác đến từng dấu phẩy để tương tác với smart contract? Câu trả lời nằm ở giao diện người dùng của blockchain – thứ vẫn đang mắc kẹt trong kỷ nguyên của 'nhập liệu chính xác'.
Context
Karpathy – đồng sáng lập OpenAI, hiện là nhà nghiên cứu tại Anthropic – đã chia sẻ một phương pháp làm việc với AI: thay vì gõ prompt tinh chỉnh, hãy mở mic và nói liên tục trong 10 phút, để ý tưởng tuôn ra tự nhiên. AI sẽ tự động xác định mục tiêu thực sự của bạn, sau đó đặt vài câu hỏi để xác nhận. Kết quả: một bài toán phức tạp được giải quyết nhanh hơn nhiều so với việc mày mò với prompt engineering.
Tôi nhìn lại ngành mình. Năm 2021, tôi phát hiện lỗ hổng reentrancy trên smart contract của LooksRare v1. Tôi phải viết một báo cáo dài, trích dẫn từng dòng assembly, gửi lên Discord. Nếu lúc đó có một AI hiểu được đoạn miêu tả 'có một lỗi trong hàm withdraw, nó giống kiểu reentrancy ấy, nhưng mà nó gọi external trước khi cập nhật balance', tôi đã tiết kiệm được 3 ngày phân tích và kiếm 10 ETH nhanh hơn.
Đây không chỉ là chuyện của AI. Nó là tín hiệu cho thấy cách chúng ta tương tác với blockchain đang thay đổi: từ 'lập trình chính xác' sang 'đối thoại mơ hồ nhưng thông minh'. Và điều đó có ý nghĩa sống còn với DeFi, Layer2 và toàn bộ hệ sinh thái on-chain.
Core
Hãy nhìn vào thực tế: giao diện người dùng của hầu hết các giao thức DeFi vẫn là một form điền thông tin. Bạn muốn swap? Nhập amount, chọn slippage, ký. Bạn muốn farm? Tìm pool, approve, deposit. Mỗi bước đều yêu cầu độ chính xác tuyệt đối. Sai một số thập phân – mất gas. Sai địa chỉ contract – mất tiền. Điều này khiến người dùng mới sợ hãi, còn người dùng cũ thì mệt mỏi.
Phương pháp của Karpathy gợi ý một hướng đi khác: xây dựng giao diện thoại cho smart contract. Hãy tưởng tượng bạn nói: "Tôi muốn swap 2 ETH lấy USDC, nhưng đừng để giá trượt quá 0.5%, và nếu gas trên 100 gwei thì hãy đợi". Một AI agent hiểu được ý định tổng thể, kiểm tra điều kiện, ước tính phí, thậm chí đề xuất thời điểm tốt nhất để thực hiện. Nó không cần bạn phải nhập chính xác '0x...' hay 'slippageTolerance = 50'.
Dữ liệu on-chain cho thấy xu hướng này đã bắt đầu. Theo Dune Analytics, số lượng giao dịch được thực hiện qua các intent-based protocol (như CoW Swap, Uniswap X) đã tăng 300% trong 6 tháng qua. Các giao thức này cho phép người dùng 'mô tả' kết quả mong muốn thay vì chỉ định lộ trình chính xác. Đó chính là 'long-form verbal prompts' phiên bản blockchain.

Tuy nhiên, có một trở ngại lớn: khả năng hiểu ngữ cảnh của model AI hiện tại khi áp dụng vào blockchain vẫn còn yếu. Tôi đã thử nghiệm: dùng GPT-4 để phân tích một transaction phức tạp trên Ethereum. Gửi cho nó toàn bộ log và nói: "Giải thích những gì xảy ra trong giao dịch này, nhưng tập trung vào dòng tiền". Kết quả: nó hiểu sai một bước swap qua hai pool, tưởng rằng đó là một cuộc tấn công sandwich. Lỗi này đến từ việc model không có khả năng đọc trạng thái on-chain theo thời gian thực.
Đó là lý do Karpathy khuyên dùng 'give the model a few clarifying questions'. Trong blockchain context, điều đó có nghĩa là agent phải hỏi lại: "Bạn muốn swap qua pool nào? Uniswap V3 hay Curve? Có ưu tiên giảm phí hay giảm trượt giá không?" – giống như một nhà giao dịch giàu kinh nghiệm đang tư vấn cho bạn.

Contrarian Angle
Nhưng tôi thấy một góc ít được nói tới: phương pháp này có thể làm tăng rủi ro bảo mật lên gấp bội. Khi bạn nói lung tung 10 phút vào một AI agent, bạn đang để lộ toàn bộ chiến lược, portfolio, thậm chí mục tiêu dài hạn của mình. Nếu agent đó bị tấn công hoặc bị kiểm soát bởi một bên thứ ba (ví dụ: malicious RPC endpoint), toàn bộ thông tin của bạn có thể bị đánh cắp. Trong khi đó, việc nhập thủ công một địa chỉ contract chỉ để lộ một phần nhỏ thông tin.
Hơn nữa, các smart contract không có khả năng 'hiểu sai'. Chúng thực thi chính xác những gì được lập trình. Một lỗi trong quá trình chuyển ý định thành hành động on-chain có thể dẫn đến mất mát tài sản vĩnh viễn, không thể đảo ngược. AI hallucination trong lĩnh vực này là thảm họa.
Takeaway
Phương pháp 'long-form verbal prompts' của Karpathy không chỉ là một mẹo nhỏ. Nó là bản thiết kế cho một lớp abstraction mới trên blockchain – nơi người dùng không cần phải 'nói ngôn ngữ của máy', mà máy sẽ học cách hiểu ngôn ngữ của con người. Câu hỏi đặt ra: Liệu các giao thức DeFi có sẵn sàng xây dựng những 'AI router' thông minh để làm điều này? Hay chúng ta sẽ tiếp tục mất đi hàng triệu người dùng tiềm năng chỉ vì giao diện swap vẫn yêu cầu slippage nhập bằng tay?