Hook:
Ngày 28 tháng 7 năm 2025, tin tức vụ nổ: Nvidia đầu tư chiến lược vào SSI – công ty siêu trí tuệ an toàn do Ilya Sutskever sáng lập. Kèm theo đó là cam kết "hỗ trợ GPU quy mô lớn". Đọc lướt qua, ai cũng thấy: Ilya đã có sân chơi riêng, Nvidia khóa được khách hàng tỷ đô. Nhưng với tư cách một người đã audit hàng trăm hợp đồng thông minh, tôi thấy một lỗ hổng cấu trúc. Một dòng code ẩn trong bản ghi nhớ đầu tư: "SSI trước đây phụ thuộc vào Google TPU, nay chuyển sang Nvidia". Đó không phải là chiến thắng. Đó là sự tập trung hóa rủi ro. Và trong thế giới mà tôi sống – DeFi auditing – bất kỳ sự phụ thuộc đơn lẻ nào vào một điểm kiểm soát duy nhất đều là lỗ hổng chưa được vá.

Context:

SSI (Safe Superintelligence) được Ilya Sutskever thành lập sau khi rời OpenAI. Mục tiêu: xây dựng siêu trí tuệ với an toàn được tích hợp từ nền tảng. Họ huy động 20 tỷ USD, định giá 30 tỷ – không có sản phẩm, không doanh thu. Đối tác đầu tư gồm a16z, Sequoia, và giờ là Nvidia. Bản thân Ilya từng là đồng sáng lập và chief scientist của OpenAI, người đặt nền móng cho Scaling Law. Nhưng giờ ông đặt câu hỏi: liệu chỉ mở rộng dữ liệu và tính toán có đưa đến AGI an toàn không? Câu trả lời của ông là không – và SSI ra đời. Về mặt kỹ thuật, SSI đã xây dựng trên Google TPU. Nvidia đầu tư và kéo họ sang CUDA ecosystem. Điều đó có nghĩa: toàn bộ tương lai của mô hình siêu trí tuệ này phụ thuộc vào một kiến trúc phần cứng duy nhất, một bộ compiler duy nhất, một nhà cung cấp duy nhất. Trong DeFi, đó là smart contract chạy trên một chuỗi, không có fallback. Lỗi chain đó, toàn bộ dApp sập.
Core:
Hãy nhìn vào chi tiết kỹ thuật. SSI tuyên bố "an toàn là ưu tiên hàng đầu". Nhưng an toàn trong AI không thể tách rời khỏi tính khả kiểm (auditability). Một mô hình chạy trên GPU của Nvidia: liệu có thể kiểm tra xem Nvidia có nhúng một backdoor vào firmware không? Liệu CUDA compiler có thêm optimization không mong muốn? Trong thế giới blockchain, chúng tôi audit từng dòng Solidity, từng bytecode, từng external call. An toàn đòi hỏi toàn bộ stack phải được mở và kiểm chứng. Ở SSI, stack bắt đầu bằng chip – nơi không ai có thể kiểm tra ngoại trừ Nvidia. Đây là một điểm mù cổ điển: trust dependency không được kiểm soát.
Tôi nhớ năm 2020, khi audit một AMM trên Uniswap v2, tôi phát hiện lỗi làm tròn phí. Lỗi 0.1% mỗi giao dịch, nhưng với khối lượng lớn, nó tạo ra chênh lệch có thể khai thác. Lỗi đó nằm trong một dòng chia. Nếu dòng chia đó được viết bởi một bên thứ ba mà tôi không kiểm tra, tôi không thể đảm bảo an toàn. SSI hiện đang giao toàn bộ tầng tính toán cho Nvidia. Nvidia có thể có lỗi hardware, firmware, driver. Không ai audit được chúng. an toàn trong bối cảnh này là một lời hứa dựa trên lòng tin, không phải kiểm chứng.
Hơn nữa, SSI kỳ vọng "tăng quy mô tính toán lên một bậc độ lớn". Điều đó có nghĩa họ sẽ sở hữu cluster 100.000 GPU hoặc hơn. Lịch sử cho thấy cluster càng lớn, tỷ lệ lỗi phần cứng càng cao. Các lỗi bit flip, nhiễu điện từ, lỗi bộ nhớ có thể gây ra kết quả sai lệch ngẫu nhiên. Trong hệ thống AI, một lỗi như vậy có thể dẫn đến model learning sai – hoặc tệ hơn, hành vi không an toàn. an toàn của một hệ thống phải bao gồm khả năng chịu lỗi và phát hiện lỗi. SSI có cơ chế đó không? Họ có chạy Byzantine fault tolerance trên cluster không? Hay họ chỉ tin vào Nvidia's ECC memory? Trong blockchain, nếu một node cho kết quả sai, chúng tôi có bằng chứng gian lận. Ở đây, không có bằng chứng nào cả.
Contrarian:
Nhiều người cho rằng việc SSI chọn Nvidia là thông minh: nhận được vốn và tài nguyên tính toán mạnh nhất. Nhưng góc phản trực giác: chính sự phụ thuộc này làm suy yếu tuyên bố "an toàn" của họ. Bởi vì an toàn thực sự yêu cầu đa dạng hóa và phi tập trung hóa rủi ro. Nếu tôi audit một protocol mà biết nó sẽ chạy hoàn toàn trên một cloud provider duy nhất, tôi sẽ đánh dấu đỏ ngay. Ở đây, SSI không chỉ phụ thuộc vào Nvidia hardware, mà còn phụ thuộc vào CUDA ecosystem – một bộ toolchain độc quyền. Nếu Nvidia quyết định thay đổi API, hủy bỏ một tính năng, hoặc thậm chí chèn một giới hạn về safety-critical operations, SSI không có phương án thay thế. Họ đã từ bỏ Google TPU, mất đi sự đa dạng hóa.
Có một song song với DAO governance: "Code is law" chỉ hoạt động khi không có admin key. SSI tự trao admin key cho Nvidia. Nvidia có thể nâng cấp firmware, thay đổi hành vi GPU, ảnh hưởng đến model. Không có multi-sig, không có time lock. Đây là vấn đề tôi thấy trong các dự án DeFi non trẻ: họ bỏ quyền kiểm soát vào tay một bên và tin rằng bên đó sẽ không lạm dụng. Nhưng lịch sử cho thấy: khi tiền và quyền lực đủ lớn, incentive sẽ làm lệch hướng.
Takeaway:
Nvidia đầu tư vào SSI không chỉ là một thương vụ tài chính. Đó là việc kiến trúc sư của AGI tương lai đang tự nhốt mình vào một lồng vàng. An toàn thực sự không đến từ một nhà cung cấp duy nhất, dù mạnh đến đâu. Nó đến từ khả năng kiểm tra, thay thế, và phân tán. Tôi đặt câu hỏi: liệu đến năm 2028, khi cluster 100.000 GPU này có lỗi phần cứng không thể vá, liệu SSI có còn là "an toàn" không? Hay chúng ta sẽ thấy một kịch bản tương tự như sự cố của The DAO – nơi một lỗi trong smart contract được cho là an toàn đã dẫn đến hard fork? Câu trả lời nằm ở việc chúng ta có dám audit cả stack hay không.