## Hook Một startup chỉ 26 người, gọi vốn 15 triệu USD, định giá 100 triệu USD, tuyên bố sẽ 'thay thế CUDA của NVIDIA' bằng AI. Đó là Infinity, và câu chuyện của họ đang làm nóng giới đầu tư AI lẫn blockchain. Liệu một phần mềm viết mã tự động có thể phá vỡ thế độc tôn của NVIDIA, và quan trọng hơn, nó sẽ ảnh hưởng thế nào đến hạ tầng blockchain – nơi mà chi phí tính toán và hiệu suất chip là yếu tố sống còn?
## Context Infinity ra đời từ ý tưởng của Jeremy Nixon, cựu nghiên cứu viên Google Brain. Họ xây dựng Ignition – một AI agent có khả năng tự động viết kernel code cho các tác vụ inference (suy luận) trên mọi loại chip: GPU, SRAM, chip di động, thậm chí systolic array. Khác với các compiler truyền thống (TVM, MLIR) vốn dùng luật cố định, Ignition dùng học sâu để sinh, kiểm thử và tối ưu code. Điểm đặc biệt: họ không bán bản quyền, mà tính phí dựa trên hiệu suất thực tế – một mô hình 'pay-for-performance' rất giống cơ chế của các giao thức DeFi (phí gas thay đổi theo hiệu suất).
## Core ### Công nghệ: AI viết code cho AI Ignition hoạt động như một hệ thống compiler tự động hóa hoàn toàn. Nó nhận vào một mô hình AI (ví dụ Transformer) và một đích chip cụ thể, sau đó sinh ra kernel code tối ưu cho chip đó. Quá trình này lặp lại: thử nghiệm, debug, đánh giá tốc độ, rồi viết lại cho đến khi đạt ngưỡng. Không cần kỹ sư CUDA – AI tự làm. Đây là bước tiến so với AutoTVM (dùng thuật toán tìm kiếm) và XLA (biên dịch tĩnh). Tuy nhiên, rủi ro kỹ thuật cực lớn: mã tự sinh có thể sai số, gây lỗi bộ nhớ hoặc hiệu suất thấp hơn CUDA thủ công. Hiện tại, chưa có benchmark công khai nào chứng minh Ignition vượt qua được cuDNN của NVIDIA.
### Thương mại: Bán hiệu năng, không bán phần mềm Khách hàng đầu tiên là D-Matrix, một startup chip AI inference. Với mô hình chia sẻ lợi nhuận, Infinity không thu phí trả trước. Nếu Ignition giúp D-Matrix chạy mô hình nhanh hơn 20%, họ lấy một phần giá trị đó. Cách này giúp giảm rào cản cho khách hàng nhỏ, nhưng tạo ra khó khăn trong việc đo lường đồng thuận – tương tự bài toán oracle trong blockchain. Làm sao để cả hai bên tin vào số liệu? Hợp đồng thông minh có thể là giải pháp. Nếu Infinity áp dụng smart contract để tự động phân phối doanh thu dựa trên kết quả benchmark on-chain, đó sẽ là cầu nối giữa AI và DeFi.
### Tác động đến blockchain Tại sao một startup viết kernel code lại liên quan đến blockchain? Bởi vì tương lai của blockchain phụ thuộc vào phần cứng rẻ và mạnh. Các ZK-rollup (zkSync, StarkNet) cần hàng trăm GPU để tạo proof. Các dự án AI oracle (Bittensor, Render Network) cần chip inference giá thấp. Nếu Infinity giúp chip AMD, Intel, hoặc chip Việt Nam (Vingroup?) đạt hiệu suất ngang NVIDIA, giá thành điện toán blockchain sẽ giảm mạnh. Ngược lại, nếu Infinity thất bại, NVIDIA tiếp tục độc quyền, chi phí vận hành node sẽ tăng, đe dọa tính phân quyền.
## Contrarian ### Góc nhìn phản trực giác: AI viết kernel không phải là cuộc cách mạng, mà là bước trung gian Nhiều người cho rằng Infinity sẽ thay thế CUDA. Nhưng sự thật: CUDA không chỉ là ngôn ngữ – nó là hệ sinh thái hàng nghìn thư viện tối ưu (cuDNN, TensorRT, NeMo). Một agent 26 người không thể nào bắt kịp. Nguy cơ lớn nhất không phải là NVIDIA đè bẹp, mà là bản thân Infinity không scale được: mỗi chip mới cần huấn luyện lại Ignition từ đầu, chi phí tính toán cho việc tối ưu có thể vượt quá lợi ích. Điều này giống như các dự án blockchain non-EVM: ý tưởng tốt, nhưng khó đạt network effect.
### Điểm mù của thị trường: Infinity là mảnh ghép cho 'Edge AI + Blockchain' Giới phân tích chỉ tập trung vào cuộc chiến với NVIDIA. Họ bỏ qua tiềm năng ở biên: chip di động, SRAM, IoT. Đây chính là nơi blockchain gặp AI thực tế – các thiết bị biên (điện thoại, cảm biến) chạy inference trực tiếp, rồi ghi kết quả lên blockchain. Infinity có thể tối ưu code cho những chip yếu, giúp AI on-device chạy nhanh hơn mà không cần cloud. Nếu thành công, nó sẽ kích hoạt hàng loạt ứng dụng DePIN (mạng lưới hạ tầng phi tập trung) như render, map, compute sharing.
## Takeaway Theo dõi Infinity không phải để đầu tư ngay, mà để đo lường tín hiệu: họ có công bố benchmark so với CUDA không? Có ký được hợp đồng với AMD/Intel không? Nếu có, đó là tín hiệu cho thấy chi phí tính toán blockchain sắp giảm. Nếu không, câu chuyện 'thay thế CUDA' chỉ là PR. Một câu hỏi để lại: Liệu một AI agent 26 người có thể làm được điều mà cả Google (XLA) và Meta (TVM) chưa làm trọn vẹn? Hay nó sẽ trở thành một 'Optimism' của thế giới AI – thành công về mặt kỹ thuật nhưng lại phụ thuộc vào phần cứng trung tâm? Câu trả lời sẽ định hình tương lai của blockchain phi tập trung.