Startup hạ tầng AI Infinity huy động 15 triệu USD để thách thức vị thế của Nvidia
Infinity, startup chuyên về hạ tầng AI, vừa gọi vốn thành công 15 triệu USD với định giá 100 triệu USD. Công ty đang phát triển giải pháp thay thế CUDA nhằm tối ưu hóa hiệu năng cho các dòng chip AI...
Infinity, một công ty trong lĩnh vực hạ tầng AI, vừa công bố khoản huy động vốn 15 triệu USD với mức định giá 100 triệu USD. Vòng gọi vốn này có sự tham gia của các nhà đầu tư như Touring Capital, Principal VC cùng nhiều chuyên gia nghiên cứu từ OpenAI và Anthropic.
Mục tiêu cốt lõi của Infinity là xây dựng phần mềm giúp các chip AI vận hành mô hình hiệu quả hơn. Hiện tại, Nvidia đang thống trị thị trường không chỉ nhờ phần cứng mạnh mẽ mà còn nhờ hệ sinh thái phần mềm CUDA. CUDA cho phép các GPU chuyển đổi linh hoạt thành bộ xử lý đa năng, hỗ trợ các framework phổ biến như PyTorch và TensorFlow, giúp lập trình viên dễ dàng triển khai ứng dụng trên chip Nvidia mà không cần can thiệp sâu vào phần cứng.
Tuy nhiên, việc viết các kernel (phần mềm cấp thấp điều khiển chip) là một thách thức lớn đối với hầu hết các startup. Infinity đang phát triển một thư viện inference phổ quát, có khả năng tương thích với nhiều loại chip khác nhau như SRAM, GPU, chip điện thoại và Systolic Arrays. Đây được xem là nỗ lực nhằm phá vỡ thế độc quyền của Nvidia trên thị trường.
Được sáng lập bởi Jeremy Nixon – cựu nghiên cứu viên tại Google Brain và là người sáng lập cộng đồng AGI House, Infinity vận hành dựa trên triết lý “tự động hóa phát minh”. Sản phẩm chủ đạo của họ là Ignition, một AI research agent có khả năng tự viết, kiểm thử, debug và tối ưu hóa mã nguồn cấp thấp cho các chip không phải của Nvidia.
Theo Nixon, Ignition có khả năng tự học và thích nghi với các kiến trúc chip khác nhau, tạo ra một stack phần mềm tương đương với CUDA. Thay vì thu phí bản quyền trả trước, Infinity áp dụng mô hình kinh doanh dựa trên hiệu suất, hưởng lợi từ việc cải thiện tốc độ xử lý (tokens per second) và tiết kiệm chi phí cho khách hàng.
Hiện tại, Infinity đã có 26 nhân sự và đang hợp tác với các đối tác như D-Matrix, đồng thời mở rộng đàm phán với nhiều công ty sản xuất chip và nhà cung cấp cloud lớn khác. Hệ thống của họ đã giúp rút ngắn quy trình tối ưu hóa phần cứng từ hàng tháng, hàng năm xuống chỉ còn vài giờ hoặc vài ngày.
Nguồn tham khảo: TechCrunch



No Comment! Be the first one.