aiexpert
Início / Notícias / Nota
Funding · 06 de ago. de 2026, 22:06 · 2 fontes

Infinity levanta $15M para automatizar dev de kernel para chips AI; agente Ignition gera stacks de software nível Cuda em dias

A startup de infraestrutura AI em estágio inicial Infinity Inc. levantou $15 milhões em financiamento de seed (avaliação pós-moeda de $100M) para desenvolver geração automatizada de stack de software para chips de inferência AI. Fundada por Jeremy Nixon, um pesquisador ex-Google Brain e co-fundador da AGI House, a tecnologia central de Infinity é Ignition, um agente AI que gera, testa e otimiza kernels de computação de baixo nível para inferência sem engenheiros humanos escrevendo-os do zero. A rodada foi liderada por Touring Capital, com participação de Principal Venture Partners e executivos não nomeados da OpenAI, Anthropic e chipmakers.

Alvo de Infinity: romper o monopólio CUDA da Nvidia gerando infraestrutura de software nível Cuda para chips concorrentes em horas em vez de meses. A startup já está gerando milhões em receita recorrente anual através de parcerias com d-Matrix e outros chipmakers. Em um projeto d-Matrix, Ignition alcançou 92% do desempenho de pico teórico do acelerador Corsair em 10 horas, distribuindo Qwen3, Qwen3.5 e Gemma4 totalmente no chip em 10 dias. Em teste separado em Nvidia H100, Infinity relatou melhoria de 34% no throughput de inferência para Qwen3-8B versus vLLM após um dia de otimização automatizada (ainda não validado independentemente).

O modelo de receita de Infinity vincula compensação a ganhos de desempenho: tipicamente captura ~20% da economia de computa que clientes realizam do throughput melhorado, não de taxas de licenciamento. Para arquitetos avaliando provedores de chip AI alternativos (AMD, Cerebras, Intel, Modular/Qualcomm): a automação de Infinity de-risca a ramp-up de ecossistema de software, historicamente a maior barreira à adoção fora da Nvidia. A arquitetura auto-melhora da startup aprende de sucessos e falhas para acelerar execuções de otimização subsequentes. Ignition manipula criação de kernel, debuggers, profilers, compiladores, orquestração através de hardware de inferência—permitindo novo silício alcançar desempenho usável sem lock-in de fornecedor para stacks de software proprietários.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source siliconangle.com
  2. 02 SiliconAngle: Infinity raises $15M to run AI inference on any chipset siliconangle.com