Компания по ИИ-инфраструктуре Infinity привлекла $15 млн при оценке $100 млн. О раунде компания объявила в понедельник. В числе инвесторов — Touring Capital, Principal VC, а также исследователи из OpenAI и Anthropic.
Стартап разрабатывает софт, который упрощает запуск ИИ-моделей на разных чипах. В материале TechCrunch отмечается, что лидерство Nvidia связано не только с производительными ускорителями, но и с программной платформой CUDA, которая позволяет использовать GPU как универсальные вычислительные процессоры.
Крупнейшие фреймворки для разработки ИИ, PyTorch и TensorFlow, построены поверх CUDA. За счёт этого разработчики могут писать приложения, например, на Python и по умолчанию запускать их на чипах Nvidia без дополнительной низкоуровневой настройки.
Большинство стартапов прикладного уровня не могут самостоятельно писать ядра — низкоуровневый код для работы с чипами — и переносить свои приложения на другие ИИ-ускорители. Поэтому Infinity создаёт альтернативу CUDA: программный слой, который должен работать с разными типами чипов, включая SRAM, GPU, мобильные чипы и systolic arrays.
Компания пытается создать универсальную библиотеку инференса для всех чипов. По замыслу Infinity, это должно помочь автоматизировать воспроизведение результатов передовых исследований на разном оборудовании.
Infinity была запущена в прошлом году Джереми Никсоном, бывшим исследователем Google Brain и создателем сообщества AGI House. В разговоре с TechCrunch он сказал, что решил основать компанию из-за своей идеи «автоматизированного изобретения» и убеждения, что «системы ИИ могут быть мета-технологией».
По словам Никсона, ранее он создал алгоритм машинного обучения Omega, который генерировал новые алгоритмы и автоматически оценивал их в цикле обратной связи. Этот опыт подтолкнул его применить тот же подход к аппаратному уровню и использовать автоматические системы для генерации низкоуровневого кода, который помогает эффективнее запускать чипы.
Исследовательский ИИ-агент Infinity под названием Ignition должен писать низкоуровневый код для инференса на чипах, альтернативных Nvidia. Система тестирует код, отлаживает его, измеряет скорость работы оборудования и при необходимости переписывает код для повышения производительности.
Никсон утверждает, что система сама улучшает свою работу и подстраивается под разные архитектуры чипов, включая проприетарные разработки. Результатом, по заявлению Infinity, становится программный стек уровня CUDA.
Среди клиентов компании есть производитель ИИ-чипов D-Matrix. По словам Никсона, Infinity также ведёт переговоры с другими крупными производителями чипов и облачными компаниями.
При этом человек остаётся в процессе и задаёт общее направление, а агент берёт на себя рутинную работу. В одном из кейсов, как утверждает стартап, агент сократил процесс, который мог занять месяцы или годы, до часов или дней.
Infinity не берёт лицензионный платёж на старте. Вместо этого компания получает долю от прироста производительности и экономии затрат, измеряя изменения в токенах в секунду.
Сейчас в компании 26 сотрудников, включая команды дизайна, операционных процессов и разработки.
Источник: TechCrunch.






















