Железо Aug 7, 2026В закладки

AMD приобретает стартап Taalas для повышения производительности инференса, встраивая модели ИИ непосредственно в свои чипы. Это принципиально иной подход по сравнению с универсальными GPU.
AMD объявила 6 августа 2026 года о покупке Taalas, стартапа, специализирующегося на инференсе ИИ, согласно The Register. Особенность Taalas заключается в том, что вместо универсальных GPU, способных запускать любые модели, стартап разрабатывает подход, при котором модели ИИ буквально «впечатываются» в кремний — их архитектура интегрирована в саму конструкцию чипа.
Технический термин — model-in-silicon или fixed-function AI accelerator. Идея заключается в том, что вместо программируемого процессора, загружающего модель во время выполнения, чип проектируется вокруг конкретной модели, что обеспечивает значительные преимущества в производительности и энергоэффективности для целевых сценариев использования.
AMD в настоящее время испытывает трудности в конкурентной борьбе с Nvidia на рынке ИИ-ускорителей. Покупка Taalas является частью более широкой стратегии диверсификации в область специализированного инференса, рынок которого стремительно растёт с повсеместным внедрением LLM в производственных средах.
Инференс (запуск модели для получения результатов) отличается от обучения (тренировки модели). Он требует меньшей гибкости, но большего объёма и эффективности. Именно здесь model-in-silicon проявляет себя наилучшим образом: если вы знаете, что будете запускать одну и ту же модель миллионы раз в день, её оптимизация на аппаратном уровне может drastically сократить задержки и энергопотребление.
Первые технические демонстрации Taalas показывают до 17 000 токенов в секунду на своих специализированных интегрированных схемах — цифра, наглядно иллюстрирующая обещания model-in-silicon.
Сравнение подходов:
| Подход | Гибкость | Эффективность инференса | Стоимость производства |
|---|---|---|---|
| Универсальный GPU (Nvidia H100, AMD MI300) | ★★★★★ | ★★★ | Высокая |
| Специализированный ASIC (Google TPU, AWS Trainium) | ★★ | ★★★★★ | Очень высокая |
| Model-in-silicon (Taalas) | ★★★ | ★★★★★ | В разработке |
Это производительность, продемонстрированная в первых технических демонстрациях Taalas на своих специализированных чипах — в сравнении с несколькими сотнями или тысячами токенов в секунду на универсальных GPU в стандартной конфигурации.
Подход Taalas занимает промежуточную позицию между чистым ASIC (очень жёстким) и универсальным GPU, нацеливаясь на семейства моделей, а не на одну фиксированную модель.
Очевидный риск такого подхода: если модель эволюционирует (новые версии LLM, изменение архитектуры), кремниевую схему придётся перепроектировать. AMD делает ставку на то, что некоторые рабочие нагрузки инференса стабилизируются настолько, что оправдают создание специализированных чипов.
Покупка Taalas даёт AMD технологический блок, который выделяет её в гонке за инференс в сфере ИИ. Это не прямая альтернатива Nvidia H100 — это начало стратегии для выхода на смежный, потенциально более прибыльный рынок: массовый инференс в центрах обработки данных.
Следует наблюдать: первые чипы AMD с технологией Taalas. Если 17 000 токенов/с, показанные в демонстрациях, подтвердятся в производстве, это может стать настоящим прорывом в сегменте специализированных ИИ-ускорителей.
Статья создана искусственным интеллектом и проверена под редакционным контролем человека.