Подразделение по разработке чипов Alibaba, T-Head, представило свой новейший ускоритель для обучения и инференса искусственного интеллекта — Zhenwu V900. Презентация состоялась на конференции Apsara в Ханчжоу 22 сентября, согласно пресс-релизу Alibaba Cloud на английском языке. Официальное брендирование продукта включает Alibaba / T-Head / Zhenwu.
В данном обзоре акцент сделан на самом чипе — его памяти, межсоединении и сроках производства, а не на более широкой компоновке суперузла V900 с использованием ICN Switch, смарт-NIC и контроллеров SSD, которые освещались отдельно.
Согласно материалам компании, Zhenwu V900 демонстрирует производительность примерно в три раза выше, чем Zhenwu M890, который был выпущен в мае. При этом новый ускоритель оснащен 216 ГБ памяти и обеспечивает пропускную способность между чипами на уровне 1200 ГБ/с. Чип изначально поддерживает несколько точностей данных, включая FP8 и FP4, что позволяет использовать его как для высокоточного обучения, так и для инференса с низкой точностью.
T-Head объясняет, что увеличенный объем памяти на кристалле помогает снизить накладные расходы на шардирование моделей и перемещение данных при работе с плотными нагрузками, а более широкий путь соединения между чипами необходим, когда множество ускорителей должны функционировать как единая машина.
Планируется, что массовое производство и коммерческий выпуск Zhenwu V900 состоятся в первом квартале 2027 года. Отчет TechNode в рамках доклада Apsara добавляет, что V900 основан на запатентованной архитектуре параллельных вычислений T-Head и предназначен для работы с межсоединением ICN Switch. Это позволяет более чем 1000 картам совместно использовать семантику нативной памяти и унифицированное адресование.
Alibaba также сообщила, что линейка Zhenwu обслужила более 650 клиентов в таких сферах, как автомобильная промышленность, финансы, большие языковые модели, воплощенный интеллект, энергетика и производство. Эти данные о внедрении являются утверждениями самой компании.
Для покупателей, следящих за отечественными кремниевыми решениями для ИИ, ключевая информация заключается в следующем: это ускоритель Zhenwu следующего поколения с производительностью около трехкратной M890, 216 ГБ памяти, межсоединением 1200 ГБ/с и окном производства в первом квартале 2027 года. При презентации не были представлены независимые сторонние бенчмарки; фактическая производительность кластера будет зависеть от готовности поставляемого кремния и программного стека.

