T-Head представила ускоритель искусственного интеллекта Zhenwu V900 с производительностью в три раза выше M890
Подробнее
Pandaily
pandaily.com

T-Head представила ускоритель искусственного интеллекта Zhenwu V900 с производительностью в три раза выше M890

Подразделение по разработке чипов Alibaba, T-Head, представило свой новейший ускоритель для обучения и инференса искусственного интеллекта — Zhenwu V900. Презентация состоялась на конференции Apsara в Ханчжоу 22 сентября, согласно пресс-релизу Alibaba Cloud на английском языке. Официальное брендирование продукта включает Alibaba / T-Head / Zhenwu.

В данном обзоре акцент сделан на самом чипе — его памяти, межсоединении и сроках производства, а не на более широкой компоновке суперузла V900 с использованием ICN Switch, смарт-NIC и контроллеров SSD, которые освещались отдельно.

Согласно материалам компании, Zhenwu V900 демонстрирует производительность примерно в три раза выше, чем Zhenwu M890, который был выпущен в мае. При этом новый ускоритель оснащен 216 ГБ памяти и обеспечивает пропускную способность между чипами на уровне 1200 ГБ/с. Чип изначально поддерживает несколько точностей данных, включая FP8 и FP4, что позволяет использовать его как для высокоточного обучения, так и для инференса с низкой точностью.

T-Head объясняет, что увеличенный объем памяти на кристалле помогает снизить накладные расходы на шардирование моделей и перемещение данных при работе с плотными нагрузками, а более широкий путь соединения между чипами необходим, когда множество ускорителей должны функционировать как единая машина.

Планируется, что массовое производство и коммерческий выпуск Zhenwu V900 состоятся в первом квартале 2027 года. Отчет TechNode в рамках доклада Apsara добавляет, что V900 основан на запатентованной архитектуре параллельных вычислений T-Head и предназначен для работы с межсоединением ICN Switch. Это позволяет более чем 1000 картам совместно использовать семантику нативной памяти и унифицированное адресование.

Alibaba также сообщила, что линейка Zhenwu обслужила более 650 клиентов в таких сферах, как автомобильная промышленность, финансы, большие языковые модели, воплощенный интеллект, энергетика и производство. Эти данные о внедрении являются утверждениями самой компании.

Для покупателей, следящих за отечественными кремниевыми решениями для ИИ, ключевая информация заключается в следующем: это ускоритель Zhenwu следующего поколения с производительностью около трехкратной M890, 216 ГБ памяти, межсоединением 1200 ГБ/с и окном производства в первом квартале 2027 года. При презентации не были представлены независимые сторонние бенчмарки; фактическая производительность кластера будет зависеть от готовности поставляемого кремния и программного стека.

Похожие сюжеты

Alibaba Cloud представила стеки суперузлов Apsara, объединяющие ускорители Zhenwu V900 с компонентами T-Head
Подробнее
pandaily.com

Alibaba Cloud представила стеки суперузлов Apsara, объединяющие ускорители Zhenwu V900 с компонентами T-Head

На конференции Apsara Cloud и T-Head продемонстрировали обновленный стек суперузлов. Этот стек интегрирует ускоритель искусственного интеллекта Zhenwu V900 с чипами ICN Switch от T-Head, интеллектуальной сетевой картой Pangu NIC и контроллером SSD Zhenyue.

Основная цель презентации заключалась не в представлении отдельного ускорителя, а в демонстрации скоординированной работы вычислительных, сетевых и системных компонентов на уровне всего суперузла. Официально брендинг продукта определяется как Alibaba Cloud / T-Head.

Согласно отчету QuDong's Apsara, ускоритель Zhenwu V900 обладает 216 ГБ памяти и обеспечивает межчиповое соединение со скоростью 1200 ГБ/с. Его производительность примерно в три раза выше, чем у Zhenwu M890, и он поддерживает нативные форматы FP8/FP4. Планируется, что массовое производство Zhenwu V900 начнется в первом квартале 2027 года.

Благодаря подключению через ICN Switch, суперузлы получают унифицированное адресование и нативную семантику памяти, что позволяет приблизительно тысяче карт V900 функционировать как один крупный ускоритель. Используя переработанную интеллектуальную вычислительную сеть Alibaba Cloud, компания заявляет, что один кластер способен масштабироваться до около 500 000 карт.

Ранее суперузлы на базе M890 использовались в крупном масштабе и, по утверждению компании, обрабатывали модели класса Qwen3.8 и Kimi K3, имеющие более двух триллионов параметров, хотя это еще не было независимо проверено.

Данная разработка важна тем, что T-Head теперь позиционирует ускорители ИИ, процессоры Yitian, межсоединение ICN, сетевые карты Pangu NIC и контроллеры хранения Zhenyue как единый набор чипов для центров обработки данных внутри страны.

Хотя в будущем планируются последующие поколения Zhenwu и SKU суперузлов в окне 2029 года, информация от 22 сентября касается именно суперузла, основанного на V900, и потенциала кластера в 500 000 карт.

Для покупателей облачных сервисов и кластеров эта новость означает, что Alibaba упаковывает ускоритель, коммутатор, сетевую карту и кремниевые компоненты SSD в единую концепцию Apsara supernode с четким показателем масштаба.

Скорость поставок V900 (указанная как первый квартал 2027 года) и реальное поведение многостойкового фабричного соединения определят, является ли путь в 500 000 карт инженерным запасом или планом для ближайшего времени.

Популярное