Kling AI представила модель Kling 4.0 с возможностью генерации 30-секундных клипов и многократного контроля
Подробнее
Pandaily
pandaily.com

Kling AI представила модель Kling 4.0 с возможностью генерации 30-секундных клипов и многократного контроля

Компания Kuaishou представила свою новую видеомодель Kling 4.0 28 сентября, а в тот же день открыла ограниченный доступ к более легковесной версии Kling 4.0 Flash. Доступ к Flash сначала предоставляется подписчикам Ultra Yearly, тогда как полноценная модель планируется к выпуску в октябре, хотя точная дата еще не названа.

Основное улучшение заключается в продолжительности видео: Kling 4.0 способна генерировать до 30 секунд видео за один проход, что вдвое превышает прежний лимит в 15 секунд у Kling 3.0. Эта функция поддерживает длинные планы и непрерывное повествование в рамках одного клипа. Кроме того, скоро появится функция расширения видео, позволяющая пользователям продолжать клип несколько раз, достигая длительности около двух минут.

Контроль над генерацией и редактирование

Другой акцент сделан на возможности управления процессом. Одна задача теперь может объединять до 15 мультимодальных ссылок, которые могут быть взяты из 10 изображений, пяти видеоклипов и семи объектов. Это позволяет персонажам, движению, работе камеры и звуку более точно следовать предоставленному материалу. Пользователи также могут устанавливать до 10 ключевых кадров для фиксации состояний персонажей, смены сцен и сюжетных моментов.

Ввод текстовых запросов увеличен до 8000 токенов, что дает модели возможность расширять и дорабатывать короткие промпты. Инструменты редактирования позволяют добавлять, изменять или удалять объекты и фоны в уже существующем видео, а также корректировать стиль, погоду, цвет, материал, размер кадра или ракурс. Режим переделки анализирует языковые особенности и темп эталонного видео, чтобы создать новый рекламный ролик на этой структуре, ориентированный на социальные сети, рекламу продуктов, моду, красоту и потребительскую электронику.

По качеству вывода Kling 4.0 поддерживает форматы 4K и 1080p с 10-битным HDR, что также ожидается в скором времени. Дополнительно предусмотрен ультраширокий формат 21:9, стереозвук с двумя каналами и улучшенная синхронизация губ. Компания утверждает, что движение, трекинговые кадры и вращающиеся движения камеры стали более стабильными. Голосовая поддержка охватывает китайский, английский, японский, корейский, испанский, португальский, немецкий, французский и хинди, включая акценты американского, британского и индийского английского, а также несколько китайских диалектов, таких как кантонский. Модель также способна отображать мультиязычный текст, эмодзи и логотипы на экране.

Версия Kling 4.0 Flash предназначена для высокообъемного создания контента благодаря более быстрой генерации и сниженной стоимости. Kuaishou также обновила страницу создания, объединив ссылки на изображения, видео и аудио в единое поле ввода, добавив временную шкалу для предварительного просмотра и редактирования, а также рабочую область холста с помощником-агентом. Цены API для новой модели пока не опубликованы.

Похожие сюжеты

Inspur представила суперузел MetaBrain SD200 Ultra с 128 отечественными чипами для работы с моделью Kimi K3
Подробнее
pandaily.com

Inspur представила суперузел MetaBrain SD200 Ultra с 128 отечественными чипами для работы с моделью Kimi K3

Компания Inspur Information представила суперузел искусственного интеллекта MetaBrain SD200 Ultra на конференции по вычислениям в области искусственного интеллекта AICC2026. Этот узел позиционируется как система класса возможностей для обработки задач с триллионными параметрами и агентами. Официальное английское наименование системы — Inspur / MetaBrain.

Согласно данным компании и информационных агентств, узел объединяет 128 отечественных чипов ИИ, предоставляет доступ к 8 ТБ унифицированной памяти ускорителя и 64 ТБ хостовой памяти. Он способен запускать модель Kimi K3 от Moonshot AI, имеющую 2,8 триллиона параметров, на одной машине с задержкой генерации токена менее 5,85 миллисекунд, что составляет около 170 токенов в секунду для одного пользователя, по оценкам Inspur.

Архитектурные особенности узла включают фабрику 3D Hyper Mesh, обеспечивающую нативную коммуникацию, чувствительную к семантике памяти, с заявленной задержкой в 0,69 микросекунды. Также используются короткодействующие медные интерконнекты и симметричная память, позволяющая ускорителям напрямую обращаться к памяти удаленных узлов. Inspur утверждает, что время выполнения операции AllReduce сократилось примерно в 3,5 раза по сравнению с предыдущими решениями.

Кроме того, встроенные «супероператоры» для стадий KDA, gated MLA и MoE модели Kimi K3 уменьшают количество операторов примерно в десять раз, одновременно повышая производительность инференса более чем втрое. Эти показатели являются заявлениями вендора. Материалы также указывают на потенциал поддержки моделей размером до 10 триллионов параметров на одном узле.

Другой продукт, MetaBrain HC2000, представляет собой стойку с несколькими ускорителями, предназначенную для инференса класса емкости, с заявленной десятикратной пропускной способностью токенов на инвестицию при соблюдении согласованных ограничений SLA. Хотя различные издания описывают ускорители лишь как отечественные или локальные чипы ИИ, ни один из основных источников, проанализированных для данного обзора, не называет производителя кремния или SKU внутри SD200 Ultra. Следовательно, данная статья не приписывает узел Ascend, Cambricon или любому другому конкретному поставщику.

Популярное