Этот сайт использует файлы cookies. Продолжая просматривать сайт, Вы соглашаетесь на использование нами файлов cookies. Ознакомьтесь с нашей политикой конфиденциальности.
China Mobile Hubei и Huawei первыми в Китае провели операторскую валидацию решения для ускорения AI-инференса

[Шанхай, Китай, 24 июня 2026 года] На выставке MWC Shanghai 2026 компания China Mobile Communications Group Hubei Co., Ltd. совместно с Huawei объявила об успешной проверке решения Huawei AI Inference Acceleration Solution в действующей сети оператора. Это первая подобная валидация в телеком-отрасли Китая. Решение, работающее на базе хранилища Huawei OceanStor A800, Ascend A3 SuperPoD и Unified Cache Manager (UCM), обеспечивает повышение пропускной способности токена до 372% для рабочих нагрузок вывода данных в области искусственного интеллекта (ИИ) с длинными последовательностями. Это достижение обеспечивает важную техническую поддержку для эффективного развертывания вычислительных сервисов ИИ операторами связи.
Huawei UCM устраняет ограничения при обработке длинных AI-запросов
Поскольку приложения искусственного интеллекта быстро переориентируются на агентов ИИ, сценарии с длинными последовательностями, такие как генерация кода и многоходовые диалоги, становятся все более распространенными. Однако ограниченная емкость обычной встроенной памяти и динамической оперативной памяти (DRAM) значительно ограничивает коэффициенты попадания в кэш «ключ-значение», что ограничивает общую производительность.
В 2025 году Huawei представила технологию Unified Cache Manager, которая решает эту проблему за счет использования внешнего высокопроизводительного хранилища. Используя внешнее высокопроизводительное хранилище, UCM преодолевает традиционные ограничения емкости встроенной памяти и DRAM, обеспечивая возможности кэширования ключ-значение в петабайтном масштабе. Решение реализует иерархическое управление и планирование кэша ключ-значение на протяжении всего жизненного цикла, значительно расширяя контекстное окно для диалогов с одним ходом. Для диалогов с несколькими ходами UCM повторно использует исторический кэш ключ-значение для исключения избыточных вычислений, обеспечивая оптимизированный процесс вывода при меньших затратах на вывод.
Испытания показали рост скорости и пропускной способности
Проверка проходила в действующей сети China Mobile Hubei с использованием фреймворка vLLM-Ascend. В тестах моделировались длинные входные последовательности от 8K до 190K токенов. Испытания проводились на популярных моделях, включая MiniMax M2.5 и GLM-5.1. Основные результаты:
● MiniMax M2.5: При включенной функции UCM время до получения первого токена (TTFT) улучшилось на 26–62%, а также значительно увеличилось количество токенов в секунду (TPS) на один NPU. При более детальном рассмотрении различных длин последовательностей, TPS улучшилось на 58% при длине последовательности 64K и выросло на 78% в среде с последовательностью длиной 128K.
● GLM-5.1: Показатель TTFT улучшился на 51–93%, а TPS вырос на 56–372%. TPS увеличился на 313% при длине последовательности 64K и взлетел на 372% в среде с последовательностью длиной 128K.
Результаты тестирования показывают, что с увеличением длины контекста преимущества решения для ускорения вывода ИИ становятся еще более выраженными. Решение эффективно устраняет узкое место, связанное с объемом кэша ключ-значение, которое часто встречается при выводе длинных последовательностей.
Решение для эпохи AI-агентов
Представитель China Mobile Hubei отметил: «Хубэй расположен в центральной зоне, и задержка связи с восемью крупнейшими вычислительными центрами страны составляет всего 10 миллисекунд. Этот тест подтверждает необходимость взаимодействия хранилища данных, вычислительных ресурсов и сети. В таких сценариях, как взаимодействие агентов ИИ и генерация кода, решение для ускорения вывода ИИ может увеличить пропускную способность более чем на 50%, закладывая прочную основу для крупномасштабного развертывания сервисов ИИ China Mobile Hubei».
Новый этап развития AI-инфраструктуры
Майкл Цю, президент департамента маркетинга и продаж решений для глобального хранения данных Huawei, отметил: «С запуском крупными операторами связи пакетов токенов широкомасштабное внедрение агентов ИИ явно вступило в новую фазу. Ожидается, что потребление токенов в будущем будет расти экспоненциально. Решение для ускорения вывода данных с помощью ИИ не только значительно сокращает время ожидания передачи данных (TTFT), но и помогает снизить стоимость токенов, позволяя операторам связи создавать эффективную и экологичную вычислительную инфраструктуру для ИИ».
Успешная проверка знаменует собой важный шаг вперед в совместной оптимизации вычислительной инфраструктуры искусственного интеллекта для операторов связи, предоставляя воспроизводимую техническую модель для мировой индустрии ИИ.
Выставка MWC Shanghai 2026 пройдет с 24 по 26 июня в Шанхае, Китай. В ходе мероприятия компания Huawei представит свои новейшие продукты и решения в зале N1 Шанхайского нового международного выставочного центра (SNIEC).
ИКТ-индустрия стремительно движется к эре монетизации токенами. Huawei сотрудничает с глобальными операторами связи и партнерами для изучения возможностей монетизации высокоскоростного восходящего канала 5G-A и повышения качества обслуживания, а также модернизации бизнеса с помощью искусственного интеллекта за счет расширения возможностей подключения и вычислительных мощностей. Вместе мы воспользуемся возможностями, которые предоставляет монетизация токенами.
Для получения дополнительной информации посетите сайт: https://carrier.huawei.com/minisite/mwcs2026/en/