Sugon показала мобильную рабочую станцию с 64-потоковым CPU
Китайский производитель суперкомпьютеров Sugon представил мобильную рабочую станцию, которую компания называет первой в мире моделью с 64-потоковым процессором для локального запуска ИИ-моделей. Устройство оснащено отечественным CPU и дискретной графикой с 16 ГБ видеопамяти, что, по заявлению разработчика, обеспечивает скорость генерации до 50 токенов в секунду на моделях с 35 миллиардами параметров.
Согласно данным издания ITHome, новый ноутбук от Sugon позиционируется как инструмент для вычислений искусственного интеллекта. В отличие от громоздких мобильных рабочих станций прошлых лет, которые напоминали настольные ПК в корпусе чемодана, это устройство имеет тонкий корпус толщиной всего 16,9 мм. Такие габариты сопоставимы с премиальными ультрабуками, что делает аппарат значительно более портативным для профессиональных задач.
В основе системы лежит процессор из серии C86-5G, разработанный компанией Hygon. Важно отметить, что Sugon сама не производит чипы, а выступает крупным акционером Hygon. Ранее эти компании пытались объединиться, чтобы создать мощного игрока на рынке серверного оборудования, конкурирующего с HPE и Dell, однако сделка не состоялась. Тем не менее, тесное сотрудничество продолжается, и именно чипы Hygon используются в новых устройствах Sugon.
Архитектурно процессор C86-5G представляет собой отход от микроархитектуры AMD Zen, на которой основывались предыдущие поколения. Новая серия поддерживает инструкции AVX-512 и использует конфигурацию четырехпотоковой одновременной многопоточности (SMT4), где на каждое ядро приходится четыре потока. Если в мобильной рабочей станции действительно установлен такой чип, то речь идет о 16-ядерном процессоре с 64 потоками. Это обеспечивает высокую вычислительную мощность, необходимую для обработки данных в задачах машинного обучения.
Графическая подсистема также заслуживает внимания. В устройстве установлена дискретная видеокарта с 16 ГБ видеопамяти (VRAM). Конкретная модель GPU не раскрывается, но наличие такого объема памяти указывает на то, что аппарат предназначен для работы с большими языковыми моделями, которые требуют значительных ресурсов для хранения весов и контекста. По словам производителя, сочетание 64-потокового процессора и дискретной графики обеспечивает производительность в задачах инференса ИИ в 3–5 раз выше, чем у основных конкурентов на рынке.
Ключевым показателем заявлена скорость генерации текста: до 50 токенов в секунду при локальном запуске модели MoE (Mixture of Experts) с 35 миллиардами параметров. Для сравнения, стандартные облачные API обычно обеспечивают пропускную способность в диапазоне от 30 до 80 токенов в секунду. Если Sugon подтвердит эти цифры независимыми тестами, их мобильная станция может стать серьезной альтернативой облачным сервисам для разработчиков, которым важна конфиденциальность данных и отсутствие зависимости от сетевого соединения.
На данный момент Sugon не раскрыла информацию о цене и сроках выхода устройства в продажу. Учитывая текущие рыночные условия на компоненты памяти и накопители, а также специфический характер оборудования для ИИ, стоимость такой рабочей станции, вероятно, будет довольно высокой. Тем не менее, появление мобильных устройств с такой вычислительной мощностью демонстрирует, как быстро развивается сегмент локального ИИ-инференса, особенно в условиях стремления к технологической независимости в Китае.