Jensen Huang: 100 000 GPU Nvidia для обучения GPT-6 Astra
NVIDIA раскрыла масштаб вычислительных ресурсов, задействованных для обучения последней модели OpenAI — GPT-6 Astra. По словам генерального директора NVIDIA Jensen Huang, для этой задачи было использовано более 100 000 графических процессоров, а компания уже планирует развернуть инфраструктуру на 400 000 ускорителей.
Информация появилась в связи с недавним запуском ограниченного доступа к GPT-6 Astra. OpenAI начала предоставлять модель узкому кругу организаций, при этом более широкий доступ для подписчиков ожидается в ближайшее время. Jensen Huang сообщил в социальной сети X, что обучение проходило на серверных стойках конфигурации Nvidia Grace Blackwell NVLink72, общее количество графических процессоров в которых превысило 100 000 единиц.
Сопредседатель и президент OpenAI Greg Brockman подтвердил эти данные в интервью изданию Stratechery. Он отметил, что это первый случай в истории компании, когда для обучения нейросети было задействовано более 100 000 графических процессоров. Такой масштаб вычислений требует значительных ресурсов и, по мнению наблюдателей, может влиять на глобальный рынок комплектующих, включая память.
Планы по расширению инфраструктуры
Помимо уже использованных ресурсов, NVIDIA и OpenAI имеют планы на будущее. Jensen Huang заявил, что уже ведутся работы по выводу в эксплуатацию еще 400 000 графических процессоров. Это означает, что общая вычислительная мощность, доступная для будущих моделей, может вырасти в четыре раза по сравнению с текущим уровнем. Подобное расширение инфраструктуры свидетельствует о намерении компаний продолжать наращивать масштабы обучения искусственного интеллекта.
Вопросы безопасности и позиционирования
Вместе с анонсом модели OpenAI сделала акцент на вопросах безопасности. Greg Brockman подчеркнул, что значительная часть вычислительных ресурсов была направлена на обеспечение безопасности и выравнивание (alignment) модели. Он заявил, что компания проделала огромную работу, чтобы предоставить модель безопасно. OpenAI описывает GPT-6 Astra как свою «наиболее выровненную» модель.
Тем не менее, заявления руководства NVIDIA о том, что «искусственный общий интеллект (AGI) наступил», вызывают дискуссии. Термин AGI обычно используется для описания моделей, которые соответствуют или превосходят человеческие способности в сложных когнитивных задачах. Greg Brockman признал, что определение AGI остается размытым и зависит от интерпретации. Он предположил, что предыдущая модель, Astra или следующая версия могут претендовать на этот статус, но окончательного консенсуса в отрасли пока нет.
Производительность и доступность
По данным OpenAI, GPT-6 Astra демонстрирует передовые результаты на ряде стандартизированных тестов, включая FrontierMath Tier 4, ARC-AGI 3 и TerminalBench-4.0. В промо-ролике модель представлена как инструмент, способный выполнять различные компьютерные задачи, такие как создание презентаций, объявлений на eBay и файлов .STL для 3D-печати по голосовым командам.
На данный момент доступ к модели остается ограниченным, что затрудняет независимую проверку заявлений о ее возможностях. Тем не менее, масштаб используемого оборудования и планы по его расширению подчеркивают серьезность намерений OpenAI и NVIDIA в развитии технологий искусственного интеллекта. Для конечных пользователей ключевым остается вопрос, когда и в каком виде станет доступен полный функционал модели.