
Опубликовано: 18 сентября 2026 · Источник: TAdviser
Первый слой: вычислительные узлы и сеть
Состав первого слоя диктует нагрузка. Если корпоративный ассистент отвечает через две минуты вместо требуемых пяти секунд, формально работающая модель не решает задачу. Поэтому сайзинг начинается с метрик будущего сервиса.
Вычислительный контур включает GPU-узлы, управляющие серверы, хранилище и несколько сетей. Система обслуживания и управления Скала^р Геном отслеживает состояние Машины и управляет ею. Размерность ИИ-кластера в ПАК ИИ — от одного GPU-узла для тестов до 16 узлов полного цикла. Вместе с мощностью повышаются требования к межузловому обмену: при росте ИИ-кластера добавить GPU недостаточно.
| Конфигурации проверяются под нагрузками, в том числе совместно с производителями оборудования. Например, при валидации платформы YADRO наша команда протестировала отсутствовавший в каталоге поставщика узел с установленными в нем шестью GPU. Испытания подтвердили работоспособность такой конфигурации, затем YADRO провела собственную проверку и начала поставлять их заказчикам, говорит Алексей Павлов, ведущий архитектор ИИ-платформы Скала^р, Группа Rubytech. |
Тот же подход применяют к альтернативным ускорителям. В августе 2026 года специалисты Группы Rubytech запустили модель Cotype 3 от MWS AI на конфигурации с китайскими GPU. Тест подтвердил работоспособность отдельного альтернативного стека. Объединять его с основным контуром в одном пуле нельзя, но результаты можно использовать при планировании миграции. По сути, Группа Rubytech разработала методологию, которая позволяет включать в состав продукта любые программные и аппаратные средства для инференса LLM, прошедшие валидацию.
Источник: TAdviser · Оригинал статьи: ПАК ИИ по слоям: как устроена Машина искусственного интеллекта Скала^р