ТЕХНОЛОГИИ

Корейская компания HyperAccel анонсировала ускорители Bertha для искусственного интеллекта

Южнокорейский стартап HyperAccel представил ускорители Bertha, которые оптимизированы для ИИ-инференса. Они отличаются высокой экономической эффективностью благодаря использованию чипов LPDDR.

Южнокорейская компания HyperAccel анонсировала новые специализированные ускорители Bertha, предназначенные для выполнения задач ИИ-инференса. Как утверждают разработчики, одним из ключевых преимуществ этих устройств является их высокая экономическая эффективность.

В отличие от традиционных решений, использующих дорогостоящую память HBM, ускорители Bertha применяют чипы LPDDR. Они основаны на уникальной архитектуре Streamlined Dataflow, что позволяет значительно сократить перемещение данных. Это обеспечивает оптимальное соответствие между пропускной способностью памяти и вычислительными возможностями ускорителей, что в свою очередь позволяет использовать до 90% аппаратных ресурсов во время инференса. По заявлению компании, это приводит к увеличению производительности до пяти раз по сравнению с обычными решениями при сопоставимых показателях TOPS.

В рамках презентации был показан ускоритель Bertha 500, который производится по 4-нм технологии Samsung. Устройство оформлено в виде карты расширения с двумя слотами и включает 32 ядра LPU, четыре ядра Arm Cortex-A53, 256 Мбайт SRAM и 128 Гбайт LPDDR5X, с возможностью увеличения до 256 Гбайт. Пропускная способность достигает 546 Гбайт/с, а TDP составляет 250 Вт. Ускоритель демонстрирует производительность до 768 Тфлопс в режимах FP8/INT8 и до 384 Тфлопс при FP16, а также поддерживает форматы FP4, BF16 и INT4. Серийное производство запланировано на начало 2027 года.

HyperAccel также разрабатывает ускоритель Bertha 100, который предназначен для агентного ИИ и выполнен в форм-факторе M.2. Он включает 16 Гбайт LPDDR5X с пропускной способностью 64 Гбайт/с и обеспечивает производительность на уровне 32 Тфлопс в FP8. Устройство также поддерживает режимы BF16, FP4, INT8 и INT4. Первые образцы будут доступны в IV квартале 2023 года.

Ускорители Bertha совместимы с популярными фреймворками, такими как PyTorch, ONNX и vLLM. Кроме того, разработчикам предлагается комплект SDK для оптимизации, развёртывания и профилирования решений с учетом индивидуальных требований. HyperAccel утверждает, что их ускорители более чем в пять раз энергоэффективнее NVIDIA H100 и обеспечивают примерно в 20 раз лучшее соотношение цены и производительности. На февраль 2026 года компания привлекла $45 млн инвестиций, а ее штат состоит из около 80 сотрудников.

По материалам: 3dnews.ru