Компания GEEKOM — признанный эксперт в создании производительных мини‑ПК — интегрировала модель DeepSeek V4 Flash в кластер из четырёх систем GEEKOM A9 Mega. Решение демонстрирует, как компактные вычислительные устройства могут стать основой для развёртывания ИИ‑инфраструктуры в корпоративной среде.

Вместо использования централизованного серверного оборудования четыре мини‑ПК A9 Mega объединяются в единую распределённую платформу посредством интерфейса USB4. В каждом устройстве установлен процессор AMD Ryzen AI Max+ 395: он включает 16 ядер архитектуры Zen 5, графический ускоритель Radeon 8060S и унифицированную память — всё это упаковано в компактный форм‑фактор.
Распределение оптимизированной модели DeepSeek V4 Flash между узлами кластера обеспечивают программные инструменты Ubuntu, ROCm и DwarfStar. Благодаря API, совместимому с OpenAI, приложения могут взаимодействовать с ИИ‑агентами, а применение USB4 позволяет обойтись без специализированных высокоскоростных коммутаторов или серверных стоек.
Такое решение приближает возможности корпоративного ИИ непосредственно к рабочим процессам компании. Важное преимущество — сохранение данных внутри локальной инфраструктуры: подсказки, документы, исходный код, учётные данные и промежуточные результаты не передаются в публичное облако, оставаясь под полным контролем организации.
На базе платформы компании могут выстраивать собственные системы управления знаниями: они способны индексировать, искать и анализировать внутренние материалы — от политик и руководств до договоров и отчётов. Функционал также включает проверку документов, анализ кода, локальную генерацию контента с расширенным поиском, мультиисточниковые исследования и автоматизацию регламентированных рабочих процессов.
Для агентных ИИ‑систем (например, Hermes Agent) кластер предоставляет среду для обработки инструментов, политик, памяти, журналов, кода и извлечённых данных до начала выполнения задачи. Поддержка контекстов объёмом до 250 000 токенов делает платформу пригодной для работы с объёмными документами, крупными кодовыми базами и многоэтапными сценариями.
Результаты тестирования подтверждают эффективность решения: в однопоточном режиме скорость генерации составила порядка 14,61 токена в секунду, а задержка до выдачи первого токена в тестах с 32 и 128 токенами — около 0,42 секунды. Особенно заметно преимущество при обработке длинных запросов: система не просто ускоряет вывод текста, но и демонстрирует более высокую производительность и эффективное ускорение именно в сложных сценариях.
Масштабирование платформы можно выстраивать поэтапно: начать с одного‑двух устройств и при необходимости расширить конфигурацию до четырёх систем. При этом каждый мини‑ПК A9 Mega способен функционировать автономно либо участвовать в распределённом выводе — это обеспечивает гибкость развёртывания и долгосрочную экономическую ценность решения.
Достижение подчёркивает лидерство GEEKOM в сегменте инновационных мини‑ПК. Преобразуя отдельные компактные компьютеры в доступную локальную ИИ‑платформу, компания расширяет спектр применения таких устройств — они становятся полезными не только в бизнесе, но и в лабораториях, учебных классах, а также в периферийных вычислительных средах.
По материалам:
techpowerup
