oyd@lab: ~

oyd@lab:~$ ./boot --on-your-device

[ ok ] gpu ....... 4× RTX 3090 · 3× DGX Spark

[ ok ] weights ... on local disk

[ ok ] network ... no cloud required

[ ok ] privacy ... data never leaves your device

On Your Device Super Intelligence

Частный ИИ на вашем сервере

Подбираем оборудование, разворачиваем и настраиваем языковые модели, которые работают в вашей инфраструктуре. Данные остаются в компании, а за каждый запрос платить не нужно.

oyd@lab:~$

oyd@lab:~cat services.md

Что мы делаем

Можно заказать весь путь или отдельную часть.

01 · Когда планируете покупку оборудования

Подбор оборудования и замеры

Сравниваем GPU-серверы, NVIDIA DGX Spark и компьютеры на Apple Silicon на ваших задачах и моделях. Измеряем скорость, длину контекста и качество, чтобы вы купили то, что действительно нужно.

  • Замеры скорости и качества
  • Проверка б/у оборудования
  • Рекомендация с цифрами
02 · Когда оборудование уже есть

Развёртывание и настройка

Готовим сервер или Mac, устанавливаем сервер моделей с API, совместимым с OpenAI, настраиваем доступы, автозапуск и мониторинг.

  • exllamav3, vLLM, llama.cpp, MLX
  • API, совместимый с OpenAI
  • Ключи доступа и мониторинг
03 · Когда система слишком медленная или слабая

Подбор и оптимизация моделей

Подбираем открытую модель под вашу задачу и выжимаем из оборудования больше: квантизация, спекулятивное декодирование, длинный контекст, распознавание изображений.

  • Qwen, DeepSeek, GLM и другие открытые модели
  • Квантизация EXL3 и GGUF
  • Спекулятивное декодирование
04 · Когда модель должна работать с вашими данными

Подключение к работе

Соединяем локальную модель с тем, чем команда уже пользуется: поиск по документам компании, чат- или код-ассистент, интеграции через API.

  • Поиск по документам (RAG)
  • Чат- и код-ассистенты
  • Интеграции через API

oyd@lab:~oyd bench --list

Замеры в нашей лаборатории

Цифры наших собственных систем. Такие же замеры мы делаем с вашими задачами, прежде чем предлагать решение.

stdout

> 0 results

> Первые замеры готовятся

> Здесь будем публиковать только то, что сами измерили на своём оборудовании: модель, настройки и результат. Пока готово оборудование.

oyd@lab:~lsdev --lab

qtydevicememstatus
4×NVIDIA RTX 309024 GBработает
3×NVIDIA DGX Spark128 GBработает
1×Mac Studio M5 Ultra—в пути
1×NVIDIA RTX 2080 Ti11 GBработает
1×NVIDIA RTX 306012 GBработает
2×AMD RX 4808 GBработает
2×Mac (Apple Silicon)—работает
./все-замеры

oyd@lab:~cat process.txt

Как мы работаем

  1. [1/4] Задачи и данные

    Выясняем, какую работу должен выполнять ИИ, с какими данными и какие есть требования к конфиденциальности.

  2. [2/4] Замеры

    Тестируем несколько моделей и вариантов оборудования на ваших задачах: скорость, качество и длину контекста. Решают цифры.

  3. [3/4] Развёртывание

    Настраиваем оборудование, модели, API и доступы в вашей сети. Система сама запускается после перезагрузки.

  4. [4/4] Поддержка

    Следим за работой системы и пробуем новые модели. Обновляем только тогда, когда замеры показывают пользу.

oyd@lab:~man local-ai

Когда локальный ИИ имеет смысл

+

Данные не покидают компанию

Договоры, данные клиентов или код остаются в вашей сети. Не нужно согласовывать, что можно отправлять внешнему поставщику.

+

Нет платы за запрос

Затраты зависят от оборудования и электричества, а не от того, сколько сотрудники пользуются системой.

+

Модель под вашим контролем

Модель не изменится и не исчезнет без вашего решения. Её можно заменить, когда выйдет более сильная.

!

Не всегда лучший выбор

Самые крупные облачные модели в некоторых задачах всё ещё сильнее. Если в вашем случае локальное решение не окупается, мы скажем об этом после замеров.

oyd@lab:~oyd --faq

Частые вопросы

> Какое оборудование нужно?

Зависит от задачи и размера модели. Небольшим моделям хватает одной хорошей видеокарты или компьютера на Apple Silicon, крупным нужно больше памяти или несколько устройств. Это мы выясняем замерами до покупки.

> Будет ли локальная модель так же хороша, как ChatGPT?

В одних задачах да, в других нет. Поэтому мы начинаем с тестов на ваших реальных задачах и показываем результаты до принятия решения.

> Данные действительно никуда не уходят?

Модель работает на вашем оборудовании и в вашей сети. Если какой-то части, например обновлениям, нужен интернет, мы это описываем, и такое соединение можно отключить.

> Можете ли вы работать с уже имеющимся оборудованием?

Да. Измеряем, на что оно способно, и говорим, какие модели и задачи на нём реально выполнять.

oyd@lab:~mail [email protected]

Хотите понять, подходит ли вам локальный ИИ?

Напишите, какую работу хотите выполнять и какое оборудование у вас есть или планируется. Предложим, что измерить в первую очередь.

./написать-письмо

Вильнюс, Литва · работаем по всему ЕС · LT / EN / RU