Інфраструктура Digio

Моделі ШІ та GPU

Запустіть агентів на керованих граничних моделях сьогодні або орендуйте ємність графічного процесора, розгорніть власні ваги та направляйте завдання Digio на приватні кінцеві точки в одному робочому просторі.

Клод, GPT, Близнюки Вибір моделі для кожного агента Оренда GPU & BYOM
Керовані моделі

Сьогодні доступні моделі в Digio

Призначте модель за замовчуванням для кожного агента або замініть для кожного завдання. Використання вимірюється в токенах Digio з балансу вашого плану — того самого гаманця, незалежно від того, чи викликає агент Sonnet, GPT-4o чи Gemini Flash.

Антропний Клод

  • Claude Opus 4.7 Флагманські міркування, довгий контекст, архітектура та стратегія роботи.
  • Claude Opus 4.6 Opus попереднього покоління для стабільного високоякісного аналізу.
  • Claude Sonnet 4.6 Щоденний драйвер — кодування, запис і багатокрокові цикли агента.
  • Claude Sonnet 4.5 / 4 Швидкі рівні Sonnet із оперативним кешуванням для підтримуваних робочих навантажень.
  • Claude Haiku 4.5 Чернетки з низькою затримкою, класифікація та великі обсяги підзадач.

Мітка інтерфейсу користувача веб-сайту B2B SaaS. Перекладіть на натуральну uk: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 Остання сімейство GPT-5 для загальних і агентських робочих навантажень.
  • GPT-4.1 & GPT-4o Надійний мультимодальний чат і використання інструментів для виробничих агентів.
  • GPT-4o mini Економічна маршрутизація для підсумків і легких кроків.
  • o3 / o3-pro / o3-mini / o4-mini Орієнтовані на міркування моделі для математики, планування та перевірки.
  • GPT-5.3 Codex & Codex mini Генерація коду, рефактори та навички роботи агента з репо.

Мітка інтерфейсу користувача веб-сайту B2B SaaS. Перекладіть на natural uk: Google Gemini

  • Gemini 2.5 Pro Дослідження тривалого контексту та структуроване вилучення.
  • Gemini 2.5 Flash Високопродуктивні кроки агента з конкурентоспроможними ставками токенів.
  • Gemini 2.0 Flash Надшвидкі проходи для аналізу, додавання тегів і пакетних завдань.

Відкриті та спеціалізовані API

  • DeepSeek Chat & Reasoner Велике значення для завдань у стилі чату та ланцюжка думок.
  • Mistral Large Європейський варіант для багатомовних команд агентів.
  • Llama 3.3 70B Модель відкритого вагового класу через API — добре поєднується з приватним графічним процесором.
  • Grok 3 Орієнтована на реальний час модель для агентів новин і соціальних моніторингів.
  • Sonar Pro Пошукові відповіді для дослідників.
  • Command R+ Зручні для RAG робочі процеси корпоративного чату та пошуку.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

Використання

Як агенти підбирають модель

Координатор може порекомендувати Sonnet vs Opus або дешевшу флеш-модель залежно від типу завдання. Досвідчені користувачі встановлюють значення за замовчуванням для кожної ролі агента — дослідження на Sonnet, остаточний перегляд на Opus, групове тегування на Haiku або Gemini Flash.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

Оренда GPU

Орендуйте графічний процесор і запускайте власні моделі

Потрібна точна настройка, контрольна точка з повітряним проміжком або передбачуване ціноутворення? Додайте виділену ємність графічного процесора до свого робочого простору Digio, встановіть стек обслуговування, якому ви віддаєте перевагу, і направте агентів на вашу приватну кінцеву точку.

Виділені екземпляри

Погодинні або щомісячні вузли GPU (клас A100, H100, L40S), прикріплені до вашого клієнта, ізольовані від інших клієнтів.

Ваші ваги

Завантажте safetensors, GGUF або витягніть з реєстру; запустіть Llama, Mistral, Qwen і спеціальні налаштування.

Стандартна порція

vLLM, TGI, Ollama або образи контейнерів, які ви підтримуєте — агенти Digio викликають базову URL-адресу, сумісну з OpenAI.

Та сама оркестровка

Що робити, командний чат, навички та співпраця залишаються незмінними — у вас є лише бекенд висновків.

Гібридна маршрутизація

Надсилайте конфіденційні кроки на приватний графічний процесор і використовуйте Claude або GPT для публічних досліджень в одному робочому процесі.

Контроль підприємства

Піринг VPC, статичний вихід, журнали аудиту та списки дозволених моделей для регульованих команд.

Принесіть власну модель

Встановити та підключити індивідуальну модель

Типове налаштування від нуля до агентів, що викликають вашу кінцеву точку:

  1. Резерв GPU

    Виберіть відеопам’ять, регіон і час безвідмовної роботи (вибух або постійний режим). Сховище для ваг транспортується разом із екземпляром або кріпиться до вашого відра.

  2. Розгорніть стек

    Запустіть образ обслуговування або SSH, встановіть драйвери CUDA та завантажте контрольні точки. Перевірки стану підтверджують готовність моделі.

  3. Зареєструвати кінцеву точку

    Додайте базову URL-адресу, ключ API та ідентифікатор моделі в налаштуваннях робочої області. Перед запуском Digio перевіряє затримку та формат маркера.

  4. Призначити агентам

    Виберіть свою приватну модель як стандартну для вибраних агентів; Керовані моделі Claude/GPT залишаються доступними поруч.

Оренда GPU оплачується окремо від підписки на план Digio. Зв’яжіться з нами для планування потужностей, SLA та міграції з існуючого кластера висновків.

Мітка інтерфейсу користувача веб-сайту B2B SaaS. Перекладіть на natural uk: FAQ

Запитання щодо моделей і GPU

Вибір керованих API проти самостійного висновку на Digio.

Чи плачу я двічі — план плюс API?

Ваша підписка на Digio покриває інфраструктуру, агентів і включені токени Digio. Керована модель використання дебетує цей баланс маркерів за фактичними маркерами введення/виведення. Оренда GPU – це доповнення для машин, якими ви керуєте.

Чи можуть різні агенти використовувати різні моделі?

Так, кожен агент може мати власне значення за умовчанням. Завдання та чати можна замінити для одного запуску без зміни глобальних стандартних параметрів.

Яка різниця між сонетом і опусом?

Opus налаштований на складніші міркування та довші послідовні плани; Sonnet є швидшим і дешевшим для повсякденних агентських циклів. Моделі Haiku та Flash-класу найкраще підходять для об’ємних підзадач.

Чи можу я запускати лише свою власну модель і блокувати хмарні API?

Корпоративні робочі простори можуть обмежувати постачальників вихідних моделей і направляти весь трафік агента до кінцевої точки GPU. Гібридний режим є типовим для більшості команд.

Які розміри GPU доступні?

Пропозиції залежать від регіону та попиту — зазвичай рівні 24–80 ГБ відеопам’яті для моделей класу 7B–70B і вузли з кількома GPU для більших стеків. Ми допомагаємо визначити розмір відеопам’яті на основі вашої кількості параметрів і квантування.

Чи приватне використання GPU все ще споживає Digio Tokens?

Оркестровка (агенти, завдання, сховище) залишається у вашому плані. Висновок на вашому GPU оплачується як час GPU; ви можете додатково вимірювати використання у формі маркера для внутрішнього повернення платежів.

Виберіть керовані моделі або візьміть із собою графічний процесор

Почніть із Claude і GPT сьогодні, а потім додайте спеціальний графічний процесор, коли будете готові розміщувати спеціальні ваги — ті самі агенти, ті самі завдання, ваші висновки.