Digio infrastruktuur

AI mudelid ja GPU

Käivitage agente hallatud piirimudelitel juba täna või rentige GPU võimsust, juurutage oma kaalud ja suunake Digio ülesanded privaatsetesse lõpp-punktidesse samas tööruumis.

Claude, GPT, Kaksikud Agendipõhine mudeli valik GPU rentimine ja BYOM
Hallatavad mudelid

Täna Digios saadaval olevad mudelid

Määrake iga agendi jaoks vaikemudel või alistage iga ülesande kohta. Kasutust mõõdetakse Digio žetoonides teie plaani saldost – sama rahakotti, olenemata sellest, kas agent helistab Sonnetile, GPT-4o-le või Gemini Flashile.

Antroopne Claude

  • Claude Opus 4.7 Lipulaeva arutluskäik, pikk kontekst, arhitektuur ja strateegiatöö.
  • Claude Opus 4.6 Eelmise põlvkonna Opus stabiilseks ja kvaliteetseks analüüsiks.
  • Claude Sonnet 4.6 Igapäevane draiver – kodeerimine, kirjutamine ja mitmeastmelised agenditsüklid.
  • Claude Sonnet 4.5 / 4 Kiired Soneti tasemed koos kiire vahemällu salvestamisega toetatud töökoormustel.
  • Claude Haiku 4.5 Madala latentsusega mustandid, klassifikatsioon ja suure mahuga alamülesanded.

Tõlgi sõna-sõnalt: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 Uusim GPT-5 perekond üldiste ja agentide töökoormuste jaoks.
  • GPT-4.1 & GPT-4o Usaldusväärne multimodaalne vestlus ja tööriistade kasutamine tootmisagentide jaoks.
  • GPT-4o mini Kulusäästlik marsruutimine kokkuvõtete ja kergete sammude jaoks.
  • o3 / o3-pro / o3-mini / o4-mini Arutlusvõimele keskendunud mudelid matemaatika, planeerimise ja kontrollimise jaoks.
  • GPT-5.3 Codex & Codex mini Koodi genereerimine, refaktorid ja repoteadlikud agendioskused.

Tõlgi sõna-sõnalt: Google Gemini

  • Gemini 2.5 Pro Pika konteksti uurimine ja struktureeritud väljavõte.
  • Gemini 2.5 Flash Suure läbilaskevõimega agendi sammud konkurentsivõimeliste lubade määradega.
  • Gemini 2.0 Flash Ülikiired läbipääsud sõelumiseks, märgistamiseks ja pakktöödeks.

Avatud ja spetsiaalsed API-d

  • DeepSeek Chat & Reasoner Suurepärane väärtus vestluse ja mõtteahela stiilis ülesannete jaoks.
  • Mistral Large Euroopas majutatud võimalus mitmekeelsete agendimeeskondade jaoks.
  • Llama 3.3 70B Avatud kaaluklassi mudel API kaudu – sobib hästi privaatse GPU-ga.
  • Grok 3 Reaalajas orienteeritud mudel uudiste ja sotsiaalse jälgimise agentidele.
  • Sonar Pro Otsingupõhised vastused uurimisagentidele.
  • Command R+ RAG-sõbralik ettevõtte vestlus- ja otsingutöövood.

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

Kasutamine

Kuidas agendid modelli valivad

Koordinaator võib soovitada Sonnet vs Opus vs odavamat välklambi mudelit ülesande tüübi alusel. Võimsad kasutajad määravad vaikeväärtused agendirolli kohta – uurimine Sonnetis, viimane ülevaade Opusel, hulgisildistamine Haiku või Gemini Flashi puhul.

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU rentimine

Rentige GPU ja käitage oma mudeleid

Kas vajate peenhäälestust, õhuvahega kontrollpunkti või prognoositavat hinnakujundust? Lisage oma Digio tööruumi spetsiaalne GPU võimsus, installige eelistatud teeninduspinn ja suunake agendid oma privaatsesse lõpp-punkti.

Spetsiaalsed eksemplarid

Tunni- või kuupõhised GPU-sõlmed (A100, H100, L40S klass), mis on teie rentnikuga ühendatud – teistest klientidest isoleeritud.

Teie kaalud

Laadige üles seifid, GGUF või tõmmake oma registrist üles; käivitada Llama, Mistral, Qwen ja kohandatud peenhäälestused.

Standardne serveerimine

VLLM-, TGI-, Ollama- või konteinerkujutised, mida hooldate – Digio agendid kutsuvad OpenAI-ga ühilduva põhi-URL-i.

Sama orkestratsioon

Selleks, meeskonnavestlus, oskused ja koostöö muutumatuna – teie päralt on ainult järelduste taustaprogramm.

Hübriidmarsruutimine

Saatke tundlikud sammud privaatsesse GPU-sse ja kasutage Claude'i või GPT-d avalikuks uurimistööks ühes töövoos.

Ettevõtte kontroll

VPC peering, staatiline väljapääs, auditi logid ja mudelite lubatud loendid reguleeritud meeskondade jaoks.

Kaasa võtta oma mudel

Installige ja ühendage kohandatud mudel

Tüüpiline seadistus nullist teie lõpp-punkti helistavate agentideni:

  1. GPU reserveerimine

    Valige VRAM, piirkond ja tööaeg (sarivõte vs alati sees). Raskuste hoidla tarnitakse koos eksemplariga või kinnitatakse kopp.

  2. Rakendage virn

    Käivitage esituspilt või SSH, installige CUDA draiverid ja laadige kontrollpunktid. Tervisekontroll kinnitab, et mudel on valmis.

  3. Registreeri lõpp-punkt

    Lisage tööruumi seadetesse baas-URL, API võti ja mudeli ID. Digio kontrollib latentsust ja märgi vormingut enne avaldamist.

  4. Määra agentidele

    Valige valitud agentide jaoks vaikemudeliks oma privaatmudel; hallatavad Claude/GPT mudelid jäävad kõrvuti kättesaadavaks.

GPU rentimisel arveldatakse Digio plaani tellimustest eraldi. Võtke meiega ühendust võimsuse planeerimise, SLA-de ja olemasolevast järeldusklastrist üleminekuks.

KKK

Küsimused mudelite ja GPU kohta

Hallatud API-de ja isehostitud järelduste valimine Digios.

Kas ma maksan kaks korda – plaan pluss API?

Teie Digio tellimus hõlmab infrastruktuuri, agente ja kaasasolevaid Digio märke. Hallatud mudelikasutus debiteerib selle märgi saldo tegelike sisend-/väljundlubade kaupa. GPU rentimine on teie juhitavate masinate lisandmoodul.

Kas erinevad agendid saavad kasutada erinevaid mudeleid?

Jah – igal agendil võib olla oma vaikeseade. Ülesanded ja vestlused võivad alistada ühe töökorra jaoks ilma globaalset vaikeseadet muutmata.

Mis vahe on Sonnetil ja Opusel?

Opus on häälestatud raskema arutluskäigu ja pikemate sidusate plaanide jaoks; Sonet on igapäevaste agendisilmuste jaoks kiirem ja odavam. Helitugevuse alamülesannete jaoks sobivad kõige paremini haiku- ja flash-klassi mudelid.

Kas ma saan käitada ainult oma mudelit ja blokeerida pilve API-sid?

Ettevõtte tööruumid võivad piirata väljaminevaid mudelipakkujaid ja suunata kogu agendiliikluse teie GPU lõpp-punkti. Hübriidrežiim on enamiku meeskondade jaoks vaikerežiim.

Millised GPU suurused on saadaval?

Pakkumised sõltuvad piirkonnast ja nõudlusest – tavaliselt 24–80 GB VRAM-i tasemed 7B–70B klassi mudelite jaoks ja mitme GPU sõlmed suuremate virnade jaoks. Aitame määrata VRAM-i suurust teie parameetrite loendamisest ja kvantifitseerimisest.

Kas privaatne GPU kasutamine tarbib endiselt Digio märke?

Orkestreerimine (agendid, ülesanded, salvestusruum) jääb teie plaani juurde. Teie GPU kohta tehtud järelduste eest arvestatakse GPU aega; saate sisemise tagasimakse jaoks valikuliselt mõõta märgikujulist kasutust.

Valige hallatavad mudelid või võtke kaasa oma GPU

Alustage Claude'i ja GPT-ga juba täna, seejärel lisage spetsiaalne GPU, kui olete valmis majutama kohandatud kaalusid – samad agendid, samad ülesanded, teie järeldus.