Digio पूर्वाधार

एआई मोडेल र GPU

आज व्यवस्थित फ्रन्टियर मोडेलहरूमा एजेन्टहरू चलाउनुहोस् — वा GPU क्षमता भाडामा लिनुहोस्, तपाईंको आफ्नै तौलहरू प्रयोग गर्नुहोस्, र डिजियो कार्यहरूलाई उही कार्यस्थानमा निजी अन्तिम बिन्दुहरूमा रुट गर्नुहोस्।

क्लाउड, GPT, मिथुन प्रति-एजेन्ट मोडेल छनोट GPU भाडा र BYOM
प्रबन्धित मोडेलहरू

आज डिजियोमा उपलब्ध मोडेलहरू

प्रति एजेन्ट वा प्रति कार्य ओभरराइड एक पूर्वनिर्धारित मोडेल असाइन गर्नुहोस्। तपाईंको प्लान ब्यालेन्सबाट डिजियो टोकनमा प्रयोगको मापन गरिन्छ — एजेन्टले सोननेट, GPT-4o, वा जेमिनी फ्ल्यासलाई कल गरे पनि उही वालेट।

एन्थ्रोपिक क्लाउड

  • Claude Opus 4.7 प्रमुख तर्क, लामो सन्दर्भ, वास्तुकला र रणनीति कार्य।
  • Claude Opus 4.6 स्थिर, उच्च-गुणस्तरको विश्लेषणको लागि अघिल्लो पुस्ताको ओपस।
  • Claude Sonnet 4.6 दैनिक चालक - कोडिङ, लेखन, र बहु-चरण एजेन्ट लूपहरू।
  • Claude Sonnet 4.5 / 4 समर्थित वर्कलोडहरूमा प्रम्प्ट क्यासिङको साथ द्रुत सोनट टियरहरू।
  • Claude Haiku 4.5 कम-विलम्बता ड्राफ्ट, वर्गीकरण, र उच्च-भोल्युम सबटास्कहरू।

शाब्दिक अनुवाद गर्नुहोस्: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 सामान्य र एजेन्टिक कार्यभारहरूको लागि नवीनतम GPT-5 परिवार।
  • GPT-4.1 & GPT-4o उत्पादन एजेन्टहरूको लागि विश्वसनीय बहुविध च्याट र उपकरण प्रयोग।
  • GPT-4o mini सारांश र हल्का चरणहरूको लागि लागत-कुशल मार्ग।
  • o3 / o3-pro / o3-mini / o4-mini गणित, योजना, र प्रमाणीकरणको लागि तर्क-केन्द्रित मोडेलहरू।
  • GPT-5.3 Codex & Codex mini कोड उत्पादन, रिफ्याक्टरहरू, र रेपो-सचेत एजेन्ट कौशल।

गुगल मिथुन

  • Gemini 2.5 Pro लामो सन्दर्भ अनुसन्धान र संरचित निकासी।
  • Gemini 2.5 Flash प्रतिस्पर्धी टोकन दरहरूको साथ उच्च-थ्रुपुट एजेन्ट चरणहरू।
  • Gemini 2.0 Flash पार्सिङ, ट्यागिङ, र ब्याच कार्यहरूको लागि अल्ट्रा-फास्ट पासहरू।

खोल्नुहोस् र विशेषज्ञ API हरू

  • DeepSeek Chat & Reasoner च्याट र चेन-अफ-थट शैली कार्यहरूको लागि बलियो मूल्य।
  • Mistral Large बहुभाषी एजेन्ट टोलीहरूको लागि युरोपेली-होस्ट गरिएको विकल्प।
  • Llama 3.3 70B API मार्फत ओपन-वेट्स क्लास मोडेल - निजी GPU सँग राम्रोसँग जोडी।
  • Grok 3 समाचार र सामाजिक निगरानी एजेन्टहरूको लागि वास्तविक समय उन्मुख मोडेल।
  • Sonar Pro अनुसन्धान एजेन्टहरूको लागि खोज-आधारित जवाफहरू।
  • Command R+ RAG-मैत्री उद्यम च्याट र पुन: प्राप्ति कार्यप्रवाह।

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

प्रयोग

कसरी एजेन्टहरूले मोडेल छान्छन्

संयोजकले कार्य प्रकारको आधारमा Sonnet बनाम Opus बनाम सस्तो फ्ल्यास मोडेल सिफारिस गर्न सक्छ। पावर प्रयोगकर्ताहरूले प्रति एजेन्ट भूमिका पूर्वनिर्धारितहरू सेट गर्छन्—सोनेटमा अनुसन्धान, ओपसमा अन्तिम समीक्षा, हाइकु वा जेमिनी फ्ल्यासमा बल्क ट्यागिङ।

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU भाडा

GPU भाडामा लिनुहोस् र आफ्नै मोडेलहरू चलाउनुहोस्

फाइन-ट्यून, एयर-गप गरिएको चेकपोइन्ट, वा अनुमानित अनुमान मूल्य निर्धारण चाहिन्छ? तपाईंको Digio कार्यस्थानमा समर्पित GPU क्षमता थप्नुहोस्, तपाईंले मनपर्ने सर्भिङ स्ट्याक स्थापना गर्नुहोस्, र तपाईंको निजी अन्तिम बिन्दुमा पोइन्ट एजेन्टहरू।

समर्पित उदाहरणहरू

घन्टा वा मासिक GPU नोडहरू (A100, H100, L40S वर्ग) तपाईंको भाडामा संलग्न-अन्य ग्राहकहरूबाट अलग।

तपाईंको वजन

सेफटेन्सरहरू, GGUF अपलोड गर्नुहोस्, वा तपाईंको रजिस्ट्रीबाट तान्नुहोस्; Llama, Mistral, Qwen, र अनुकूलन फाइन-ट्यूनहरू चलाउनुहोस्।

मानक सेवा

vLLM, TGI, Ollama, वा कन्टेनर छविहरू तपाईंले राख्नुहुन्छ — Digio एजेन्टहरूले OpenAI- संगत आधार URL कल गर्छन्।

एउटै अर्केस्ट्रेशन

गर्नको लागि, टोली च्याट, कौशल, र सहयोग अपरिवर्तित - केवल अनुमान ब्याकइन्ड तपाईंको हो।

हाइब्रिड मार्ग

निजी GPU मा संवेदनशील चरणहरू पठाउनुहोस् र एक कार्यप्रवाहमा सार्वजनिक अनुसन्धानको लागि क्लाउड वा GPT प्रयोग गर्नुहोस्।

उद्यम नियन्त्रणहरू

VPC पियरिङ, स्थिर निकास, अडिट लगहरू, र विनियमित टोलीहरूका लागि मोडेल अनुमति सूचीहरू।

तपाईंको आफ्नै मोडेल ल्याउनुहोस्

अनुकूलन मोडेल स्थापना र जडान गर्नुहोस्

तपाईंको अन्तिम बिन्दुलाई कल गर्ने एजेन्टहरू शून्यबाट सामान्य सेटअप:

  1. रिजर्भ GPU

    VRAM, क्षेत्र, र अपटाइम छान्नुहोस् (बर्स्ट बनाम सधैं-अन)। तौलको लागि भण्डारण उदाहरणको साथ जहाज वा तपाईंको बाल्टिन माउन्ट गर्दछ।

  2. स्ट्याक तैनात गर्नुहोस्

    सेवा गर्ने छवि वा SSH मा सुरु गर्नुहोस्, CUDA ड्राइभरहरू स्थापना गर्नुहोस्, र चेकपोइन्टहरू लोड गर्नुहोस्। स्वास्थ्य जाँचहरूले मोडेल तयार भएको पुष्टि गर्छ।

  3. अन्तिम बिन्दु दर्ता गर्नुहोस्

    कार्यस्थान सेटिङहरूमा आधार URL, API कुञ्जी, र मोडेल आईडी थप्नुहोस्। Digio लाइभ हुनु अघि विलम्बता र टोकन ढाँचा प्रमाणित गर्दछ।

  4. एजेन्टहरूलाई तोक्नुहोस्

    चयन गरिएका एजेन्टहरूको लागि पूर्वनिर्धारित रूपमा आफ्नो निजी मोडेल छान्नुहोस्; व्यवस्थित क्लाउड/GPT मोडेलहरू साथसाथै उपलब्ध छन्।

GPU भाडा Digio योजना सदस्यताहरूबाट अलग बिल गरिन्छ। क्षमता योजना, SLA, र अवस्थित अनुमान क्लस्टरबाट माइग्रेसनको लागि हामीलाई सम्पर्क गर्नुहोस्।

B2B SaaS वेबसाइट UI लेबल। प्राकृतिक ne मा अनुवाद गर्नुहोस्: FAQ

मोडेल र GPU प्रश्नहरू

Digio मा व्यवस्थित API बनाम स्व-होस्ट गरिएको अनुमान छनोट गर्दै।

के म दुई पटक भुक्तान गर्छु—प्लान प्लस एपीआई?

तपाईंको Digio सदस्यताले पूर्वाधार, एजेन्टहरू, र Digio टोकनहरू समावेश गर्दछ। प्रबन्धित मोडेल उपयोग डेबिटहरू जुन वास्तविक इनपुट/आउटपुट टोकनहरूद्वारा टोकन ब्यालेन्स। GPU भाडा तपाईंले नियन्त्रण गर्ने मेसिनहरूको लागि एड-अन हो।

के विभिन्न एजेन्टहरूले विभिन्न मोडेलहरू प्रयोग गर्न सक्छन्?

हो — प्रत्येक एजेन्टको आफ्नै पूर्वनिर्धारित हुन सक्छ। कार्यहरू र च्याटहरू विश्वव्यापी पूर्वनिर्धारित परिवर्तन नगरी एकल रनको लागि ओभरराइड गर्न सक्छन्।

Sonnet र Opus मा के फरक छ?

ओपस कडा तर्क र लामो सुसंगत योजनाहरूको लागि ट्युन गरिएको छ; दैनिक एजेन्ट लूपहरूको लागि सोनेट छिटो र सस्तो छ। हाइकु र फ्ल्यास-क्लास मोडेलहरू भोल्युम सबटास्कहरूको लागि उत्तम छन्।

के म मेरो आफ्नै मोडेल मात्र चलाउन सक्छु र क्लाउड एपीआईहरू ब्लक गर्न सक्छु?

इन्टरप्राइज कार्यस्थानहरूले आउटबाउन्ड मोडेल प्रदायकहरूलाई प्रतिबन्धित गर्न सक्छ र सबै एजेन्ट ट्राफिकलाई तपाईंको GPU अन्त्य बिन्दुमा रुट गर्न सक्छ। हाइब्रिड मोड अधिकांश टोलीहरूको लागि पूर्वनिर्धारित हो।

कुन GPU आकारहरू उपलब्ध छन्?

प्रस्तावहरू क्षेत्र र मागमा निर्भर हुन्छन्—सामान्यतया 24–80 GB VRAM टियरहरू 7B–70B वर्गका मोडेलहरू र ठूला स्ट्याकहरूको लागि बहु-GPU नोडहरू। हामी तपाईंको प्यारामिटर गणना र परिमाणीकरणबाट आकार VRAM मद्दत गर्छौं।

के निजी GPU प्रयोगले अझै पनि Digio टोकनहरू खपत गर्छ?

अर्केस्ट्रेशन (एजेन्टहरू, कार्यहरू, भण्डारण) तपाईंको योजनामा ​​रहन्छ। तपाईंको GPU मा अनुमानलाई GPU समयको रूपमा बिल गरिन्छ; तपाईले आन्तरिक चार्जब्याकको लागि वैकल्पिक रूपमा टोकन आकारको प्रयोग मिटर गर्न सक्नुहुन्छ।

व्यवस्थित मोडेलहरू छान्नुहोस् वा आफ्नो GPU ल्याउनुहोस्

आज क्लाउड र GPT मा सुरु गर्नुहोस्, त्यसपछि तपाईं आफू अनुकूल वजनहरू होस्ट गर्न तयार हुँदा समर्पित GPU थप्नुहोस् — उही एजेन्टहरू, समान कार्यहरू, तपाईंको अनुमान।