ডিজিও অবকাঠামো

এআই মডেল এবং জিপিইউ

আজই পরিচালিত ফ্রন্টিয়ার মডেলগুলিতে এজেন্ট চালান—অথবা GPU ক্ষমতা ভাড়া করুন, আপনার নিজের ওজন স্থাপন করুন এবং একই ওয়ার্কস্পেসে ব্যক্তিগত এন্ডপয়েন্টে ডিজিও কাজগুলিকে রুট করুন।

ক্লদ, জিপিটি, মিথুন প্রতি-এজেন্ট মডেল বাছাই GPU ভাড়া এবং BYOM
পরিচালিত মডেল

ডিজিওতে মডেলগুলি আজ উপলব্ধ

প্রতি এজেন্ট বা টাস্ক প্রতি ওভাররাইড প্রতি একটি ডিফল্ট মডেল বরাদ্দ করুন। আপনার প্ল্যান ব্যালেন্স থেকে ডিজিও টোকেন-এ ব্যবহার পরিমাপ করা হয়—এজেন্ট সনেট, GPT-4o, বা জেমিনি ফ্ল্যাশ বলে ডাকুক না কেন একই ওয়ালেট।

নৃতাত্ত্বিক ক্লদ

  • Claude Opus 4.7 ফ্ল্যাগশিপ যুক্তি, দীর্ঘ প্রসঙ্গ, স্থাপত্য এবং কৌশল কাজ.
  • Claude Opus 4.6 স্থিতিশীল, উচ্চ-মানের বিশ্লেষণের জন্য পূর্ববর্তী প্রজন্মের ওপাস।
  • Claude Sonnet 4.6 দৈনিক ড্রাইভার—কোডিং, লেখা, এবং মাল্টি-স্টেপ এজেন্ট লুপ।
  • Claude Sonnet 4.5 / 4 সমর্থিত কাজের চাপে প্রম্পট ক্যাশিং সহ দ্রুত সনেট স্তর।
  • Claude Haiku 4.5 কম লেটেন্সি ড্রাফ্ট, শ্রেণীবিভাগ, এবং উচ্চ-ভলিউম সাবটাস্ক।

B2B SaaS ওয়েবসাইট UI লেবেল। প্রাকৃতিক bn-এ অনুবাদ করুন: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 সাধারণ এবং এজেন্টিক কাজের চাপের জন্য সর্বশেষ GPT-5 পরিবার।
  • GPT-4.1 & GPT-4o উত্পাদন এজেন্টদের জন্য নির্ভরযোগ্য মাল্টিমডাল চ্যাট এবং টুল ব্যবহার।
  • GPT-4o mini সারাংশ এবং হালকা পদক্ষেপের জন্য খরচ-দক্ষ রাউটিং।
  • o3 / o3-pro / o3-mini / o4-mini গণিত, পরিকল্পনা এবং যাচাইকরণের জন্য যুক্তি-কেন্দ্রিক মডেল।
  • GPT-5.3 Codex & Codex mini কোড জেনারেশন, রিফ্যাক্টর এবং রেপো-সচেতন এজেন্ট দক্ষতা।

গুগল মিথুন

  • Gemini 2.5 Pro দীর্ঘ-প্রসঙ্গ গবেষণা এবং কাঠামোগত নিষ্কাশন।
  • Gemini 2.5 Flash প্রতিযোগিতামূলক টোকেন হার সহ উচ্চ-থ্রুপুট এজেন্ট পদক্ষেপ।
  • Gemini 2.0 Flash পার্সিং, ট্যাগিং এবং ব্যাচ কাজের জন্য অতি দ্রুত পাস।

খুলুন এবং বিশেষজ্ঞ APIs

  • DeepSeek Chat & Reasoner চ্যাট এবং চেইন-অফ-থট স্টাইলের কাজের জন্য শক্তিশালী মান।
  • Mistral Large বহুভাষিক এজেন্ট দলের জন্য ইউরোপীয়-হোস্টেড বিকল্প।
  • Llama 3.3 70B এপিআই-এর মাধ্যমে ওপেন-ওয়েট ক্লাস মডেল—প্রাইভেট জিপিইউ-এর সাথে ভালোভাবে যুক্ত।
  • Grok 3 সংবাদ এবং সামাজিক পর্যবেক্ষণ এজেন্টদের জন্য রিয়েল-টাইম ভিত্তিক মডেল।
  • Sonar Pro গবেষণা এজেন্টদের জন্য অনুসন্ধান ভিত্তিক উত্তর.
  • Command R+ RAG-বন্ধুত্বপূর্ণ এন্টারপ্রাইজ চ্যাট এবং পুনরুদ্ধার কর্মপ্রবাহ।

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

ব্যবহার

কিভাবে এজেন্ট একটি মডেল বাছাই

সমন্বয়কারী টাস্ক টাইপের উপর ভিত্তি করে সনেট বনাম ওপাস বনাম একটি সস্তা ফ্ল্যাশ মডেলের সুপারিশ করতে পারেন। শক্তি ব্যবহারকারীরা এজেন্ট ভূমিকার প্রতি ডিফল্ট সেট করে — সনেটের উপর গবেষণা, ওপাসের চূড়ান্ত পর্যালোচনা, হাইকু বা জেমিনি ফ্ল্যাশে বাল্ক ট্যাগিং।

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

GPU ভাড়া

GPU ভাড়া করুন এবং আপনার নিজস্ব মডেল চালান

একটি ফাইন-টিউন, একটি এয়ার-গ্যাপড চেকপয়েন্ট, বা অনুমানযোগ্য অনুমান মূল্যের প্রয়োজন? আপনার ডিজিও ওয়ার্কস্পেসে ডেডিকেটেড GPU ক্ষমতা যোগ করুন, আপনার পছন্দের সার্ভিং স্ট্যাক ইনস্টল করুন এবং আপনার ব্যক্তিগত এন্ডপয়েন্টে পয়েন্ট এজেন্ট করুন।

উত্সর্গীকৃত উদাহরণ

প্রতি ঘণ্টায় বা মাসিক GPU নোড (A100, H100, L40S ক্লাস) আপনার ভাড়াটে-অন্যান্য গ্রাহকদের থেকে বিচ্ছিন্ন।

আপনার ওজন

সেফটেনসর, GGUF আপলোড করুন বা আপনার রেজিস্ট্রি থেকে টানুন; Llama, Mistral, Qwen, এবং কাস্টম ফাইন-টিউন চালান।

স্ট্যান্ডার্ড পরিবেশন

vLLM, TGI, Ollama, বা আপনার রক্ষণাবেক্ষণ করা কন্টেইনার ছবি—Digio এজেন্টরা একটি OpenAI- সামঞ্জস্যপূর্ণ বেস URL কল করে।

একই অর্কেস্ট্রেশন

করতে, টিম চ্যাট, দক্ষতা এবং সহযোগিতা অপরিবর্তিত—শুধুমাত্র অনুমান ব্যাকএন্ড আপনার।

হাইব্রিড রাউটিং

ব্যক্তিগত GPU-তে সংবেদনশীল পদক্ষেপগুলি পাঠান এবং একটি ওয়ার্কফ্লোতে পাবলিক গবেষণার জন্য Claude বা GPT ব্যবহার করুন।

এন্টারপ্রাইজ নিয়ন্ত্রণ

নিয়ন্ত্রিত দলগুলির জন্য VPC পিয়ারিং, স্ট্যাটিক এগ্রেস, অডিট লগ এবং মডেল অনুমোদিত তালিকা।

আপনার নিজের মডেল আনুন

একটি কাস্টম মডেল ইনস্টল করুন এবং সংযোগ করুন

আপনার এন্ডপয়েন্টে কল করার জন্য শূন্য থেকে এজেন্টদের সাধারণ সেটআপ:

  1. রিজার্ভ GPU

    VRAM, অঞ্চল এবং আপটাইম চয়ন করুন (বার্স্ট বনাম সর্বদা চালু)। দৃষ্টান্ত সহ ওজন জাহাজের জন্য সঞ্চয়স্থান বা আপনার বালতি মাউন্ট.

  2. স্ট্যাক স্থাপন

    একটি পরিবেশন চিত্র বা SSH ইন শুরু করুন, CUDA ড্রাইভার ইনস্টল করুন এবং চেকপয়েন্ট লোড করুন। স্বাস্থ্য পরীক্ষা নিশ্চিত করে যে মডেলটি প্রস্তুত।

  3. এন্ডপয়েন্ট নিবন্ধন করুন

    ওয়ার্কস্পেস সেটিংসে বেস URL, API কী এবং মডেল আইডি যোগ করুন। Digio লাইভে যাওয়ার আগে লেটেন্সি এবং টোকেন ফরম্যাট যাচাই করে।

  4. এজেন্টদের বরাদ্দ করুন

    নির্বাচিত এজেন্টদের জন্য ডিফল্ট হিসাবে আপনার ব্যক্তিগত মডেল বেছে নিন; পরিচালিত Claude/GPT মডেল পাশাপাশি উপলব্ধ থাকে।

ডিজিও প্ল্যান সাবস্ক্রিপশন থেকে GPU ভাড়া আলাদাভাবে বিল করা হয়। একটি বিদ্যমান অনুমান ক্লাস্টার থেকে ক্ষমতা পরিকল্পনা, SLA এবং স্থানান্তরের জন্য আমাদের সাথে যোগাযোগ করুন।

B2B SaaS ওয়েবসাইট UI লেবেল। প্রাকৃতিক bn-এ অনুবাদ করুন: FAQ

মডেল এবং GPU প্রশ্ন

ডিজিওতে পরিচালিত API বনাম স্ব-হোস্টেড অনুমান নির্বাচন করা।

আমি কি দ্বিগুণ অর্থ প্রদান করব—প্ল্যান প্লাস এপিআই?

আপনার ডিজিও সদস্যতা অবকাঠামো, এজেন্ট এবং ডিজিও টোকেন অন্তর্ভুক্ত করে। পরিচালিত মডেল ব্যবহার ডেবিট যা প্রকৃত ইনপুট/আউটপুট টোকেন দ্বারা টোকেন ব্যালেন্স। আপনার নিয়ন্ত্রণ করা মেশিনগুলির জন্য GPU ভাড়া একটি অ্যাড-অন।

বিভিন্ন এজেন্ট বিভিন্ন মডেল ব্যবহার করতে পারেন?

হ্যাঁ—প্রতিটি এজেন্টের নিজস্ব ডিফল্ট থাকতে পারে। টাস্ক এবং চ্যাট গ্লোবাল ডিফল্ট পরিবর্তন না করে একক রানের জন্য ওভাররাইড করতে পারে।

সনেট এবং ওপাসের মধ্যে পার্থক্য কী?

ওপাস কঠিন যুক্তি এবং দীর্ঘ সুসংগত পরিকল্পনার জন্য সুর করা হয়; দৈনন্দিন এজেন্ট লুপের জন্য সনেট দ্রুত এবং সস্তা। হাইকু এবং ফ্ল্যাশ-ক্লাস মডেলগুলি ভলিউম সাবটাস্কের জন্য সেরা।

আমি কি শুধুমাত্র আমার নিজস্ব মডেল চালাতে পারি এবং ক্লাউড API গুলিকে ব্লক করতে পারি?

এন্টারপ্রাইজ ওয়ার্কস্পেসগুলি আউটবাউন্ড মডেল সরবরাহকারীদের সীমাবদ্ধ করতে পারে এবং সমস্ত এজেন্ট ট্র্যাফিককে আপনার GPU এন্ডপয়েন্টে রুট করতে পারে। হাইব্রিড মোড বেশিরভাগ দলের জন্য ডিফল্ট।

কোন GPU মাপ পাওয়া যায়?

অফারগুলি অঞ্চল এবং চাহিদার উপর নির্ভর করে—সাধারণত 7B–70B শ্রেণীর মডেলের জন্য 24-80 GB VRAM স্তর এবং বড় স্ট্যাকের জন্য মাল্টি-GPU নোড। আমরা আপনার প্যারামিটার গণনা এবং পরিমাপকরণ থেকে VRAM আকারে সাহায্য করি।

ব্যক্তিগত GPU ব্যবহার কি এখনও ডিজিও টোকেন ব্যবহার করে?

অর্কেস্ট্রেশন (এজেন্ট, কাজ, স্টোরেজ) আপনার পরিকল্পনায় থাকে। আপনার GPU তে অনুমান GPU সময় হিসাবে বিল করা হয়; অভ্যন্তরীণ চার্জব্যাকের জন্য আপনি ঐচ্ছিকভাবে টোকেন-আকৃতির ব্যবহার মিটার করতে পারেন।

পরিচালিত মডেল চয়ন করুন বা আপনার GPU আনুন

আজই Claude এবং GPT-এ শুরু করুন, তারপরে যখন আপনি কাস্টম ওজন হোস্ট করতে প্রস্তুত হন তখন ডেডিকেটেড GPU যোগ করুন—একই এজেন্ট, একই কাজ, আপনার অনুমান।