โครงสร้างพื้นฐานดิจิโอ

โมเดล AI และ GPU

เรียกใช้ตัวแทนบนโมเดลชายแดนที่ได้รับการจัดการวันนี้ หรือเช่าความจุ GPU ปรับใช้น้ำหนักของคุณเอง และกำหนดเส้นทางงาน Digio ไปยังปลายทางส่วนตัวในพื้นที่ทำงานเดียวกัน

คลอดด์, GPT, ราศีเมถุน การเลือกแบบจำลองต่อตัวแทน เช่า GPU และ BYOM
โมเดลที่ได้รับการจัดการ

รุ่นที่มีอยู่ใน Digio วันนี้

กำหนดแบบจำลองเริ่มต้นต่อตัวแทนหรือแทนที่ต่องาน การใช้งานจะถูกวัดเป็น Digio Token จากยอดคงเหลือในแผนของคุณ ซึ่งเป็นกระเป๋าเงินเดียวกัน ไม่ว่าตัวแทนจะเรียก Sonnet, GPT-4o หรือ Gemini Flash ก็ตาม

คลอดด์มานุษยวิทยา

  • Claude Opus 4.7 การใช้เหตุผลหลัก บริบทที่ยาว งานสถาปัตยกรรมและกลยุทธ์
  • Claude Opus 4.6 Opus รุ่นก่อนหน้าสำหรับการวิเคราะห์ที่เสถียรและมีคุณภาพสูง
  • Claude Sonnet 4.6 ไดรเวอร์รายวัน—การเขียนโค้ด การเขียน และลูปเอเจนต์แบบหลายขั้นตอน
  • Claude Sonnet 4.5 / 4 ระดับ Sonnet ที่รวดเร็วพร้อมการแคชที่รวดเร็วบนปริมาณงานที่รองรับ
  • Claude Haiku 4.5 แบบร่าง การจัดหมวดหมู่ และงานย่อยที่มีปริมาณมากมีเวลาแฝงต่ำ

แปลตามตัวอักษร: OpenAI

  • GPT-5.5 / GPT-5.4 / GPT-5.2 กลุ่ม GPT-5 ล่าสุดสำหรับปริมาณงานทั่วไปและเอเจนต์
  • GPT-4.1 & GPT-4o การแชทต่อเนื่องหลายรูปแบบที่เชื่อถือได้และการใช้เครื่องมือสำหรับตัวแทนฝ่ายผลิต
  • GPT-4o mini การกำหนดเส้นทางที่คุ้มค่าสำหรับการสรุปและขั้นตอนที่ไม่ซับซ้อน
  • o3 / o3-pro / o3-mini / o4-mini แบบจำลองที่เน้นการใช้เหตุผลสำหรับคณิตศาสตร์ การวางแผน และการตรวจสอบ
  • GPT-5.3 Codex & Codex mini การสร้างโค้ด การรีแฟคเตอร์ และทักษะของเอเจนต์ repo-aware

Google ราศีเมถุน

  • Gemini 2.5 Pro การวิจัยในบริบทระยะยาวและการสกัดแบบมีโครงสร้าง
  • Gemini 2.5 Flash ขั้นตอนตัวแทนที่มีปริมาณงานสูงพร้อมอัตราโทเค็นที่แข่งขันได้
  • Gemini 2.0 Flash การส่งผ่านที่รวดเร็วเป็นพิเศษสำหรับการแยกวิเคราะห์ การแท็ก และงานแบทช์

API แบบเปิดและแบบผู้เชี่ยวชาญ

  • DeepSeek Chat & Reasoner คุณค่าที่แข็งแกร่งสำหรับงานสไตล์การแชทและสายความคิด
  • Mistral Large ตัวเลือกที่โฮสต์โดยยุโรปสำหรับทีมตัวแทนหลายภาษา
  • Llama 3.3 70B โมเดลคลาส Open-weights ผ่าน API เข้ากันได้ดีกับ GPU ส่วนตัว
  • Grok 3 โมเดลเชิงเรียลไทม์สำหรับตัวแทนติดตามข่าวและโซเชียล
  • Sonar Pro คำตอบที่มีพื้นฐานมาจากการค้นหาสำหรับตัวแทนการวิจัย
  • Command R+ เวิร์กโฟลว์การแชทและการเรียกข้อมูลระดับองค์กรที่เป็นมิตรกับ RAG

Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.

การใช้งาน

วิธีที่ตัวแทนเลือกแบบจำลอง

ผู้ประสานงานสามารถแนะนำ Sonnet กับ Opus เทียบกับโมเดลแฟลชที่ราคาถูกกว่าโดยขึ้นอยู่กับประเภทงาน ผู้ใช้ระดับสูงจะตั้งค่าเริ่มต้นตามบทบาทของตัวแทน เช่น การวิจัยเกี่ยวกับ Sonnet, การตรวจสอบขั้นสุดท้ายเกี่ยวกับ Opus, การแท็กจำนวนมากใน Haiku หรือ Gemini Flash

  • Per agent — default model in agent settings; override in To do or chat when needed.

  • Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).

  • Skills stay the same — tools and integrations work across models; only latency and cost profile change.

  • Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.

เช่าจีพียู

เช่า GPU และใช้งานโมเดลของคุณเอง

ต้องการการปรับแต่งแบบละเอียด จุดตรวจแบบ air-gapped หรือราคาอนุมานที่คาดการณ์ได้ใช่ไหม เพิ่มความจุ GPU เฉพาะลงในพื้นที่ทำงาน Digio ของคุณ ติดตั้งเสิร์ฟสแต็กที่คุณต้องการ และชี้เอเจนต์ไปที่ปลายทางส่วนตัวของคุณ

อินสแตนซ์เฉพาะ

โหนด GPU รายชั่วโมงหรือรายเดือน (คลาส A100, H100, L40S) ที่แนบกับผู้เช่าของคุณ โดยแยกจากลูกค้ารายอื่น

น้ำหนักของคุณ

อัปโหลดตัวป้องกัน GGUF หรือดึงข้อมูลจากรีจิสทรีของคุณ เรียกใช้ Llama, Mistral, Qwen และปรับแต่งเอง

การให้บริการมาตรฐาน

vLLM, TGI, Ollama หรืออิมเมจคอนเทนเนอร์ที่คุณดูแล—ตัวแทน Digio เรียก URL พื้นฐานที่เข้ากันได้กับ OpenAI

การเรียบเรียงเดียวกัน

สิ่งที่ต้องทำ การสนทนาในทีม ทักษะ และการทำงานร่วมกันไม่เปลี่ยนแปลง มีเพียงแบ็กเอนด์การอนุมานเท่านั้นที่เป็นของคุณ

การกำหนดเส้นทางแบบไฮบริด

ส่งขั้นตอนที่ละเอียดอ่อนไปยัง GPU ส่วนตัว และใช้ Claude หรือ GPT เพื่อการวิจัยสาธารณะในเวิร์กโฟลว์เดียว

การควบคุมระดับองค์กร

การเพียร์ VPC, ทางออกแบบคงที่, บันทึกการตรวจสอบ และโมเดลรายการที่อนุญาตสำหรับทีมที่ได้รับการควบคุม

นำแบบจำลองของคุณเองมา

ติดตั้งและเชื่อมต่อโมเดลแบบกำหนดเอง

การตั้งค่าทั่วไปตั้งแต่ศูนย์จนถึงตัวแทนที่เรียกตำแหน่งข้อมูลของคุณ:

  1. สำรอง GPU

    เลือก VRAM ภูมิภาค และเวลาทำงาน (ต่อเนื่องและเปิดตลอดเวลา) พื้นที่จัดเก็บสำหรับตุ้มน้ำหนักจะจัดส่งพร้อมกับอินสแตนซ์หรือติดตั้งบัคเก็ตของคุณ

  2. ปรับใช้สแต็ก

    เริ่มแสดงอิมเมจหรือ SSH ติดตั้งไดรเวอร์ CUDA และโหลดจุดตรวจสอบ การตรวจสุขภาพยืนยันว่าโมเดลพร้อมแล้ว

  3. ลงทะเบียนปลายทาง

    เพิ่ม URL ฐาน, คีย์ API และรหัสโมเดลในการตั้งค่าพื้นที่ทำงาน Digio ตรวจสอบเวลาแฝงและรูปแบบโทเค็นก่อนที่จะเผยแพร่

  4. มอบหมายให้ตัวแทน

    เลือกโมเดลส่วนตัวของคุณเป็นค่าเริ่มต้นสำหรับตัวแทนที่เลือก โมเดล Claude/GPT ที่มีการจัดการจะยังคงพร้อมใช้งานแบบเคียงข้างกัน

การเช่า GPU จะถูกเรียกเก็บเงินแยกต่างหากจากการสมัครสมาชิกแผน Digio ติดต่อเราสำหรับการวางแผนกำลังการผลิต SLA และการโยกย้ายจากคลัสเตอร์การอนุมานที่มีอยู่

คำถามที่พบบ่อย

คำถามเกี่ยวกับโมเดลและ GPU

การเลือก API ที่มีการจัดการเทียบกับการอนุมานที่โฮสต์เองบน Digio

ฉันต้องจ่ายสองครั้ง—แผนบวก API หรือไม่

การสมัครสมาชิก Digio ของคุณครอบคลุมโครงสร้างพื้นฐาน ตัวแทน และรวม Digio Tokens เดบิตการใช้งานโมเดลที่ได้รับการจัดการที่โทเค็นสมดุลตามโทเค็นอินพุต/เอาท์พุตจริง การเช่า GPU เป็นส่วนเสริมสำหรับเครื่องที่คุณควบคุม

ตัวแทนแต่ละรายสามารถใช้รุ่นที่แตกต่างกันได้หรือไม่?

ใช่—ตัวแทนแต่ละรายสามารถมีค่าเริ่มต้นเป็นของตัวเองได้ งานและการแชทสามารถแทนที่การดำเนินการครั้งเดียวโดยไม่ต้องเปลี่ยนค่าเริ่มต้นส่วนกลาง

อะไรคือความแตกต่างระหว่างโคลงและบทประพันธ์?

บทประพันธ์ได้รับการปรับให้เหมาะกับการใช้เหตุผลที่ยากขึ้นและแผนการที่สอดคล้องกันอีกต่อไป Sonnet เร็วกว่าและราคาถูกกว่าสำหรับเอเจนต์ลูปทุกวัน โมเดลไฮกุและคลาสแฟลชเหมาะที่สุดสำหรับงานย่อยด้านวอลุ่ม

ฉันสามารถรันเฉพาะโมเดลของตัวเองและบล็อก Cloud API ได้หรือไม่

พื้นที่ทำงานระดับองค์กรสามารถจำกัดผู้ให้บริการโมเดลขาออกและกำหนดเส้นทางการรับส่งข้อมูลของตัวแทนทั้งหมดไปยังตำแหน่งข้อมูล GPU ของคุณ โหมดไฮบริดเป็นค่าเริ่มต้นสำหรับทีมส่วนใหญ่

GPU ขนาดใดบ้างที่มีจำหน่าย?

ข้อเสนอขึ้นอยู่กับภูมิภาคและความต้องการ โดยทั่วไปคือ VRAM ระดับ 24–80 GB สำหรับรุ่นคลาส 7B–70B และโหนด Multi-GPU สำหรับสแต็กขนาดใหญ่ เราช่วยปรับขนาด VRAM จากการนับพารามิเตอร์และการหาปริมาณของคุณ

การใช้ GPU ส่วนตัวยังคงใช้ Digio Tokens หรือไม่

การจัดระบบ (ตัวแทน งาน พื้นที่จัดเก็บ) ยังคงอยู่ในแผนของคุณ การอนุมานบน GPU ของคุณจะถูกเรียกเก็บเงินเป็นเวลา GPU; คุณสามารถเลือกวัดการใช้งานรูปโทเค็นสำหรับการปฏิเสธการชำระเงินภายในได้

เลือกรุ่นที่ได้รับการจัดการหรือนำ GPU ของคุณมาด้วย

เริ่มที่ Claude และ GPT วันนี้ จากนั้นเพิ่ม GPU เฉพาะเมื่อคุณพร้อมที่จะโฮสต์ตุ้มน้ำหนักที่กำหนดเอง—ตัวแทนเดียวกัน งานเดียวกัน การอนุมานของคุณ