Zhipu AI
FP8
Function Calling
CN/EN

GLM-5.2-FP8

โมเดลพื้นฐานระดับองค์กรที่ให้บริการที่ FP8 — ปรับให้เหมาะสำหรับการสกัด JSON ที่มีโครงสร้าง throughput สูงและการเรียกใช้ฟังก์ชัน

หน้าต่างบริบท
1M
Modalities
Text
การให้เหตุผล
Yes
การมองเห็น
No
Throughput รวม
5M TPM
ราคา
$0.25 in · $0.80 out
# เรียกใช้โมเดลนี้บนคีย์ TATC เดียว model="glm-5-2-fp8"

เชื่อมต่อ GLM-5.2-FP8 ในไม่กี่นาที

คีย์ TATC เดียว Base URL เดียว — สลับ glm-5-2-fp8 ในฟิลด์โมเดลของไคลเอนต์ที่เข้ากันได้กับ OpenAI ใด ๆ

  • การบูรณาการ OpenAI/LangChain ที่ราบรื่น
  • บัญชีเดียว การเรียกเก็บเงินแบบรวมศูนย์
  • การหมุนเวียนคีย์ทันที & ขีดจำกัดการใช้จ่าย
from openai import OpenAI

client = OpenAI(
    base_url="https://api.tatc.cloud/v1",  # Unified API endpoint
    api_key="sk-xxxxxxxx",                 # One key for all supported models
)

# GLM-5.2-FP8
response = client.chat.completions.create(
    model="glm-5-2-fp8",                   # Easily switch to any model ID
    messages=[{"role": "user", "content": "Hello TATC"}],
)
ความสามารถของแพลตฟอร์ม

ทุกโมเดลมาพร้อมกับ แพลตฟอร์มเต็มรูปแบบ

เสาหลักหกประการที่ทำให้การใช้งานมัลติโมเดลเร็ว ปลอดภัย และตรวจสอบได้ — เหมือนกันสำหรับทุกโมเดลในแคตตาล็อก

เกตเวย์มัลติโมเดล

การเข้าถึงโมเดลพื้นฐานมัลติโมดัลชั้นนำแบบรวมศูนย์หลังจุดเชื่อมต่อเดียวที่เข้ากันได้กับ OpenAI สลับโมเดลต่อคำขอโดยไม่ต้องกำหนดค่าไคลเอนต์ใหม่

การกำหนดเส้นทางเวลาแฝงต่ำพิเศษ

การจัดการปริมาณการใช้แบบ edge-optimized พร้อมการปรับจูนกลุ่มต่อโมเดลและการตรวจสอบเวลาแฝง P95 ตลอด 24/7 ให้ Time-To-First-Token (TTFT) ที่เหมาะสมที่สุดสำหรับโหลดงานการผลิต

ความปลอดภัยและการปฏิบัติตามระดับองค์กร

การแยกคีย์ต่อผู้เช่า VPC peering การบันทึกการตรวจสอบระดับคำขอ และสถาปัตยกรรม zero-data-retention (ZDR) ที่สอดคล้องกับการคุ้มครองข้อมูลระหว่างประเทศและกรอบความเป็นส่วนตัวระดับภูมิภาค

การวิเคราะห์การใช้งานและ FinOps

แดชบอร์ดการใช้งานแบบละเอียดต่อโมเดลและต่อคีย์ติดตามโทเคน ต้นทุน เวลาแฝง และอัตราความสำเร็จ — ส่งออกได้เต็มรูปแบบสำหรับการคิดค่าใช้จ่ายคืนและ FinOps ระดับองค์กร

การจัดการคีย์ที่ยืดหยุ่น

ออกคีย์ API แบบจำกัดขอบเขตต่อทีม โครงการ หรือสภาพแวดล้อมพร้อมขีดจำกัดการใช้จ่ายแบบแข็ง ขีดจำกัด TPM และการหมุนเวียนทันที การส่งออกข้อมูลเต็มรูปแบบโดยไม่มีการล็อคอินแพลตฟอร์ม

ความเข้ากันได้กับ SDK สากล

ความเข้ากันได้แบบ drop-in กับ SDK มาตรฐาน OpenAI, LangChain และ LiteLLM เพียงชี้ base URL ของคุณไปที่เกตเวย์ของเราและรักษา codebase ไคลเอนต์ที่มีอยู่ของคุณไว้อย่างเต็มที่

ส่วนที่เหลือของแคตตาล็อก

สลับโมเดลโดยไม่ต้องสลับคีย์

โมเดลพื้นฐานชั้นนำบนจุดเชื่อมต่อเดียวกัน — คลิกเพื่อเปรียบเทียบ

OpenAI
GPT-OSS-120B
สถาปัตยกรรม MoE น้ำหนักเปิด 120B พร้อมการโฮสต์ภายในเวลาแฝงต่ำพิเศษและความยืดหยุ่นในการปรับใช้ Apache 2.0
$0.10 /1M Tokens128K ctx
Anthropic
Claude-Fable-5 ยอดนิยม
ตัวแทนการเขียนโค้ดและการให้เหตุผลระยะยาวระดับเรือธง — ประสิทธิภาพ SWE-bench ระดับแนวหน้าพร้อมการเรียกใช้เครื่องมือที่เสถียร
$10 /1M Tokens1M ctx
Google
Gemini 3.5 Flash ยอดนิยม
โมเดล Flash ประสิทธิภาพสูงล่าสุดของ Google ที่ได้รับการปรับให้เหมาะสำหรับตัวแทนและการเขียนโค้ด พร้อมการให้เหตุผลระดับ frontier และความเร็วที่รวดเร็ว
$0.15 /1M Tokens1M ctx
Moonshot AI
Kimi-K2.6
MoE ขนาดล้านล้านพารามิเตอร์ที่ปรับจูนสำหรับเวิร์กโฟลว์ตัวแทนอัตโนมัติและการเรียกใช้เครื่องมือหลายขั้นตอน
$0.40 /1M Tokens256K ctx
MiniMax
MiniMax-M2.7
LLM MoE 230B (ใช้งาน 10B) พร้อมหน้าต่าง 200K ขับเคลื่อนตัวแทนที่ซับซ้อนสำหรับงานซอฟต์แวร์และสำนักงาน ขับเคลื่อนการวิวัฒนาการตนเอง
$0.20 /1M Tokens200K ctx

เริ่มต้นด้วย GLM-5.2-FP8 วันนี้

พูดคุยกับทีมของเราเพื่อรับคีย์ Token API — หรือขอใบเสนอราคาสำหรับความจุเฉพาะสำหรับโหลดงานการผลิต