Z-
z-ai

Z.ai: GLM 5.3 Flash

z-ai/glm-5.3-flash
فراخوانی ابزار
خروجی ساختاریافته
خروجی JSON
استدلال
خروجی تکرارپذیر (seed)
پنجره متن
۱٬۰۴۸٬۵۷۶ توکن
حداکثر خروجی
۱٬۰۴۸٬۵۷۶ توکن
قیمت ورودی
۶٬۰۰۰ تومان / ۱ میلیون توکن
قیمت خروجی
۹۰٬۰۰۰ تومان / ۱ میلیون توکن
تاریخ انتشار
۱۴۰۵/۶/۴
تعداد ارائه‌دهنده
۳۴
ورودی‌ها
متن، تصویر، ویدیو
خروجی‌ها
متن

جزئیات قیمت

Input Price۶٬۰۰۰تومان / ۱ میلیون توکن
Output Price۹۰٬۰۰۰تومان / ۱ میلیون توکن
Cache Read۳٬۰۰۰تومان / ۱ میلیون توکن

درباره مدل

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while reducing compute overhead.

قابلیت‌های مدل

ورودی‌های پشتیبانی‌شده
متن
تصویر
ویدیو
خروجی‌های پشتیبانی‌شده
متن
قابلیت‌ها
فراخوانی ابزار
خروجی ساختاریافته
خروجی JSON
استدلال
خروجی تکرارپذیر (seed)
معماری ورودی/خروجیtext,image,video->text
پارامترهای پشتیبانی‌شده
reasoninginclude_reasoningtemperaturemax_tokensstopseedresponse_formatstructured_outputstoolstool_choicetop_pfrequency_penaltypresence_penaltytop_kmin_plogit_biasrepetition_penalty

ارائه‌دهندگان (۳۴)

ارائه‌دهندهورودی (تومان / ۱M)خروجی (تومان / ۱M)پنجره متنحداکثر خروجیکوانتیزهوضعیت
OpenInference۶٬۰۰۰۹۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp4اختلال
Relace۷٬۵۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲—فعال
InferenceNet۱۳٬۵۰۰۴۲٬۰۰۰۱٬۰۴۸٬۵۷۶۱۲۸٬۰۰۰fp4فعال
Sail Research۱۳٬۵۰۰۱۸۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Sail Research۱۳٬۵۰۰۱۸۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
DeepInfra۲۲٬۵۰۰۷۵٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp4فعال
Novita۲۵٬۲۰۰۸۴٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
GMICloud۲۷٬۰۰۰۹۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp8فعال
AtlasCloud۳۴٬۶۵۰۱۱۵٬۵۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Decart۳۸٬۲۵۰۱۲۷٬۵۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp4فعال
StreamLake۳۸٬۲۵۰۱۲۷٬۵۰۰۱٬۰۲۴٬۰۰۰۱۲۸٬۰۰۰fp8فعال
Phala۳۸٬۲۵۰۱۲۷٬۵۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Near AI۳۹٬۶۰۰۱۳۲٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Io Net۴۱٬۴۰۰۱۳۸٬۰۰۰۲۶۲٬۱۴۴۶۵٬۵۳۶fp8فعال
Inceptron۴۵٬۰۰۰۱۳۵٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp8فعال
Modal۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸nvfp4فعال
BaseTen۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Crusoe۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp4فعال
CoreWeave۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸nvfp4فعال
Fireworks۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸—فعال
Friendli۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸—فعال
SiliconFlow۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۲۶۲٬۱۴۴fp8فعال
DigitalOcean۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸—فعال
Together۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۵۹۴۳٬۷۱۷—فعال
Reka۴۵٬۰۰۰۱۵۰٬۰۰۰۲۶۲٬۱۴۴۲۳۵٬۹۲۹—فعال
Parasail۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp8فعال
BaseTen۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Venice۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲—فعال
Z.AI۴۵٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۱۳۱٬۰۷۲fp8فعال
Morph۴۵٬۹۲۴۱۶۰٬۷۳۴۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸fp8فعال
NextBit۴۹٬۵۰۰۱۶۵٬۰۰۰۱٬۰۴۸٬۵۷۶۱۲۸٬۰۰۰fp8فعال
Fireworks۶۷٬۵۰۰۲۲۵٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸—فعال
Cloudflare۹۰٬۰۰۰۳۰۰٬۰۰۰۱٬۳۱۰٬۷۲۰۱٬۱۷۹٬۶۴۸—فعال
Wafer۳۰۰٬۰۰۰۱۵۰٬۰۰۰۱٬۰۴۸٬۵۷۶۹۴۳٬۷۱۸—فعال

استفاده از طریق API

این مدل را با همان کلید API هوشگر و از طریق نقطه پایانی سازگار با OpenAI فراخوانی کنید:

POST https://api.hooshgar.ir/v1/chat/completions
{
  "model": "z-ai/glm-5.3-flash",
  "messages": [
    {
      "role": "user",
      "content": "سلام"
    }
  ]
}
مستندات کامل API

مدل‌های مرتبط

اطلاعات مدل بر اساس داده‌های OpenRouter