DE
deepseek
DeepSeek: DeepSeek V4.1 Flash
deepseek/deepseek-v4.1-flashفراخوانی ابزار
استدلال
پنجره متن
۱٬۰۴۸٬۵۷۶ توکن
حداکثر خروجی
۱٬۰۴۸٬۵۷۶ توکن
قیمت ورودی
۶٬۰۰۰ تومان / ۱ میلیون توکن
قیمت خروجی
۱۸۰٬۰۰۰ تومان / ۱ میلیون توکن
تاریخ انتشار
۱۴۰۵/۶/۱۹
تعداد ارائهدهنده
۳۲
ورودیها
متن، تصویر
خروجیها
متن
جزئیات قیمت
Input Price۶٬۰۰۰تومان / ۱ میلیون توکن
Output Price۱۸۰٬۰۰۰تومان / ۱ میلیون توکن
Cache Read۶٬۰۰۰تومان / ۱ میلیون توکن
درباره مدل
DeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the first built on the company's Causal Encoder-Decoder (CED) architecture. It activates 8B parameters on input and 16B on output from a 552B-parameter backbone, an asymmetric split that keeps per-token compute low relative to the model's total size. Image understanding is native to the architecture, with visual and text embeddings trained jointly from the start of pre-training rather than added afterward as in the earlier experimental [V4 Flash Vision Exp](https://openrouter.ai/deepseek/deepseek-v4-flash-vision-exp).
It is suited for coding, terminal, and computer-use agents, along with long-horizon tasks that must run to completion across many steps and long-context analysis. Compressed KV caching cuts cache memory to roughly a quarter of the previous Flash generation, significantly reducing costs on agentic workloads. DeepSeek positions it as the cost-efficient tier of the V4.1 family and reports that it exceeds [V4 Pro](https://openrouter.ai/deepseek/deepseek-v4-pro-0813) on performance, speed, and task completion time.
قابلیتهای مدل
ورودیهای پشتیبانیشده
متن
تصویر
خروجیهای پشتیبانیشده
متن
قابلیتها
فراخوانی ابزار
استدلال
معماری ورودی/خروجیtext,image->text
پارامترهای پشتیبانیشده
reasoninginclude_reasoningtemperaturetop_ptop_kmin_pstopmax_tokenslogit_biasfrequency_penaltypresence_penaltyrepetition_penaltytoolstool_choiceارائهدهندگان (۳۲)
| ارائهدهنده | ورودی (تومان / ۱M) | خروجی (تومان / ۱M) | پنجره متن | حداکثر خروجی | کوانتیزه | وضعیت |
|---|---|---|---|---|---|---|
| Relace | ۶٬۰۰۰ | ۱۸۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| OpenInference | ۹٬۰۰۰ | ۱۵۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp4 | فعال |
| InferenceNet | ۲۰٬۷۰۰ | ۱۳۵٬۰۰۰ | ۱٬۰۴۰٬۰۰۰ | ۳۸۴٬۰۰۰ | — | فعال |
| Sail Research | ۲۴٬۰۰۰ | ۱۲۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۸۴٬۰۰۰ | fp4 | فعال |
| Morph | ۲۴٬۱۶۱ | ۱۵۳٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp8 | فعال |
| Wafer | ۳۰٬۰۰۰ | ۱۳۲٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| AtlasCloud | ۳۴٬۲۰۰ | ۱۳۶٬۸۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | fp8 | فعال |
| DekaLLM | ۳۶٬۰۰۰ | ۱۲۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| DeepInfra | ۴۲٬۰۰۰ | ۱۲۶٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۱۳۱٬۰۷۲ | fp8 | فعال |
| Ionstream | ۴۳٬۵۰۰ | ۳۴۵٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| Alibaba | ۴۵٬۰۰۰ | ۱۸۰٬۰۰۰ | ۱٬۰۰۰٬۰۰۰ | ۳۹۳٬۲۱۶ | — | فعال |
| DeepSeek | ۴۵٬۰۰۰ | ۱۸۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | — | فعال |
| StreamLake | ۴۹٬۵۰۰ | ۱۹۸٬۰۰۰ | ۱٬۰۲۴٬۰۰۰ | ۳۸۴٬۰۰۰ | fp8 | فعال |
| GMICloud | ۵۴٬۰۰۰ | ۲۱۶٬۰۰۰ | ۱٬۰۴۸٬۵۷۵ | ۹۴۳٬۷۱۷ | fp8 | فعال |
| Novita | ۵۸٬۵۰۰ | ۲۳۴٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | fp8 | فعال |
| CoreWeave | ۶۰٬۰۰۰ | ۱۹۵٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp8 | فعال |
| NextBit | ۶۳٬۰۰۰ | ۲۵۲٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp8 | فعال |
| Phala | ۶۳٬۰۰۰ | ۲۵۲٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| Fireworks | ۶۶٬۰۰۰ | ۱۹۸٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| Krea | ۶۷٬۵۰۰ | ۲۷۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp8 | فعال |
| Baidu | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | fp8 | فعال |
| BaseTen | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۲٬۷۶۸ | fp8 | فعال |
| Makora | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | fp8 | فعال |
| DigitalOcean | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| Together | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| SiliconFlow | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۹۳٬۲۱۶ | fp8 | فعال |
| Modal | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| BaseTen | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۲٬۷۶۸ | fp8 | فعال |
| Parasail | ۹۰٬۰۰۰ | ۳۶۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | fp8 | فعال |
| Venice | ۱۱۲٬۵۰۰ | ۴۵۰٬۰۰۰ | ۱٬۰۰۰٬۰۰۰ | ۱۳۱٬۰۷۲ | fp8 | فعال |
| Fireworks | ۱۳۵٬۰۰۰ | ۵۴۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۹۴۳٬۷۱۸ | — | فعال |
| BaseTen | ۱۸۰٬۰۰۰ | ۷۲۰٬۰۰۰ | ۱٬۰۴۸٬۵۷۶ | ۳۲٬۷۶۸ | fp32 | فعال |
استفاده از طریق API
این مدل را با همان کلید API هوشگر و از طریق نقطه پایانی سازگار با OpenAI فراخوانی کنید:
POST https://api.hooshgar.ir/v1/chat/completions{
"model": "deepseek/deepseek-v4.1-flash",
"messages": [
{
"role": "user",
"content": "سلام"
}
]
}مستندات کامل APIمدلهای مرتبط
DeepSeek: DeepSeek Pro Latest
~deepseek/deepseek-pro-latest
۱٬۰۴۸٬۵۷۶ توکن
DeepSeek: DeepSeek Flash Latest
~deepseek/deepseek-flash-latest
۱٬۰۴۸٬۵۷۶ توکن
DeepSeek: DeepSeek V4.1 Flash (batch)
deepseek/deepseek-v4.1-flash:batch
۱٬۰۴۸٬۵۷۶ توکن
DeepSeek: DeepSeek V4 Flash Vision Exp
deepseek/deepseek-v4-flash-vision-exp
۱٬۰۴۸٬۵۷۶ توکن
DeepSeek: DeepSeek V4 Pro 0813
deepseek/deepseek-v4-pro-0813
۱٬۰۴۸٬۵۷۶ توکن
DeepSeek: DeepSeek V4 Flash Latest
~deepseek/deepseek-v4-flash-latest
۱٬۰۴۸٬۵۷۶ توکن
اطلاعات مدل بر اساس دادههای OpenRouter
