DeepSeek
V4.1 Flash
适合作为高吞吐、低成本的通用与 Agent 主力:原生支持图像理解和 1M 上下文,并可在思考与非思考模式间切换,支持工具调用与 JSON 输出。相比更高档的 V4 Pro,定位更偏向速度、吞吐和成本效率,适合长文档、代码/Agent 及图文分析;需要更深推理时再开启思考模式。
- 推理
- 工具调用
- 结构化输出
- 长上下文
在控制台使用
deepseek-v4.1-flashUSD
价格
default
标准费率
输入$0.3/1M tokens补全价格$1.2/1M tokens
展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。
API
代码示例
curl --location --request POST 'https://api.tokenhot.cn/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
"model": "deepseek-v4.1-flash",
"messages": [
{
"role": "user",
"content": "What model are you"
}
]
}'DeepSeek
相关模型
FAQ
常见问题
V4.1 Flash 适合哪些场景?
V4.1 Flash 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。
V4.1 Flash 如何计费?
价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。
如何调用 V4.1 Flash?
使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。
开始使用