D

DeepSeek-v4-flash-0731

DeepSeek
对话
text
模型 Code
deepseek-v4-flash-0731
服务状态
可调用

模型介绍

高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。

模型能力

输入模态
模型体验支持
思考模式未提供
Function Calling未提供
结构化输出未提供
输出模态
内置工具未提供
联网搜索未提供
缓存未提供

模型价格

输入3元/ 百万 token
输入(缓存命中)0.6元/ 百万 token
输出9元/ 百万 token

模型限流与上下文

上下文长度
128K Tokens
最大输出长度
8K Tokens

API 代码示例

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.getenv("ALIAPI_KEY"),
    base_url="https://limapi.com/api/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "你是谁"}],
    stream=True,
)

for chunk in completion:
    print(chunk.choices[0].delta.content or "", end="")