ESC
AI 1 分钟阅读

DeepSeek V4 Pro 0813正式发布:新一代MoE模型上线OpenRouter

DeepSeek V4 Pro 0813 是 DeepSeek 推出的大规模混合专家模型,也是 V4 Pro 的 GA 正式版本。该模型已在 OpenRouter 上线,由单一服务商托管,支持 1M token 上下文和文本输入输出,输入价格每百万 token 0.435 美元,输出价格每百万 token 0.87 美元。

来源:Hacker News

DeepSeek: DeepSeek V4 Pro 0813

比较[Playground]试用此模型

{"@context":“https://schema.org”,"@type":“SoftwareApplication”,“name”:“DeepSeek: DeepSeek V4 Pro 0813”,“applicationCategory”:“DeveloperApplication”,“operatingSystem”:“Any”,“url”:“https://openrouter.ai/deepseek/deepseek-v4-pro-0813","description":"DeepSeek V4 Pro 0813 是 DeepSeek 推出的大规模混合专家模型。这是 DeepSeek V4 Pro 的 GA 正式发布版本。”,“author”:{"@type":“Organization”,“name”:“deepseek”},“featureList”:[“1,048,576 token 上下文”,“输入模态:文本”,“输出模态:文本”,“输入价格:$0.435/M tokens”,“输出价格:$0.87/M tokens”,“缓存读取:$0.003625/M tokens”]}

$RC(“B:1”,“S:1”)

服务商定价性能运行时间基准测试应用动态常见问题

服务商

服务商

此模型由一家服务商托管。OpenRouter 将每个请求直接转发给它——无需进行路由决策。

定价

客户实际支付的平均价格,与各服务商公布的价格并列展示。缓存和折扣意味着实际支付价格通常远低于标价。

性能

吞吐量指模型生成文本的速度(每秒 token 数——越高越好)。延迟是总往返时间(越低越好)。TTFT 是首 token 时间——即到看到任何内容出现所需的时间(越低越好)。

运行时间

过去 30 天内成功请求的百分比。OpenRouter 会持续监控每个服务商,当某服务商返回错误时,会自动重试到下一个最佳服务商。

基准测试

标准化评估的得分。百分比越高越好——百分位排名显示了该模型在 OpenRouter 所有模型中的位置。

应用

向该模型发送流量最多的公共应用。这能很好地反映真实生产工作负载的情况——也暗示了该模型最适合哪些用例。