模型比较 · 大语言模型
DeepSeek V4.1 Flash
阿里云 × 火山引擎 · 最近 24 小时的 API 体验
测试口径与边界
- 每小时一轮、约 30 秒。同一探测节点同时访问两家北京地域;各家并发为 1,最多 1 次预热 + 3 次重复请求,关闭思考模式,输出上限 128 Tokens。定时平台可能延迟,不补造缺失小时。
- TTFT:请求发出到首段非空正文到达的端到端时间,包含网络延迟;图表显示重复请求的中位数。
- TPOT:从首段到末段正文的时长 ÷(接口报告的输出 Tokens − 1),显示中位数。流式分块不等于逐 Token 到达,因此是平均间隔估算;单块响应不参与 TPOT 统计。
- 缓存命中率:重复请求中 Σ缓存命中输入 Tokens ÷ Σ输入 Tokens。使用相同长前缀、每小时更换前缀;不创建显式缓存。预热不计入三项指标,但计入调用消耗。缺少缓存用量字段显示未知,不视作 0%。
- 这是小样本、暖前缀场景的可用性拨测,不代表真实业务命中率、极限吞吐或 SLA。超时、失败和缺失样本会单独显示;使用服务别名或推理接入点时,实际版本须由厂商配置确认。
GITHUB · WEEKLY
查看 GitHub 周榜 ↗
发现正在增长的 AI 项目
从 GitHub Trending 周榜筛选 AI 项目,按本周新增 Star 排序。
正在加载周榜…
统计口径:新增 Star 直接引用 GitHub 的 “stars this week”,不是累计 Star,也不是全站 AI 项目排名。归档周按北京时间划分,同一周保留最新采集快照;不代表周一至周日的结算数据。首次采集前的历史周不补造。
| 一级分类 | 二级分类 | 业界产品命名 | 火山引擎 | 阿里云 | 腾讯云 | 华为云 | AWS | Azure | GCP | Oracle |
|---|
AI 云服务映射
| 分类 | 二级分类 | 产品 | 华为云 | AWS | 阿里云 | Azure | GCP | 腾讯云 | 火山引擎 |
|---|
Agent Platform 对比
| 对比维度 | AWS Bedrock AgentCore | 火山 AgentKit | 阿里 AgentScope |
|---|
仅比较开源大语言模型的价格与能力;模型榜单另行展示 Arena 收录的开放与闭源模型。
正在加载比价数据…
⚠️ 价格仅供参考,以各厂商官网为准。LLM 统一折算为「元/百万Tokens」;视频 wan3/混元按「元/秒」、Seedance 按官网 Token 计费;图片国内「元/张」,OpenAI 与 GCP 保留美元原价。汇率 1 USD ≈ 6.7088 CNY(2026-09-11)。