模型比较 · 大语言模型
DeepSeek V4.1 Flash
阿里云 × 火山引擎 · 最近 24 小时的 API 体验
测试口径与边界
- 每小时一轮、约 30 秒,同一节点访问两家北京地域。每家并发 1,最多 1 次基准 + 3 次场景测量,每次约 8K 输入、上限 128 输出 Tokens,关闭思考。三场景为末段变化、中段变化和开头变化,按小时轮换顺序;不增加请求、不付费重试、不补造缺测。
- TTFT:请求发出到首段非空正文的端到端时间,包含网络延迟。TPOT:首段到末段正文时长 ÷(输出 Tokens − 1),是流式分块下的平均间隔估算。新口径每场景每小时只有一次观测,旧重复口径显示有效样本中位数。
- 缓存命中率:当前场景 API 返回的缓存输入 Tokens ÷ 输入 Tokens。正文共享比例不等于实际命中率;缺少缓存字段显示未知,不视作 0%。基准请求单独展示,不能保证绝对冷缓存。各场景与旧口径分开画图,不混合平均。
- 每小时更换测试标识;默认隐式缓存,不创建显式缓存,也不设置额外缓存路由参数。调用数量保持不变,但减少缓存命中可能增加实际费用。
- 这是合成文档问答与模板变化诊断,不代表真实业务流量、缓存 TTL、极限吞吐或 SLA;命中还受缓存就绪、淘汰与服务路由影响。超时、失败、未执行会单独显示;真实业务命中率需要代表性业务轨迹回放。
GITHUB · WEEKLY
查看 GitHub 周榜 ↗
发现正在增长的 AI 项目
从 GitHub Trending 周榜筛选 AI 项目,按本周新增 Star 排序。
正在加载周榜…
统计口径:新增 Star 直接引用 GitHub 的 “stars this week”,不是累计 Star,也不是全站 AI 项目排名。归档周按北京时间划分,同一周保留最新采集快照;不代表周一至周日的结算数据。首次采集前的历史周不补造。
| 一级分类 | 二级分类 | 业界产品命名 | 火山引擎 | 阿里云 | 腾讯云 | 华为云 | AWS | Azure | GCP | Oracle |
|---|
AI 云服务映射
| 分类 | 二级分类 | 产品 | 华为云 | AWS | 阿里云 | Azure | GCP | 腾讯云 | 火山引擎 |
|---|
Agent Platform 对比
| 对比维度 | AWS Bedrock AgentCore | 火山 AgentKit | 阿里 AgentScope |
|---|
仅比较开源大语言模型的价格与能力;模型榜单另行展示 Arena 收录的开放与闭源模型。
正在加载比价数据…
⚠️ 价格仅供参考,以各厂商官网为准。LLM 统一折算为「元/百万Tokens」;视频 wan3/混元按「元/秒」、Seedance 按官网 Token 计费;图片国内「元/张」,OpenAI 与 GCP 保留美元原价。汇率 1 USD ≈ 6.7088 CNY(2026-09-11)。