模型比较 · 大语言模型

DeepSeek V4.1 Flash

阿里云 × 火山引擎 · 最近 24 小时的 API 体验

测试口径与边界
  • 每小时一轮、约 30 秒,同一节点访问两家北京地域。每家并发 1,最多 1 次基准 + 3 次场景测量,每次约 8K 输入、上限 128 输出 Tokens,关闭思考。三场景为末段变化、中段变化和开头变化,按小时轮换顺序;不增加请求、不付费重试、不补造缺测。
  • TTFT:请求发出到首段非空正文的端到端时间,包含网络延迟。TPOT:首段到末段正文时长 ÷(输出 Tokens − 1),是流式分块下的平均间隔估算。新口径每场景每小时只有一次观测,旧重复口径显示有效样本中位数。
  • 缓存命中率:当前场景 API 返回的缓存输入 Tokens ÷ 输入 Tokens。正文共享比例不等于实际命中率;缺少缓存字段显示未知,不视作 0%。基准请求单独展示,不能保证绝对冷缓存。各场景与旧口径分开画图,不混合平均。
  • 每小时更换测试标识;默认隐式缓存,不创建显式缓存,也不设置额外缓存路由参数。调用数量保持不变,但减少缓存命中可能增加实际费用。
  • 这是合成文档问答与模板变化诊断,不代表真实业务流量、缓存 TTL、极限吞吐或 SLA;命中还受缓存就绪、淘汰与服务路由影响。超时、失败、未执行会单独显示;真实业务命中率需要代表性业务轨迹回放。
GITHUB · WEEKLY

发现正在增长的 AI 项目

从 GitHub Trending 周榜筛选 AI 项目,按本周新增 Star 排序。

查看 GitHub 周榜 ↗

正在加载周榜…

统计口径:新增 Star 直接引用 GitHub 的 “stars this week”,不是累计 Star,也不是全站 AI 项目排名。归档周按北京时间划分,同一周保留最新采集快照;不代表周一至周日的结算数据。首次采集前的历史周不补造。

一级分类 二级分类 业界产品命名 火山引擎 阿里云 腾讯云 华为云 AWS Azure GCP Oracle

AI 云服务映射

分类 二级分类 产品 华为云 AWS 阿里云 Azure GCP 腾讯云 火山引擎

Agent Platform 对比

对比维度 AWS Bedrock AgentCore 火山 AgentKit 阿里 AgentScope

仅比较开源大语言模型的价格与能力;模型榜单另行展示 Arena 收录的开放与闭源模型。

正在加载比价数据…

⚠️ 价格仅供参考,以各厂商官网为准。LLM 统一折算为「元/百万Tokens」;视频 wan3/混元按「元/秒」、Seedance 按官网 Token 计费;图片国内「元/张」,OpenAI 与 GCP 保留美元原价。汇率 1 USD ≈ 6.7088 CNY(2026-09-11)。