中文 AI 模型选型工作台
人工智能模型图鉴
按业务场景、能力约束和真实调用量筛选候选模型,再用价格、榜单与来源证据完成决策。
按你的工作量筛选候选模型
先应用上下文、模态和 API 能力等硬约束,再按当前场景的公开信号排序;缺失数据不会推算成高分。
候选模型 0
价格、能力与生命周期趋势
按来源独立快照记录价格、能力字段及上线/下线历史;单纯刷新时间不会制造动态。
DeepSeek V4 Flash 0423
输入价格:0.08232 → 0.07868;输出价格:0.16464 → 0.15736;缓存命中价格:0.016464 → 0.015736
DeepSeek V4 Pro 0423
输入价格:0.559062 → 0.417252;输出价格:1.118124 → 0.834504;缓存命中价格:0.0465885 → 0.034771
DeepSeek V4 Pro 0423
输入价格:0.741588 → 0.559062;输出价格:1.483176 → 1.118124;缓存命中价格:0.061799 → 0.0465885
olmo-3-32b-think
arena_text_style_control_overall:名次 260 → 260;成绩 1307 → 1307
K-EXAONE 2.0
artificial_analysis_agentic:名次 85 → 85;成绩 19.719797 → 19.719797
K-EXAONE 2.0
artificial_analysis_coding:名次 88 → 88;成绩 40.6237 → 40.6237
K-EXAONE 2.0
artificial_analysis_intelligence:名次 98 → 98;成绩 30.984544 → 30.984544
DeepSeek V4 Pro 0813
最大输出:943717 → 384000;输入价格:1.122 → 0.66;输出价格:3.366 → 1.98;缓存命中价格:0.0374 → 0.022
Gemini 3.7 Flash
输入价格:0.375 → 0.75;输出价格:1.875 → 3.75;缓存命中价格:0.0375 → 0.075;缓存写入价格:0.02083333 → 0.04166667;音频价格:0.375 → 0.75;图片输入价格:3.75e-07 → 7.5e-07;内部推理价格:1.875 → 3.75
KAT-Coder-Pro V2.5
上下文窗口:256000 → 262144;支持参数:logprobs、max_tokens、presence_penalty、response_format、stop、structured_outputs、temperature、tool_choice、tools、top_logprobs、top_p → frequency_penalty、logit_bias、logprobs、max_tokens、min_p、presence_penalty、repetition_penalty、response_format、seed、stop、structured_outputs、temperature、tool_choice、tools、top_k、top_logprobs、top_p
Nemotron 3 Ultra
上下文窗口:512288 → 262144;最大输出:461059 → 16384;输入价格:0.6 → 0.5;输出价格:3.6 → 2.2;缓存命中价格:0.2 → 0.1
GLM 5.3
上下文窗口:1048576 → 1310720;支持参数:include_reasoning、max_tokens、reasoning、reasoning_effort、response_format、temperature、tool_choice、tools、top_k、top_p → frequency_penalty、include_reasoning、logit_bias、logprobs、max_tokens、min_p、presence_penalty、reasoning、reasoning_effort、repetition_penalty、response_format、seed、stop、structured_outputs、temperature、tool_choice、tools、top_k、top_logprobs、top_p;Hugging Face:未提供 → zai-org/GLM-5.3
Google Gemini Flash Latest
输入价格:0.375 → 0.75;输出价格:1.875 → 3.75;缓存命中价格:0.0375 → 0.075;缓存写入价格:0.02083333 → 0.04166667;音频价格:0.375 → 0.75;图片输入价格:3.75e-07 → 7.5e-07;内部推理价格:1.875 → 3.75
GLM Latest
上下文窗口:1048576 → 1310720;支持参数:include_reasoning、max_tokens、reasoning、reasoning_effort、response_format、temperature、tool_choice、tools、top_k、top_p → frequency_penalty、include_reasoning、logit_bias、logprobs、max_tokens、min_p、presence_penalty、reasoning、reasoning_effort、repetition_penalty、response_format、seed、stop、structured_outputs、temperature、tool_choice、tools、top_k、top_logprobs、top_p;输入价格:1.4 → 1.25
当前筛选条件下暂无历史记录。
多源榜单,不混淆评价口径
同一模型在不同任务中可能排名悬殊。每张榜单保留原始指标与模型档位,分数不可跨榜单直接比较。
前沿模型观察
结论来自当前公开榜单与价格表现;预览版、推理档位和具体服务商实现会造成明显差异。
OpenRouter 全量模型目录
价格统一换算为美元 / 百万词元;目录由每日构建任务从接口完整同步,浏览器直接读取已通过质量门禁的静态快照。
| 模型 | 输入模态 → 输出模态 / 能力 | 上下文 | 输入 / 百万词元 | 输出 / 百万词元 | 收录日期 | 操作 |
|---|
数据口径与来源
模型价格和上下文会变动,榜单也可能更新模型版本。重要选型应回到原始测试说明与官方控制台复核。