模型追踪

主流模型版本 / 价格 / 开源 / 基准结构化对比 · 共 10 个模型

只收录可核验的公开事实;查不到或未经官方来源确认的字段标注"待补核",超过 30 天未复核的数据就地打 ⚠ 示警。

总览对比

模型 厂商 最新版本 发布日期 参数规模 上下文 模态 状态 数据核验日期
GPT 系列 OpenAI GPT-5.6(Sol / Terra / Luna) 2026-07-09(全面开放;6 月 26 日起限量预览) 待补核 ⚠ 1M(最大输出 128K) 文本 / 图像 / 音频 在役 2026-07-24
Claude Anthropic Claude Opus 5(Claude Max 新默认;旗舰为 Fable 5) 2026-07-25(Opus 5) 待补核 ⚠ 200K(消费端)/ 500K(Enterprise 默认模型) 文本 / 图像 在役 2026-07-25
Gemini Google Gemini 3.1 Pro 2026-02 待补核 ⚠ 1M(最大输出 65,536) 文本 / 图像 / 音频 / 视频 在役 2026-07-24
DeepSeek V4 DeepSeek(深度求索) DeepSeek V4(V4-Pro / V4-Flash) 2026-04-24(权重上线 HuggingFace) V4-Pro:1.6T(MoE,激活 49B);V4-Flash:284B(激活 13B) 100 万 token 文本 在役 2026-07-24
Kimi K3 Moonshot AI(月之暗面) Kimi K3 2026-07-17 2.8T(Stable LatentMoE,896 个专家激活 16 个) 100 万 token(最大输出 1,048,576) 文本 / 图像 / 视频 在役 2026-07-27
Qwen(通义千问) 阿里巴巴 Qwen3.7-Max(最新快照 qwen3.7-max-2026-06-08) 2026-05-20(Qwen3.7 系列发布) 万亿级 MoE(媒体多源一致口径,官方未公布精确值) 256K(262,144 tokens,媒体口径) 文本 / 图像 在役 2026-07-24
GLM 智谱 AI GLM-5.2 待补核 ⚠ 待补核(GLM-4.6 为 355B 总参 / 32B 激活,官方文档口径) 1M(GLM-5.2,官方定价页口径) 文本 在役 2026-07-25
MiniMax M3 MiniMax(稀宇科技) MiniMax-M3 2026-06-12(权重开源) 428B 总参 / 23B 激活(MSA 稀疏注意力) 1M 文本 在役 2026-07-24
Llama Meta Llama 4(Scout / Maverick;Behemoth 未发布) 2025-04-05 Scout:109B 总参 / 17B 激活(16 专家);Maverick:400B 总参 / 17B 激活(128 专家);Behemoth:约 2T(288B 激活,未发布) 10M(Scout)/ 1M(Maverick) 文本 / 图像 在役 2026-07-24
Mistral Mistral AI Mistral Large 3 2025-12-02 675B 总参 / 41B 激活(细粒度 MoE,另含 2.5B 视觉编码器) 256K 文本 / 图像 在役 2026-07-24

数据核验日期逐行标注;更新机制:每日新闻联动 + 每周一巡检

价格对比

模型 国内价格 海外价格 币种与计费说明 数据核验日期
GPT 系列 国内无官方直接服务;企业可走 Azure OpenAI 渠道 Sol:$5/$30;Terra:$2.50/$15;Luna:$1/$6(每百万 token,输入/输出) 美元,OpenAI 官方 API 定价页口径 2026-07-24
Claude 国内无官方直接服务 Fable 5:$10/$50;Opus 4.8:$5/$25;Sonnet 5:$2/$10(2026-08-31 前推广价,之后 $3/$15);Haiku 4.5:$1/$5(每百万 token,输入/输出) 美元,Anthropic 官方定价页口径(2026-07-24 直连核验) 2026-07-25
Gemini 国内无官方直接服务 ≤200K 上下文:$2/$12;>200K:$4/$18(每百万 token,输入/输出;Batch 半价) 美元,Google AI 官方定价页口径 2026-07-24
DeepSeek V4 官方 API 国内可直接访问,价格同海外口径 V4-Pro:$0.435/$0.87;V4-Flash:$0.14/$0.28(每百万 token,输入/输出) 美元,DeepSeek 官方 API 文档口径 2026-07-24
Kimi K3 按量付费,输入区分缓存命中/未命中、输出统一单价,不按上下文档位分段;充值 ¥10 起解锁(赠送的 15 元代金券不可用于 K3);精确单价待补核(官方定价页动态加载,未能核到数值) 待补核 ⚠ 人民币,Kimi API 开放平台 2026-07-27
Qwen(通义千问) 阿里云百炼平台人民币计价,单价以官方定价页为准 待补核(Qwen3.7 海外定价未核验;旧值 Qwen3-Max $0.40/$1.20 已随版本退役) 海外美元 / 国内人民币 2026-07-24
GLM GLM-5.2:¥8/¥28;GLM-4.7:¥2–4/¥8–16(按输入/输出长度分档);GLM-4.7-Flash:免费(每百万 token,输入/输出) 待补核 ⚠ 人民币,智谱开放平台官方定价页(2026-07-24 直连核验) 2026-07-25
MiniMax M3 Token Plan 人民币订阅(Max 档 ¥119/月);API 人民币计价,单价以国内开放平台定价页为准 M3:$0.30/$1.20(每百万 token,输入/输出;输入超 512k token 后单价翻倍) 国内人民币 / 海外美元,两套平台独立计费 2026-07-24
Llama 国内无官方渠道,可通过第三方平台或自部署 权重免费自部署;第三方托管 API:Scout $0.20–$0.50,Maverick $0.85–$1.00(每百万 token) 美元,第三方托管平台口径,随平台浮动 2026-07-24
Mistral 国内无官方渠道 Mistral Large 3:$0.50/$1.50(每百万 token,输入/输出) 美元,Mistral 官方定价页口径 2026-07-24

数据核验日期逐行标注;更新机制:每日新闻联动 + 每周一巡检

开源与权重

模型 开源协议 GitHub HuggingFace 魔搭 国内可用性
GPT 系列 闭源 GitHub ↗ 国内不可直接访问(企业可通过 Azure OpenAI 渠道)
Claude 闭源 GitHub ↗ 国内不可直接访问
Gemini 闭源 GitHub ↗ 国内无法直接访问
DeepSeek V4 MIT GitHub ↗ HuggingFace ↗ 魔搭 ↗ 国内可直接使用
Kimi K3 待补核(官方预告 2026-07-27 经 Hugging Face 开放;截至当日时点已过权重仍未放出,许可证文本未公布) GitHub ↗ HuggingFace ↗ 魔搭 ↗ 国内可直接使用(kimi.com / Kimi API 开放平台)
Qwen(通义千问) 闭源(Qwen3 系列开源模型为 Apache 2.0) GitHub ↗ HuggingFace ↗ 魔搭 ↗ 国内可直接使用
GLM MIT(GLM-4.6V 模型卡口径) GitHub ↗ HuggingFace ↗ 魔搭 ↗ 国内可直接使用
MiniMax M3 自定义许可证(非标准开源协议,商用前需阅读仓库条款) GitHub ↗ HuggingFace ↗ 魔搭 ↗ 国内可直接使用(minimaxi.com)
Llama Llama 4 社区许可(商业使用受条款约束) GitHub ↗ HuggingFace ↗ 无官方国内服务,可自部署
Mistral Apache 2.0(Base 与 Instruct 权重均开源) HuggingFace ↗ 无官方国内服务

数据核验日期逐行标注;更新机制:每日新闻联动 + 每周一巡检

基准成绩

模型 AA Coding Agent IndexArtificial Analysis Intelligence IndexSWE-benchARC-AGI-2SWE-bench VerifiedArtificial Analysis 综合排名Artificial Analysis Intelligence Index(开源权重)HLESWE-bench ProMMLUPinch Bench 数据核验日期
GPT 系列 80(Sol,第三方评测 SOTA) ↗ 2026-07-24
Claude 61(总榜第 1,170 模型) ↗ 82%(Opus 4.5,收录评测口径) ↗ 2026-07-25
Gemini 77.1%(官方发布口径,第三方整理) ↗ 2026-07-24
DeepSeek V4 80.6%(V4-Pro-Max,第三方评测) ↗ 2026-07-24
Kimi K3 全球第 3(第三方评测,2026-07) ↗ 2026-07-27
Qwen(通义千问) 72.3%(发布会口径,媒体多源一致) ↗ 2026-07-24
GLM 51(开源权重第 1,94 个开源模型) ↗ 42.8%(GLM-4.7,较 GLM-4.6 提升 41%,第三方整理) ↗ 2026-07-25
MiniMax M3 59.0%(首个超越 GPT-5.5 58.6% 的开放权重模型,第三方评测) ↗ 2026-07-24
Llama 79.6(Scout,官方发布口径,第三方收录) ↗ 2026-07-24
Mistral 72.20(28/37,第三方收录) ↗ 2026-07-24

数据核验日期逐行标注;更新机制:每日新闻联动 + 每周一巡检;成绩链接直达来源

变更时间线

日期 模型 变更内容 来源
2026-07-27 Kimi K3 权重开放跳票核验:官方预告 2026-07-27 00:00 UTC 放出完整权重,截至当日 03:45 UTC(时点已过约 4 小时)HF moonshotai 组织无 K3 权重仓(仅倒计时占位页 moonshotai/Kimi-K3,"Waiting for the release")、魔搭搜索为零、官方博客措辞未更新、第三方托管 Baseten 仍标 COMING SOON;无官方延期公告,继续观察 来源 ↗
2026-07-25 Claude 来源 ↗
2026-07-25 GLM 来源 ↗
2026-07-24 GPT 系列 周巡检:latestVersion 去除"限量发布"标注;releaseDate 待补核→2026-07-09;context 待补核→1M(最大输出 128K);overseas 定价补齐 Sol/Terra/Luna 三档(官方定价页反爬未直连,数值经 Simon Willison 评测转述与第三方汇总双源一致,非官方一手核验) 来源 ↗
2026-07-24 Claude 周巡检(官方定价页直连核验):latestVersion Opus 4.5→Fable 5;pricing 旧值 Opus $5/$25→Fable 5 $10/$50 等全系四档;context "200K(Pro)/ 1M(Enterprise)"→"200K / 500K(Enterprise 默认模型)" 来源 ↗
2026-07-24 Gemini 周巡检:releaseDate 待补核→2026-02;context "2M(2.5 Pro 口径)"→1M(最大输出 65,536);overseas 定价 待补核→$2/$12 与 $4/$18 分档;补 ARC-AGI-2 77.1%(数值经多家第三方整理一致,官方定价页未直连核验) 来源 ↗
2026-07-24 DeepSeek V4 旧 API 别名 deepseek-chat / deepseek-reasoner 正式退役,全面切换 V4 家族 来源 ↗
2026-07-24 DeepSeek V4 周巡检:releaseDate 待补核→2026-04-24(权重上线 HF);openWeights.license 待补核→MIT(HF 四个仓库:V4-Pro / V4-Pro-Base / V4-Flash / V4-Flash-Base,hf-mirror 镜像确认组织存在,多源确认 MIT 协议) 来源 ↗
2026-07-24 Kimi K3 官方确认 K3 权重定档 2026-07-27 经 Hugging Face 完全开放 来源 ↗
2026-07-24 Kimi K3 周巡检(官方开发文档直连核验):releaseDate "2026-07"→2026-07-17(财新报道口径);modalities 补视频输入;计费模式确认为按量付费不分段、充值 ¥10 起解锁;精确单价官方定价页动态加载未核到,保留待补核(第三方流传的 ¥20/¥100 未经官方复核,不采用) 来源 ↗
2026-07-24 Qwen(通义千问) 站长指令纠偏:latestVersion Qwen3-Max→Qwen3.7-Max(2026-05-20 系列发布,06-08 快照增加视觉模态理解);params/context 改媒体多源口径并注明;海外定价与 LMArena 基准随旧版本退役(原值见 git 历史);新增 SWE-bench Verified 72.3% 来源 ↗
2026-07-24 Qwen(通义千问) 周巡检:releaseDate 待补核→2025-09-24;params 待补核→超 1 万亿;context 200K→256K;openWeights.license 明确为旗舰闭源 + Qwen3 系列 Apache 2.0;补 LMArena 文本榜第 3(发布事实经 36氪/智源等媒体报道一致,官方模型页未直连核验) 来源 ↗
2026-07-24 GLM 周巡检(官方定价页直连核验):latestVersion GLM-4.6→GLM-5.2(官方定价页旗舰新品);context 待补核→1M(GLM-5.2);domestic 定价旧值"¥1.0/千 token"(收录口径自相矛盾)弃用,改官方定价页口径;openWeights.url 改 zai-org(GLM-4.5V 等新权重所在组织,hf-mirror 确认存在);补 HLE 42.8%(GLM-4.7,第三方整理);GLM-5.2 发布日期与参数官方未公布,保留待补核 来源 ↗
2026-07-24 MiniMax M3 周巡检:releaseDate "2026-06"→2026-06-12(开源当日 vLLM 专用镜像发布,GPUStack 实测记录);links.huggingface 补 https://huggingface.co/MiniMaxAI(hf-mirror 镜像确认组织存在,vLLM Recipes 引用 MiniMaxAI/MiniMax-M3);补 SWE-bench Pro 59.0%(第三方评测) 来源 ↗
2026-07-24 Llama 周巡检:修正旧版错误——params 旧值"Scout 17B / Maverick 109B / Behemoth 405B"→官方口径 Scout 109B 总参/17B 激活、Maverick 400B 总参/17B 激活、Behemoth 约 2T(未发布);context "10M(Maverick)"→"10M(Scout)/ 1M(Maverick)";releaseDate 待补核→2025-04-05;补 MMLU 79.6(Scout) 来源 ↗
2026-07-24 Mistral 周巡检:latestVersion Large 2→Large 3(2025-12-02 发布);params/context/modalities 按官方发布口径补齐;overseas 定价旧值 Large 2 $2/$6→Large 3 $0.50/$1.50;openWeights.license 明确 Apache 2.0(Base+Instruct 均开源);github 链接经 GitCode 镜像核实未找到官方组织,保持 null 来源 ↗
2026-07-09 GPT 系列 GPT-5.6 全量上线,同步推出 ChatGPT Work 来源 ↗
2026-06-27 Claude 美国解除 Claude Mythos 5 封锁,面向 100+ 机构重新部署 来源 ↗
2026-06-26 GPT 系列 GPT-5.6 系列(Sol / Terra / Luna)限量发布 来源 ↗
2026-06 MiniMax M3 M3 权重开源,发布当日获 vLLM、NVIDIA、Fireworks 等十余家推理平台支持 来源 ↗

数据核验日期逐行标注;更新机制:每日新闻联动 + 每周一巡检