追 GPT 分数的时代结束,追 GPT 没做的场景开始。

智谱 GLM-5

GLM-5 在 C-EvalCMMLU 上反超 GPT-5 约 3 分,更重要的是上下文放到 2M,中文长文本场景已经具备压倒性成本优势。API 定价 $1.5 / $6 每百万,是 Sonnet 4.5 的一半。

Kimi Workspace

Kimi 月活突破 8000 万后,推出企业版 Workspace:打包文档、表格、PPT、会议纪要四件套,按席位计费。打法对标 Notion AI + Google Workspace,但深度集成微信生态。

MiniMax 海螺视频

海螺视频模型更新,10 秒 1080p 片段生成时间从 2 分钟压到 45 秒,首次进入实时预览可用区间。B 端 API 同步开放,定价 $0.12 / 秒。

选型矩阵

厂商强项价格区间最佳场景
智谱 GLM-5中文长文本中端中文知识库 / 客服
Kimi Workspace企业工具链按席位SaaS / 中后台
MiniMax 海螺视频生成按秒短视频 / 广告素材
DeepSeek V4开源 + 推理自部署私有化 / 成本敏感
Qwen 3 Max多模态 + 阿里云阿里云内电商 / 云上应用
口诀中文场景选国产,通用推理选海外。

中文客服 / 知识库

典型表现
海外模型中文语料不够
判断标准
中文 benchmark 领先且成本低
解决方向
GLM-5 主模型 + DeepSeek 兜底

企业 SaaS

典型表现
需要文档/表格/PPT 一体化
判断标准
不打算自研工具
解决方向
Kimi Workspace 直接采购

短视频素材

典型表现
人工拍摄成本高
判断标准
10s 片段 < 1 分钟生成
解决方向
海螺 API 批量调用

私有化部署

典型表现
数据不能出内网
判断标准
模型可自跑
解决方向
DeepSeek V4 / Qwen 3 Max 开源版

国产厂商停止追 GPT 分数,开始追 GPT 没做的场景。

— toy