追 GPT 分数的时代结束,追 GPT 没做的场景开始。
智谱 GLM-5
GLM-5 在 C-Eval 和 CMMLU 上反超 GPT-5 约 3 分,更重要的是上下文放到 2M,中文长文本场景已经具备压倒性成本优势。API 定价 $1.5 / $6 每百万,是 Sonnet 4.5 的一半。
Kimi Workspace
Kimi 月活突破 8000 万后,推出企业版 Workspace:打包文档、表格、PPT、会议纪要四件套,按席位计费。打法对标 Notion AI + Google Workspace,但深度集成微信生态。
MiniMax 海螺视频
海螺视频模型更新,10 秒 1080p 片段生成时间从 2 分钟压到 45 秒,首次进入实时预览可用区间。B 端 API 同步开放,定价 $0.12 / 秒。
选型矩阵
| 厂商 | 强项 | 价格区间 | 最佳场景 |
|---|---|---|---|
| 智谱 GLM-5 | 中文长文本 | 中端 | 中文知识库 / 客服 |
| Kimi Workspace | 企业工具链 | 按席位 | SaaS / 中后台 |
| MiniMax 海螺 | 视频生成 | 按秒 | 短视频 / 广告素材 |
| DeepSeek V4 | 开源 + 推理 | 自部署 | 私有化 / 成本敏感 |
| Qwen 3 Max | 多模态 + 阿里云 | 阿里云内 | 电商 / 云上应用 |
口诀中文场景选国产,通用推理选海外。
中文客服 / 知识库
- 典型表现
- 海外模型中文语料不够
- 判断标准
- 中文 benchmark 领先且成本低
- 解决方向
- GLM-5 主模型 + DeepSeek 兜底
企业 SaaS
- 典型表现
- 需要文档/表格/PPT 一体化
- 判断标准
- 不打算自研工具
- 解决方向
- Kimi Workspace 直接采购
短视频素材
- 典型表现
- 人工拍摄成本高
- 判断标准
- 10s 片段 < 1 分钟生成
- 解决方向
- 海螺 API 批量调用
私有化部署
- 典型表现
- 数据不能出内网
- 判断标准
- 模型可自跑
- 解决方向
- DeepSeek V4 / Qwen 3 Max 开源版
国产厂商停止追 GPT 分数,开始追 GPT 没做的场景。
— toy