🔥 本周核心看点:智谱GLM-5.3-Flash发布追平Claude Opus 4.8(价格仅1/40)| 腾讯混元Hy4 Preview 770B开源 | OpenAI GPT-5.6 Sol更新+Luna成Free默认+o3退役 | Qwen3.8-Flash发布降价 | DeepSeek首个多模态视觉模型 | Anthropic MHS标准
🔴 重磅更新
1. 智谱GLM-5.3-Flash正式发布 🌟 本周最大新闻
8月26日,智谱正式上线并开源GLM-5.3-Flash(320B-A18B),GLM-5系列首个原生多模态模型。
- 性能追平旗舰:AA综合智能指数57分,与Claude Opus 4.8持平
- 极致低价:定价为GLM-5.3的1/10,限时1/20,Opus 4.8的1/40
- 国产芯片里程碑:全部由国产芯片集群承载,62T token实测
- 技术突破:首个稀疏注意力+线性注意力混合架构开源前沿模型
- 视觉融入Coding循环,支持前端/3D/Office全场景Agent
- 已开源至HuggingFace,开放API+GLM Coding Plan
2. 腾讯混元Hy4 Preview发布 NEW
8月28日,腾讯混元发布并开源新一代旗舰模型Hy4 Preview。
- 770B总参数MoE架构,支持1M上下文
- Terminal Bench 2.1与Claude Opus 5持平
- Apache 2.0协议开源,API定价极具竞争力
- 定位"为生产力而生",预览版暂不支持多模态
3. GPT-5.6 Sol重大更新 + Luna成Free默认 8/28
- Plus/Pro用户可用更新版GPT-5.6 Sol:事实更可靠、回答更聚焦、新增思考深度滑块
- GPT-5.6 Luna成为Free/Go默认模型,下周起无限文字聊天+Think按钮
- OpenAI o3正式退役(8/26),API暂不受影响
- GPT-5.6 Sol API促销降价超20%仍在进行(至11/21)
4. Qwen3.8-Flash发布并开源 8/26-27
- Qwen4架构首次预览:125B总参/6B激活,训练成本降至1/9
- 原生支持1M上下文,兼容OpenAI/Anthropic协议
- 阿里云降价(8/27):输入¥0.8/输出¥2.7每M(分别降20%/10%)
5. DeepSeek V4-Flash-Vision-Exp上线 8/25
- 首个V4视觉API,多模态Agent能力逼近Opus-4.8
- 纯文本能力与V4-Flash持平,价格同级别
- Files API同步上线(JPEG/PNG/GIF/WebP)
- 峰谷定价(8/17生效)运行中,V4 Pro闲时半价
🟡 重要动态
6. Anthropic Model Hardware Standard(8/27)
MHS预览版发布:定义AI Agent安全操作物理设备的共享规范,首批面向科研实验室和先进制造商开放。
7. Anthropic扩大科学家支持(8/25)
10,000个免费Claude订阅席位(1年),AI for Science扩展至更多领域,单项目最高$50,000额度。
8. Google Gemini持续扩展
- Canvas:Gemini内直接创建编辑文档和代码(8/26)
- Audio Overviews:AI播客生成集成到Gemini
- Gemini Enterprise for Legal(8/25):法律行业专用Agentic AI
- Gemini 3.7 Flash促销中:$0.75/M输入至年底
9. 字节跳动组织整合(8/24)
TRAE与扣子团队整合并入豆包,加速AI产品统一入口。
10. Kimi K3筹备港股IPO
月之暗面携K3洽谈美云巨头分成,投前估值315亿美元。
💰 本周价格变动
| 模型 | 价格 | 变动 |
| GLM-5.3-Flash | GLM-5.3的1/10,限时1/20 | NEW |
| Qwen3.8-Flash | ¥0.8/¥2.7 每M | ↓ 20%/10% |
| GPT-5.6 Sol(促销) | $4/$20 每M(至11/21) | 不变 |
| Gemini 3.7 Flash | $0.75/$3.75 每M(至年底) | 促销中 |
| DeepSeek V4-Flash-Vision | 同V4-Flash(峰谷制) | NEW |
| 混元Hy4 Preview | 极具竞争力(待公布) | NEW |
📌 本周趋势:开源军备赛升级 + 极致性价比 + 多模态全面覆盖
- 国产开源模型井喷:GLM-5.3-Flash + 混元Hy4 + Qwen3.8-Flash 三大模型同周发布,性能追平闭源旗舰,价格低至1/40
- 国产算力里程碑:GLM-5.3-Flash全部跑在国产芯片上,62T token实测验证
- OpenAI产品矩阵精简:o3退役,Luna下沉到免费用户,思考深度可调成标配
- 多模态成标配:GLM-5.3-Flash原生多模态,DeepSeek V4视觉上线
- 价格战持续:Qwen3.8-Flash再降价,GLM-5.3-Flash定价极低,API成本持续下探
← 返回云帆导航