2026年8月 AI 模型终极对决:Claude Opus 5 凭什么登顶?GPT-5.6/Gemini 3.7 怎么选?
截至 2026-08-26。每月新模型都在出,本文聚焦"现在留学生能用、性价比最高的"那几款。
一、一句话结论
- 写论文/读 PDF/做长任务 → Claude Opus 5(Pro $20/mo 起,能力天花板最高)
- 日常作业/STEM/编程/性价比 → GPT-5.6 Terra(Plus $20/mo) 或 DeepSeek V4-Pro(API $0.14/M)
- 多模态作业/免费用 → Gemini 3.6/3.7 Flash(免费版 + Google AI Studio)
- AI 替代生活助理/Action 执行 → Manus 1.6 Lite 或 Claude Sonnet 5 Free
免费组合拳:ChatGPT Free (GPT-5.6 Luna) + Gemini Free (3.7 Flash) + Claude Sonnet 5 Free + DeepSeek V4 + Qwen 3.7 Max API(200 免费请求/天)。月支出 $0。
二、Claude Opus 5:为什么登顶?
7 月 24 日发布的 Opus 5 是 Anthropic 首次让一个模型同时霸榜三个独立榜单:
| 榜单 | Opus 5 分数 | 第二名 Artificial Analysis Intelligence Index | 61 | GPT-5.6 Sol(56) Agentic Index | 55.3 | GPT-5.6 Sol(54.0) LM Arena Agent (任务成功率) | 0.176 | Claude Fable 5(0.142) |
- 长任务不中断:Opus 5 能连续跑 30 小时不崩,对写论文、做多步研究、写代码 review 这种"一次给一坨活"的场景直接起飞
- PDF/论文阅读:1M 上下文可以一次性塞进 100 篇论文,提问时给你"跨论文对比"
- Cowork / Skills:8 月新增的虚拟助手生态,能在你 Excel/PowerPoint 里直接干活
- Claude.ai:Free(含 Sonnet 5) / Pro $20/mo(含 Opus 5) / Max $200/mo(5× Opus 5 配额)
- API:Opus 5 输入 $5/M、输出 $25/M(贵但比 Opus 4 降了 75%)
- 写硕士论文、博士开题、做 literature review → Pro $20/mo 值得
- 只写平时作业、应付 deadline → Plus $20 (GPT-5.6) 或 Sonnet 5 Free 够用
三、GPT-5.6 系列:分层清晰,免费版都好用
7 月 9 日 Sol 发布后,OpenAI 用了 4 周把整条产品线推到稳态:
| 版本 | ChatGPT 默认 | API 价格 (per M) | 适用 GPT-5.6 Luna | Free / Go $8 | $1 / $4 | 日常写作、低成本 GPT-5.6 Terra | Plus $20 | $5 / $25 | 编程、STEM、性价比 GPT-5.6 Sol | Pro $200 | $15 / $60 | 数学奥赛、研究 GPT-5.6-Cyber | API only | $3 / $12 | 编程专用 |
- Sign in with ChatGPT:OpenAI 测试第三方登录,未来可能成为新的 OAuth 协议
- App 生态:ChatGPT 已经有 220+ 应用(13 个类别),其中 85+ 是消费类(Expedia/Instacart/Zillow)
- 8 月 31 日:Sonnet 5 介绍期定价结束,API 输入从 $2 → $3(涨 50%),tokenizer 调整后实际可能涨 35%
四、Gemini 3.6/3.7 Flash:免费版的王者
Google 把"免费但能用"做到了极致:
- 3.6 Flash(7-21):输入 $1.50/M、输出 $7.50/M,1M 上下文
- 3.7 Flash(8-13):进一步强化 STEM,3.5 Flash-Lite(输入 $0.30/M)做超低延迟
- 免费版:Gemini App + AI Studio 都跑 3.6/3.7 Flash,留学生零成本就能用
- NotebookLM:把 50 个来源(PDF/网页/YouTube 字幕)做成 AI 笔记 + 思维导图 + 音频总结 → 写 literature review 神器
- Nano Banana:Google 自家图像生成,跟 ChatGPT 的 Sora 对位
- Personal Intelligence(1 月):让 Gemini 直接读你的 Gmail / 相簿 / YouTube 历史(要主动开启)
五、其他不能忽略的玩家
- DeepSeek V4-Pro-0813(8-13):API $0.14/M(MIT 许可证),SWE Marathon #1,API 性价比之王
- Qwen3.8-Max(8-3):2.4T 参数,WAIC 上承诺开放权重,但 8 月底还没放出 HuggingFace 仓库
- Qwen3.8-27B(8-14):开源 27B,可以本地跑
- GLM-5.3(8-14):智谱 AI,国产 Claude 替代
- Kimi K3(7-21):Moonshot,128k 上下文
- Grok 4.6(8-11):xAI,免费版有但限制多
- Muse Spark 1.2 / Muse Glimmer(8-10):Meta,多模态
- kimi-k2.5 / moonshot-v1 系列(8k/32k/128k/auto) → 必须迁到 kimi-k3
六、不同身份的留学生怎么选?
本科生(预算紧、作业多): 1. ChatGPT Free (GPT-5.6 Luna) — 日常 2. Gemini Free (3.7 Flash) — 多模态 3. Claude Sonnet 5 Free — 长 PDF 阅读 4. DeepSeek V4 API — 编程 硕士生(写论文为主): 1. Claude Pro $20/mo — Opus 5 长任务 + PDF 3. ChatGPT Plus $20/mo — Terra STEM 4. NotebookLM 免费 — 文献综述 博士生 / 研究者: 1. Claude Max $200/mo — Opus 5 不限量 2. ChatGPT Pro $200/mo — GPT-5.6 Sol 3. Qwen3.8 API — 等开放权重后本地跑 预算为零:- 全部用免费组合,输出质量可以接受 90% 场景
七、避坑提醒
- 不要同时订阅 3 套付费:Opus 5 + GPT-5.6 + Gemini 3 Pro 每月 $240,学生用不上
- 看清订阅层级:Plus ≠ Pro,Pro 是 $200/mo 不是 $20
- 8 月 31 日后 Sonnaet 5 API 涨价:如果是 project 用 API 来跑论文批量处理,预算要提前留
- WAIC 8 月底还有 Qwen3.8-Max 发布会:如果它真放出开源权重,本地跑 7B/27B 模型就完全 free
八、写在最后
AI 模型现在最大的问题不是"哪个最强",而是"哪个最适合你的场景"。免费组合已经能覆盖 80% 日常需求,剩下的 20%(写论文 / 做研究 / 写代码 review)才需要付费。
别被排行榜绑架 —— 你写一篇 essay 不需要 Intelligence Index 61 分,需要的是语法对、引用准、不被 AIGC 检测抓。
问题:你现在订阅了哪个 AI 模型?够用吗?欢迎评论区聊。