2026-08-17
今天最重要的事是 DeepSeek 大幅涨价(缓存涨幅超 12 倍),直接冲击依赖其低价 API 的 coding 工具和 Token Plan。同时,开源模型 Qwen 3.8 27B 发布,本地可跑但默认 xhigh 推理设置导致严重的过度思考,需手动调整。如果你在用 DeepSeek 或 Qwen 做 coding agent,建议今天检查成本并更新配置;harness 架构的两条高质量推文也值得一读。
A · 深度观察
- Anthropic 平台负责人 Angela Jiang 澄清 harness 定义 — harness 是驱动模型的 loop,而非 application;一个应用可包含多个 harness,这是设计 agent 系统的核心心智模型。 · 来源
- Addy Osmani:云原生 harness 将取代低带宽终端 — 现有 agentic coding 终端和桌面应用带宽不足,云原生 harness 可跨设备、跨环境运行,是未来架构方向。 · 来源
- 宝玉分享 Pi 作者反共识:代码即真相,Bash 足够,MCP 常被高估 — Pi 作者认为 coding agent 不需要 RAG 或记忆系统,直接读代码即可;Bash 组合能力足以替代多数 MCP 场景,skill + 脚本更轻量。 · 来源
C · 产品动态
1. DeepSeek 大幅涨价,第三方 Token Plan 被迫调整
📌 发生了什么 — DeepSeek 在大幅涨价(缓存部分涨幅超过 12 倍,综合涨幅 3-6 倍)后,Cola Token Plan 已将 Flash 和 Lite 模型价格调整为原来约 3 倍,并计划推出新方案恢复智能和用量;OpenCode 团队正在测试多个托管方案,试图以接近原价提供 DeepSeek 服务,但称多数声称做到的服务商并未真正实现。
💬 讨论 — 开发者社区关注 DeepSeek 低价策略是否终结,第三方服务商面临成本压力。
🔗 来源 — Orange AI · Dax (OpenCode builder)
💡 Insight — 依赖 DeepSeek 低价的 coding agent 用户需要立即重新评估后端成本,考虑迁移至其他开源模型(如 Qwen)或接受涨价;OpenCode 的测试结果值得关注。
2. Qwen 3.8 27B 发布:默认 xhigh 推理导致严重 overthinking
📌 发生了什么 — Qwen 发布 Apache 2.0 许可的 27B 开源模型,支持视觉;Simon Willison 实测发现其默认 reasoning_effort 为 xhigh,在消费级设备(128GB M5 Max MacBook Pro 和 DGX Spark)上产生大量无意义的过度思考,严重影响效率和成本。建议用户手动将 reasoning_effort 设为 medium 或 low。
💬 讨论 — 社区关注该模型基准分数(自报超过 Qwen 3.6 27B 和 Qwen 3.7-Plus),但独立基准待验证;默认设置不合理可能影响第一印象。
🔗 来源 — Simon Willison
💡 Insight — 使用 Qwen 3.8 做本地 coding 时,必须显式设置 reasoning_effort 为 medium/low,否则 token 消耗和延迟将远超预期;这是模型默认参数与实际工作负载错配的典型案例。