Daily Issue · 2026.08.14 · Friday

价格曲线与智能体轨道

DeepSeek 将于 8 月 17 日启用 API 峰谷计价,批处理与评测可考虑移至低价时段;新开源的 Harness 是开发者预览版,安装、兼容和故障回退仍待实测。本期另附央行政策基线、沪杭周末室内活动与三篇新论文。

今日判断

低价时段进入任务调度

DeepSeek 8 月 17 日起实行峰谷计价,非高峰费率为高峰的一半。可延迟任务因此多了一项明确的运行条件,实时请求则没有同样的迁移空间。

Harness 仍待工程验证

DeepSeek Harness 把工具、技能和沙箱等能力做成插件,并记录运行轨迹。当前只是开发者预览版;安装、兼容和故障回退能否稳定工作,还没有充分实测。

沪杭周末室内活动清单

本期收录上海、杭州各 4 场固定室内活动,覆盖剧场、音乐会与小型现场。表格按日期和开场时间排列,价格与退改限制直接列在行内。

自制主视觉:2026年8月14日价格曲线、智能体轨道、上海杭州文化活动与AI研究

宏观、金融与政策

央行二季度报告强调流动性调节的精度

中国人民银行 8 月 12 日发布《2026 年第二季度中国货币政策执行报告》。报告是观察下半年总量工具、结构性支持与市场利率传导的最新官方基线。

为什么重要:市场对短端资金面的判断不宜只看单日操作量。季度报告更适合用来区分临时对冲和政策方向变化。

来源:中国人民银行

中文互联网热点与讨论场

自制议题示意图:API峰谷时段定价与AI智能体测试护栏,不代表新闻机构报道或背书

DeepSeek 峰谷计价:模型账单开始服从时段

发生了什么

DeepSeek 官方定价页显示,API 将于北京时间 8 月 17 日零时起改用峰谷计价;高峰时段对应 UTC 01:00—04:00 与 06:00—10:00,其余时段按高峰费率的一半计费。争议集中在缓存命中价与 Pro 输出价的上调,以及工作时段恰好落入高峰。此次调整不只改了价格,也要求批处理和评测任务重新安排调用时段。

讨论场

官方页面给出时段和费率,是事实基线。知乎问题及回答主要围绕真实账单、缓存成本和替代模型讨论承受力。现有社区样本只能说明部分用户正在计算工作时段价格和任务迁移,不能外推为全行业结论。

近模型:峰谷负荷定价(原领域:电力经济学)

电力系统用时段价格把可转移负荷推离峰值。对应到 API,关键在于任务能否延后,以及低价时段是否还有足够容量。批处理和评测可以排队,交互式请求则接近刚性需求。这个机制解释了分时费率为何可能改变调用安排,却不证明迁移后一定更省钱。

远模型:昼夜节律相位调整(原领域:时间生物学)

生物体会把代谢与修复安排到不同相位;外部光照改变后,活动节律也要跟着调整。低价调用同样可能牵动团队时钟:任务移到夜间后若要等到次日验收,节省的模型费用可能换成等待时间。这个类比只用于检查协作成本,不用于判断费率是否合理。

模型边界

峰谷定价说明价格怎样分流请求;昼夜节律提醒人和系统未必能同步迁移。绝对价格是否合理,仍要看质量和真实账单。

下一组变量与验证点

先看低价时段的排队延迟与错误率。若节省的 token 费用被重试和人工等待抵消,迁移就没有价值;分时用量明细则决定成本能否准确核算。

来源:DeepSeek API 定价 · 知乎问题 · 知乎高赞回答

DeepSeek Harness:插件化的雄心先接受工程检验

发生了什么

DeepSeek 公开 Harness 开发者预览版与源码。模型、工具和沙箱等能力可以插件方式替换,系统还把模型看到的上下文与工具调用写入追加式日志。发布当天,中文社区并未一致叫好:首批反馈主要卡在安装体积和依赖问题,实际可用性仍待验证。

讨论场

官方页面证明插件结构、运行轨迹和预览状态。Hacker News 讨论把重点放在开源实现与同类框架比较;知乎回答集中提到安装慢和依赖重。36 氪把它放进 DeepSeek 新模型与 Agent 能力的商业叙述。社区反馈能标出开发者卡点,不能证明架构已经失败。

近模型:模块化系统的接口契约(原领域:软件架构)

插件化依赖稳定接口:模块可以替换,状态和错误语义却不能含糊。Harness 公开了插件边界与事件日志,这有利于组合和复现;接口一旦频繁变化,安装与升级成本也会随之放大。插件边界已经公开,可靠性还要看后续版本。

远模型:铁路联锁(原领域:交通信号工程)

铁路联锁允许列车切换线路,但道岔与区段占用必须互斥,否则灵活性会制造碰撞。插件像线路,权限与沙箱像信号,运行日志则接近调度记录。更多插件不会自动带来可靠性;更需要检查的是,插件出错后系统能否安全停止或回退。

模型边界

接口是否稳定,决定插件能否替换;权限冲突和故障回退,则要靠实际测试确认。几条安装抱怨也不足以概括所有使用场景。

下一组变量与验证点

检查最小安装体积、插件升级兼容测试和失败回退。若同一任务不能从轨迹稳定复现,所谓“可追溯”就只是保留日志;第三方插件数量和核心 API 的版本兼容性也要持续记录。

来源:DeepSeek Harness 官方页 · Hacker News 讨论 · 知乎问题 · 知乎开发者体验 · 36 氪

上海、杭州周末可以做什么

周五版覆盖 8 月 15 日至 16 日。以下均为固定时间、明确场地的室内活动,按日期与开场时间排列。

时间活动地点场地价格与退改来源提示
08/15 15:00Nicole Zuraitis 人声大师工作坊林肯爵士乐上海中心南京东路商圈室内坐席99 元除场地方取消外不退票退款秀动
08/15 19:30话剧《奥兰多》茉莉花剧场上海市区室内剧场80 元起平台票品原则上不退不换;取消或延期按通知处理秀动
08/15 19:30Cécile Corbel 与风同行二十周年上海站ENCORE 意空间见上海市区室内演出299 元起平台票品原则上不退不换;取消或延期按通知处理秀动
08/16 14:00扬琴与双排键奇幻之旅上海保利大剧院·小剧场嘉定区室内剧场30 元平台票品原则上不退不换;取消或延期按通知处理秀动

AI、科研与开发者工具

AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses

强模型不改弱模型参数,而是在推理时为它搭建代码化流程、路由和答案约束;论文报告目标模型平均表现从 0.49 提升到 0.91。

它把外围系统能否补强弱模型变成可测问题。后续要看这种提升能否在独立复现中保持。

来源:arXiv

VAKRA: Evaluating Multi-Hop Reasoning Across APIs and Retrieval Under Tool-Use Policies

VAKRA 用 62 个领域、超过 8000 个可执行 API 测试跨 API 与文档的多跳推理,并用真实调用重新验证答案。

现有评测常把工具调用和检索分开;它的可执行 API 与多跳任务可以补充这块缺口。

来源:arXiv

How Organizations Use AI: Evidence from ChatGPT

研究把企业账户、岗位和任务分类连接起来,分析 1500 多家组织与 1700 多万条消息,显示企业采用速度、岗位覆盖与用途差异很大。

这组组织级数据提供了企业采用情况的比较基线,也能校正开发者社区样本的偏差。

来源:arXiv

今天可以继续追的线索