最近想做一个小收集:日常在使用 Claude Code、Codex 等 AI 工具的朋友们,有没有遇到过一些真实的使用问题,是你觉得如果能了解背后的一些模型训练原理/产品设计机制,会有帮助的?
比如我的:
同一个 skill、同个模型在不同 harness 上表现存在明显差异,应该怎样更好地约束?
为什么 agent 改 skill 时,常常把某个 badcase 补成一条很具体的新规则,最后规则越堆越乱?更好的对齐方案是什么?
有这个想法,是因为我之前看了一篇 Claude Code 产品负责人 Cat Wu 的访谈,她分享了一些自己在不同场景下使用 Claude Code / CoWork 的方法。这让我觉得,真正做模型、Agent 或 AI 产品的人,其实有很多隐性的使用经验。而如果我们也能有一些这样的认知,就能够更好地使用工具。
所以想先做一期问题收集。大家可以直接在评论区回复~ 我设想的是,有一部分问题可能通过大家互相分享经验就能得到直接的解决,剩下的问题我会再整理和找合适的人解答!
内容可以包括:
你在用什么工具 / agent?想让它完成什么任务?
它出现了什么让你困惑的行为?
你已经尝试过什么改法?
你更想知道背后的机制,还是想知道怎样优化?