给中文改稿 agent 写验收标准,先检查它有没有改事实、编细节、加承诺,再判断它像不像人。 如果你正在做一个调用模型的写作产品,这三项比“请写得更自然”更容易测试,也更值得先做好。
用一条延期通知测试改稿
KKKKhazix/human-writing 关注的方向很实用:让通用创作与改稿更像一个具体的人在说话。这里借这个方向讨论验收方法,不代表 Kimss AI 已将该项目打包或集成。
先给模型一组明确的事实:
- 今天无法交付。
- 联调还没完成。
- 周五前更新进度。
- 新交付日期尚未确定。
套话版可能是:
因项目推进需要,交付时间将适当调整,感谢理解与支持。
这句话很顺,但读者最需要的信息几乎都不见了。
更有用的版本是:
今天交不了了,联调还没做完。抱歉让你白等。我会在周五前更新进度,但现在还不能承诺新的交付日期。
“像人说话”的关键,不是加口头禅,而是把事实、责任和不确定性说清楚。
把“自然一点”变成三个验收项
如果你要把改稿能力放进产品,就不能只靠读起来是否舒服来判断结果。
不改事实
“周五前更新进度”不等于“周五交付”。模型即使只改了几个字,也可能改变用户对期限的理解。
不造细节
已知联调未完成,但不知道为什么没完成。不要让模型补出“第三方接口故障”或“需求临时变更”,哪怕这些解释听起来很合理。
不加承诺
语气可以更直接,但不能擅自扩大责任和期限。“现在不能承诺新的交付日期”不能被润色成“我们保证下周完成”。
这三项可以作为第一版人工验收清单。流畅不是通过条件,守住输入中的事实边界才是。
先验证改稿,再搭 Agent 执行循环
对开发者、设计师、产品工程师和独立开发者来说,第一步通常只是把一条真实输入跑通。没必要在这个阶段花一个下午重搭大家都写过的 agent 执行循环。
Kimss Forge 是 MIT 开源的 agent harness,本地免费运行,不需要 Kimss 账号。 配合你自己的模型端点,先用少量代码验证改稿流程;它不是替你提供模型,也不会自动保证文案满足上面的验收条件。
安装:
pip install kimss-forge
先拿一条真实延期通知测试,而不是马上扩展成完整写作平台。每次改提示词或换模型,都重新检查那三个问题:事实变了吗?细节编了吗?承诺加了吗?
要接生产,再加网关
本地试验和生产控制是两件事。
没有生产网关时,Forge 在敏感工具触发时会给出 soft Authority Boundary 警告,但不会阻止本地运行。这个提示不是完整的 Authority Boundary 执行能力,也不能替代你的改稿验收。
需要给模型调用附带身份、接入 Kill Switch 时,在同一个 agent 上添加 gateway="kimss"。通过 Kimss 网关的流量可以使用 Developer 免费层的身份与 Kill Switch;Authority Boundary、SSO、SCIM 是后续付费能力,不需要为此重写 agent。
已有模型调用的接入位置
如果产品已经使用 OpenAI-compatible 客户端,生产接入的入口是模型调用的 base_url:
base_url = "https://api.kimss.ai"
这是端点配置的一行示意,不是完整鉴权示例;实际接入还需要相应的网关凭据与上游配置。你继续使用自己的模型服务和基础设施,Kimss 不托管模型,也不转售计算资源。
Kill Switch 的作用范围是经过 Kimss 网关的访问。 它不能终止一个从不调用网关的本地进程,更不能判断一条延期通知是否偷偷增加了承诺。
文案验收与运行控制,各管一层
- 改稿验收:检查事实、细节与承诺有没有越界。
- 本地 Forge:承接 agent 执行循环,让你先验证产品流程。
- 生产网关:为经过网关的模型调用提供身份与访问控制。
Kimss AI 的控制平面是生产模型调用的代理,不是聊天应用。Forge 是本地开源起点,也不是 Hermis 的开源版本。
下一步:运行 pip install kimss-forge,拿一条真实延期通知,按“不改事实、不造细节、不加承诺”验收一次改稿。 先证明这个流程值得放进产品,再给生产调用加上网关。
Top comments (0)