加载中...
文章
75
标签
61
分类
6
首页
归档
标签
分类
说说
友链
关于
搜索
我的博客
【前沿】Harness Engineering:Agent 的操作系统
返回首页
首页
归档
标签
分类
说说
友链
关于
搜索
【前沿】Harness Engineering:Agent 的操作系统
发表于
2026-08-14
|
更新于
2026-08-25
|
前沿技术
|
总字数:
7
|
阅读时长:
1分钟
请输入密码
Decrypt
文章作者:
Moyon
文章链接:
https://moyon.net.cn/2026/08/14/agent-tech-02-harness-engineering/
版权声明:
本博客所有文章除特别声明外,均采用
CC BY-NC-SA 4.0
许可协议。转载请注明来源
我的博客
!
Harness
运行时
AgentOS
请作者喝杯咖啡 ☕
微信
支付宝
上一篇
【前沿】上下文工程:让模型在正确时间看到正确信息
下一篇
【前沿】多 Agent 编排架构:从单兵到层级协作
评论
Moyon
记录代码、阅读与思考
文章
75
标签
61
分类
6
Follow Me
公告
This is my Blog
目录
1.
一、马具隐喻
2.
二、概念演进:Prompt → Context → Harness
2.1.
第一层:Prompt Engineering(2022—2024)
2.2.
第二层:Context Engineering(2025)
2.3.
第三层:Harness Engineering(2026)
3.
三、为什么偏偏 2025 年底到 2026 年初爆发
3.1.
原因一:模型够强了,系统设计变成主要差异来源
3.2.
原因二:长任务暴露了裸模型的系统性缺陷
3.3.
原因三:串联步骤的可靠性数学
3.4.
原因四:模型趋于商品化
3.5.
概念的命名归因
4.
四、Lilian Weng 的理论框架:Harness 是部署系统
5.
五、头部公司的实践
5.1.
Anthropic:从双 Agent 到三 Agent
5.2.
Google DeepMind:Aletheia 的 Generator-Verifier-Reviser 循环
5.3.
OpenAI:百万行代码的 Codex 实验
5.4.
Vercel:砍掉 80% 工具反而更好
5.5.
Devin:6 个月 5 次完整重写
5.6.
Stripe:给 Agent 和人类工程师一样的环境
6.
六、成熟 Harness 的六大核心模块
6.1.
模块 1:上下文工程与知识管理
6.2.
模块 2:工具编排与权限设计
6.3.
模块 3:验证机制与硬约束
6.4.
模块 4:状态管理与记忆持续性
6.5.
模块 5:可观测性与反馈闭环
6.6.
模块 6:人类接管与生命周期管理
7.
七、Harness 的可撕裂性
8.
八、风险与局限
9.
九、新瓶装旧酒?还是真正的创新?
10.
十、总结与行动路径
11.
补充:运行时控制流与追踪
11.1.
ReAct 主循环 vs 三阶段模式
11.2.
编排原语:任务图控制流组合子
11.3.
span 树可观测
最新文章
Hello World
2026-08-25
AI 日报 · 2026-08-25
2026-08-25
AI 日报 · 2026-08-24
2026-08-24
AI 日报 · 2026-08-23
2026-08-23
AI 日报 · 2026-08-22
2026-08-22
×