加载中...
文章
75
标签
61
分类
6
首页
归档
标签
分类
说说
友链
关于
搜索
我的博客
【前沿】Skill 自进化机制:参数派 vs 非参派
返回首页
首页
归档
标签
分类
说说
友链
关于
搜索
【前沿】Skill 自进化机制:参数派 vs 非参派
发表于
2026-08-14
|
更新于
2026-08-25
|
前沿技术
|
总字数:
7
|
阅读时长:
1分钟
请输入密码
Decrypt
文章作者:
Moyon
文章链接:
https://moyon.net.cn/2026/08/14/agent-tech-08-skill-self-evolution/
版权声明:
本博客所有文章除特别声明外,均采用
CC BY-NC-SA 4.0
许可协议。转载请注明来源
我的博客
!
Skill
自进化
SkillOpt
请作者喝杯咖啡 ☕
微信
支付宝
上一篇
【前沿】用户偏好系统
下一篇
【前沿】Agent Skill 体系:能力封装与渐进式披露
相关推荐
2026-08-14
【前沿】自进化 Agent:技术路线全景
2026-08-14
【前沿】自进化闭环工程:从自博弈 Demo 到生产落地
2026-08-14
【前沿】Agent Skill 体系:能力封装与渐进式披露
评论
Moyon
记录代码、阅读与思考
文章
75
标签
61
分类
6
Follow Me
公告
This is my Blog
目录
1.
一、两条技术路线的分野
2.
二、非参进化的底层逻辑
3.
三、六套代表性方案
3.1.
参数派(2 套)
3.1.1.
SkillRL:递归技能增强强化学习
3.1.2.
MemSkill:记忆技能自进化
3.2.
非参派(4 套)
3.2.1.
AutoSkill:无需训练的终身学习
3.2.2.
SkillClaw:多用户交互驱动进化
3.2.3.
SAGER:策略进化 ≠ 记忆进化 ⭐
3.2.4.
SkillOpt:文本空间系统化优化器 ⭐ 当前 SOTA
4.
四、SkillOpt 五大核心机制详解
4.1.
机制 1:有界编辑(Edit Budget)= 文本学习率
4.2.
机制 2:验证门(Held-out Gate)= 防止过拟合
4.3.
机制 3:拒绝缓冲区(Rejected-Edit Buffer)= 负反馈记忆
4.4.
机制 4:慢更新(Slow / Meta Update)= 跨 Epoch 长程记忆
4.5.
机制 5:双模型分工
5.
五、完整执行流程
6.
六、六套方案对比总览
7.
七、从六套方案提炼的设计原则
最新文章
Hello World
2026-08-25
AI 日报 · 2026-08-25
2026-08-25
AI 日报 · 2026-08-24
2026-08-24
AI 日报 · 2026-08-23
2026-08-23
AI 日报 · 2026-08-22
2026-08-22
×