加载中...
avatar
文章
75
标签
61
分类
6
首页
归档
标签
分类
说说
友链
关于
搜索
我的博客【前沿】Skill 自进化机制:参数派 vs 非参派 返回首页
首页
归档
标签
分类
说说
友链
关于
搜索

【前沿】Skill 自进化机制:参数派 vs 非参派

发表于2026-08-14|更新于2026-08-25|前沿技术
|总字数:7|阅读时长:1分钟
文章作者: Moyon
文章链接: https://moyon.net.cn/2026/08/14/agent-tech-08-skill-self-evolution/
版权声明: 本博客所有文章除特别声明外,均采用 CC BY-NC-SA 4.0 许可协议。转载请注明来源 我的博客!
Skill自进化SkillOpt
请作者喝杯咖啡 ☕
  • 微信
    微信
  • 支付宝
    支付宝
cover of previous post
上一篇
【前沿】用户偏好系统
cover of next post
下一篇
【前沿】Agent Skill 体系:能力封装与渐进式披露
相关推荐
cover
2026-08-14
【前沿】自进化 Agent:技术路线全景
cover
2026-08-14
【前沿】自进化闭环工程:从自博弈 Demo 到生产落地
cover
2026-08-14
【前沿】Agent Skill 体系:能力封装与渐进式披露

评论
avatar
Moyon
记录代码、阅读与思考
文章
75
标签
61
分类
6
Follow Me
公告
This is my Blog
目录
  1. 1. 一、两条技术路线的分野
  2. 2. 二、非参进化的底层逻辑
  3. 3. 三、六套代表性方案
    1. 3.1. 参数派(2 套)
      1. 3.1.1. SkillRL:递归技能增强强化学习
      2. 3.1.2. MemSkill:记忆技能自进化
    2. 3.2. 非参派(4 套)
      1. 3.2.1. AutoSkill:无需训练的终身学习
      2. 3.2.2. SkillClaw:多用户交互驱动进化
      3. 3.2.3. SAGER:策略进化 ≠ 记忆进化 ⭐
      4. 3.2.4. SkillOpt:文本空间系统化优化器 ⭐ 当前 SOTA
  4. 4. 四、SkillOpt 五大核心机制详解
    1. 4.1. 机制 1:有界编辑(Edit Budget)= 文本学习率
    2. 4.2. 机制 2:验证门(Held-out Gate)= 防止过拟合
    3. 4.3. 机制 3:拒绝缓冲区(Rejected-Edit Buffer)= 负反馈记忆
    4. 4.4. 机制 4:慢更新(Slow / Meta Update)= 跨 Epoch 长程记忆
    5. 4.5. 机制 5:双模型分工
  5. 5. 五、完整执行流程
  6. 6. 六、六套方案对比总览
  7. 7. 七、从六套方案提炼的设计原则
最新文章
Hello World
Hello World2026-08-25
AI 日报 · 2026-08-25
AI 日报 · 2026-08-252026-08-25
AI 日报 · 2026-08-24
AI 日报 · 2026-08-242026-08-24
AI 日报 · 2026-08-23
AI 日报 · 2026-08-232026-08-23
AI 日报 · 2026-08-22
AI 日报 · 2026-08-222026-08-22
© 2026 By Moyon框架 Hexo 8.1.2|主题 Butterfly 5.7.0
×