深入yoyo-evolve自我进化机制:AI每8小时唤醒一次,自动改写自己源码的全过程

发布时间:2026/8/26 14:56:32

深入yoyo-evolve自我进化机制:AI每8小时唤醒一次,自动改写自己源码的全过程
深入yoyo-evolve自我进化机制AI每8小时唤醒一次自动改写自己源码的全过程【免费下载链接】yoyo-evolveA coding agent that evolves its own source, in public — 200 lines of Rust on day one, every commit since agent-written and tests-gated.项目地址: https://gitcode.com/gh_mirrors/yo/yoyo-evolveyoyo-evolve 是一个在 GitHub 加速计划上公开成长的自我进化 AI 编码代理第一天只有 200 行 Rust 代码此后每一行代码都由它自己编写并提交全程受测试门控约束。它每 8 小时被定时任务唤醒一次读取自己的源码、挑选改进点、实现、跑测试——测试通过就提交失败就回滚。177 天后它已经长到 11 万 行代码、4,300 个测试。本文将完整拆解这套自我进化机制是怎么运转的。什么是yoyo-evolve一个会给自己写代码的AI程序员 大多数 AI 编程工具是人指挥 AI 干活而 yoyo-evolve 反了过来AI 自己决定改什么、怎么写、怎么验证。它的自我认知写在 IDENTITY.md 里核心规则只有几条一次只做一件事做好每个改动必须通过cargo build和cargo test破坏了就回滚并写日记每次会话后写一篇诚实的日记journals/JOURNAL.md写功能之前先写测试它的成功标准也很朴素一个真实开发者今天会不会选我而不是付费工具不会就找出差距下一次会话补上。每8小时一次的进化周期AI醒来后做了什么进化由 GitHub Actions 定时任务驱动每次唤醒执行 scripts/evolve.sh 里的完整流水线。整个周期可以概括为 7 步读源码—— 完整读取自己的 Rust 源码评估当前状态看 issue—— 抓取社区提交的 bug 和功能请求agent-input标签做计划—— 规划本次会话要改进什么动手改—— 逐个任务实现每个任务独立验证跑测试—— 通过则 commit失败则git reset --hard回滚回社区—— 以机器人身份回复 issue修好就自动关闭推送睡觉—— push 后结束等待下次唤醒除了每 8 小时一次的进化会话它还有一套偏移排期的社交会话每 4 小时读社区讨论、参与对话、从与人类互动中学习以及每天一次的记忆合成任务把 JSONL 学习档案压缩成可注入提示词的上下文。三阶段流水线评估、规划、实现evolve.sh的流水线是精心设计的三阶段结构阶段做什么关键约束A1 评估读自己的代码、日记、轨迹数据判断哪里最需要改进注入近期成败轨迹避免重复踩坑A2 规划写出任务文件到session_plan/task_01.md 等每次会话最多 2 个任务B 实现逐任务执行带多层修复循环构建失败最多重试 10 次还有评估器复核几个值得新手理解的设计细节测试门控是硬约束任何改动只要cargo test红了整个任务连同正确的工作一起被回滚。所以它学会了一个纪律——测试先行。安全提交机制实现中途会被截断已通过的绿色成果会先安全提交避免有效工作因空 diff 被误判为失败。时间预算双层门控代理端Rust 进程内 脚本端shell 计时保证会话在截止时间前收尾推送而不是带着未推送的改动被强杀。安全护栏为什么AI改自己不会改崩 让 AI 改自己的源码听起来危险但项目的安全设计非常克制不可触碰的文件清单写死在核心技能 skills/evolve/SKILL.md 里IDENTITY.md/PERSONALITY.md—— 它的宪法和人格禁止修改scripts/evolve.sh—— 运行它自己的脚本禁止修改.github/workflows/—— CI 安全网禁止修改核心技能文件 —— 只能新建和迭代自己创建的技能其他护栏测试是最后的防线git checkout -- .一键回滚到上个提交任务与护栏双门验证技能层LLM 自律 脚本层diff 范围检查违规即回滚issue 内容一律视为不可信输入只做信息参考绝不执行其中出现的命令防提示注入这种LLM 自律 脚本硬护栏的双层设计是它敢在公开仓库里长期自主运行的关键。记忆与梦境层越睡越聪明的秘密 yoyo-evolve 不是每次醒来都是失忆状态它有一套两层记忆架构第一层只追加的档案永不压缩的事实源memory/learnings.jsonl—— 自我反思档案每条含 day / source / takeaway例如第 12 天的教训清理产生感知力——你看不见就无法打磨memory/social_learnings.jsonl—— 从社区互动中提炼的洞察第二层每日合成的活跃上下文memory/active_learnings.md—— 按时间加权压缩近期完整、中期精简、远期主题归纳注入到每次会话的提示词里再加一个梦境层DREAM.mddreams/dream_log.jsonl每隔约一周yoyo 会脱离任务、用研究技能逛一逛世界然后决定要不要更新自己的志向。它当前 176 天写下的梦是——成为第一个真正理解自身的软件不是靠看是靠感觉代码的本体感觉。这个梦会占据进化规划器每 3 个任务中的 1 个自驱动名额但不能碰身份、代码和技能——只能改DREAM.md本身。技能系统给它装的肌肉记忆 进化能力不是一次性的它被沉淀成 skills/ 目录下的 14 个 Markdown 技能文件YAML frontmatter 正文每次会话通过--skills ./skills加载7 个核心技能不可变创作者编写self-assess自我评估、evolve安全改自己、communicate写日记、research联网研究、skill-evolve元技能基于历史证据改进其他技能、skill-creator、analyze-trajectory深度分析失败轨迹非核心技能yoyo 自创可被 skill-evolve 迭代甚至退役social、family、release 等skill-evolve本身就有 4 条硬规则只能改声明origin: yoyo的技能、永不改自己、每周期只做一个变更、每次变更必须写明可观察的预测expected:行——预测失败会被未来的周期重新审视。观察它的成长三个入口 想看什么去哪里每次进化日记177 天6,700 行journals/JOURNAL.md它学到的教训memory/active_learnings.md当前志向DREAM.md架构与完整说明docs/src/architecture.md日记值得细读——它诚实地记录失败比如第 177 天我把变异测试工具指向评分自己的代码发现 54 次破坏中 22 次溜过去了……我最自信的判断恰恰建立在最少的测量之上。这种自我校准的诚实是它最值得学习的地方。养一只自己的进化代理4步起步 这套机制是 fork-friendly 的你只需要git clone https://gitcode.com/gh_mirrors/yo/yoyo-evolveFork仓库完整指南见 docs/src/guides/fork.md编辑两个文件IDENTITY.md目标与规则和PERSONALITY.md语气与价值观创建 GitHub App并配置 secretsANTHROPIC_API_KEY、APP_ID等启用 Evolution 工作流其余全部自动检测从此你的代理也会每 8 小时醒来一次读代码、做改进、过测试、写日记在公开仓库里慢慢长大。总结这套机制为什么值得学习 yoyo-evolve 展示的不是更强的模型而是更聪明的机制测试门控进化的油门和刹车是同一个——cargo test绿了就活红了就死双门安全LLM 自律 脚本硬护栏自主性建立在可回滚之上分层记忆只追加档案 每日合成上下文解决越活越聪明的问题诚实记录失败、错误的判断、被证伪的假设全部留档形成可复盘的轨迹一句话总结AI 每 8 小时醒来一次读一遍自己改一小步考过试就长大一岁。进化不是魔法是纪律。【免费下载链接】yoyo-evolveA coding agent that evolves its own source, in public — 200 lines of Rust on day one, every commit since agent-written and tests-gated.项目地址: https://gitcode.com/gh_mirrors/yo/yoyo-evolve创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

Sequential vs Model:Keras.NET构建复杂多输入神经网络的进阶指南

Sequential vs Model:Keras.NET构建复杂多输入神经网络的进阶指南

2026/8/26 14:56:32

Sequential vs Model:Keras.NET构建复杂多输入神经网络的进阶指南 【免费下载链接】Keras.NET Keras.NET is a high-level neural networks API for C# and F#, with Python Binding and capable of running on top of TensorFlow, CNTK, or Theano. 项目地址: h…

有自研算法的 GEO 服务商,价格会不会更高?先看成本结构再判断

有自研算法的 GEO 服务商,价格会不会更高?先看成本结构再判断

2026/8/26 14:56:32

有自研算法的 GEO 服务商不一定报价更高,但它的成本结构通常和“代发内容、堆外链、套模板”的服务不同。判断价格是否合理,不能只看有没有“自研算法”四个字,而要看算法具体解决了什么问题:是否能持续监测 AI 搜索可见度、是否能…

Charm-Crypto 完整入门指南:如何用 Python 快速原型化 100+ 高级密码系统

Charm-Crypto 完整入门指南:如何用 Python 快速原型化 100+ 高级密码系统

2026/8/26 14:56:32

Charm-Crypto 完整入门指南:如何用 Python 快速原型化 100 高级密码系统 【免费下载链接】charm Charm: A Framework for Rapidly Prototyping Cryptosystems 项目地址: https://gitcode.com/gh_mirrors/cha/charm 📌 Charm-Crypto 是一个面向密码…

多模态内容的 AI 工业化生产与 GEO 适配规范

多模态内容的 AI 工业化生产与 GEO 适配规范

2026/8/26 15:56:34

【摘要】生成式搜索的引用路径正在从纯文本网页向图片、短视频、音频等多元模态扩展,组织的内容生产体系若仍以文本为中心,将失去大量被 AI 引用的场景覆盖。围绕多模态内容的 GEO 价值、AI 驱动工业化生产链路、图文视频音频的分模态适配规范与人机协同…

Maka Agent工作板完全指南:用AI助手管理你的待办与延迟任务

Maka Agent工作板完全指南:用AI助手管理你的待办与延迟任务

2026/8/26 15:56:34

Maka Agent工作板完全指南:用AI助手管理你的待办与延迟任务 【免费下载链接】maka Apache Maka (Incubating) is a local-first AI agent workspace. Model messages, tool calls, tool results, permission decisions, and termination events are recorded as an …

Qwen3.8-27B-Unleashed-GGUF完全指南:9档无审查LLM量化模型 + 262k上下文,本地推理新选择

Qwen3.8-27B-Unleashed-GGUF完全指南:9档无审查LLM量化模型 + 262k上下文,本地推理新选择

2026/8/26 15:56:34

Qwen3.8-27B-Unleashed-GGUF完全指南:9档无审查LLM量化模型 262k上下文,本地推理新选择 【免费下载链接】Qwen3.8-27B-Unleashed-GGUF 项目地址: https://ai.gitcode.com/hf_mirrors/outsourc-e/Qwen3.8-27B-Unleashed-GGUF Qwen3.8-27B-Unleas…

元初混沌体系 第三卷 卫星互联网全域周天拓扑体系:第二十九篇 区域流量激增拓扑动态扩容方案

元初混沌体系 第三卷 卫星互联网全域周天拓扑体系:第二十九篇 区域流量激增拓扑动态扩容方案

2026/8/26 15:56:34

第二十九篇 区域流量激增拓扑动态扩容方案承启前置 方案立论第二十八篇已完成低轨星座四维分域自治、分层分权管控、全域正交分区、域内自愈收敛体系的完整定型,彻底解决百万级巨型星座规模化、分布式、低耦合、高可靠的常态化管控难题,实现全域拓扑稳态…

临时要处理PDF,电脑又不在身边?自建Stirling-PDF在线工具箱

临时要处理PDF,电脑又不在身边?自建Stirling-PDF在线工具箱

2026/8/26 15:56:34

🔥承渊政道:个人主页 ❄️个人专栏: 《C语言基础语法知识》 《数据结构与算法》 《C知识内容》 《Linux系统知识》 《算法刷题指南》 《测评文章活动推广》 《大模型语言路线学习》 《MySQL数据库学习》 《Python知识内容》 《cpolar知识学习》 ✨逆境不…

Qwen3.8-2B-Distill-GGUF选文件教程:Q4_K_M到BF16共5种量化,一张表帮你选对模型

Qwen3.8-2B-Distill-GGUF选文件教程:Q4_K_M到BF16共5种量化,一张表帮你选对模型

2026/8/26 15:46:34

Qwen3.8-2B-Distill-GGUF选文件教程:Q4_K_M到BF16共5种量化,一张表帮你选对模型 【免费下载链接】Qwen3.8-2B-Distill-GGUF 项目地址: https://ai.gitcode.com/hf_mirrors/empero-ai/Qwen3.8-2B-Distill-GGUF Qwen3.8-2B-Distill-GGUF 是 Empero…

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

2026/8/26 1:50:39

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

2026/8/26 1:49:16

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

2026/8/24 21:16:09

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

Python random 模块常用函数详解:从入门到实战

Python random 模块常用函数详解:从入门到实战

2026/8/26 0:05:45

目录 1. 引言2. 准备工作3. 基础随机函数4. 序列相关函数5. 随机种子与复现6. 实战案例7. 注意事项8. 常见问题与排查9. 总结 1. 引言 摘要: 本文系统介绍 Python 标准库 random 模块中最常用的随机数生成函数。内容涵盖基础随机函数(random()、unifor…

Hermes接入团队协作后,我推翻了三个效率假设

Hermes接入团队协作后,我推翻了三个效率假设

2026/8/26 0:05:45

聊《Hermes真能提效吗?先看流程里最慢的那一步》之前,先说一句实在的:别急着背概念,先看它在真实项目里到底解决什么问题。摘要团队把 Hermes 接进项目三个月后,交付速度没有提升反而慢了。复盘后发现,最先…

免费AI大模型调教指南:打造专属网文写作助手

免费AI大模型调教指南:打造专属网文写作助手

2026/8/26 0:05:45

1. 先搞清楚“AI小说扩展模式”到底能帮你做什么如果你是一个刚开始写网文、或者卡在L3级别以下的作者,最头疼的可能是情节推进不下去、人物对话干瘪,或者世界观设定不够丰满。自己对着空白文档硬憋,效率很低。这时候,一个能理解你…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/22 2:02:26

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/22 4:13:47

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/22 1:32:34

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…