Cómo crear Loops en Fable 5 如何在 Fable 5 中创建循环
DEJA DE HACER PROMPTS. EMPIEZA A DISEÑAR LOOPS. 停止编写提示词。开始设计循环。
Anthropic acaba de publicar cómo trabajan internamente con Fable 5. Anthropic刚刚公布了他们内部如何使用Fable 5进行工作的方式。
Y la conclusión es clara: **el prompt ha muerto como unidad de trabajo.**结论很明确:作为工作单元的“提示词”已经过时了。
Lo nuevo se llama Loop Engineering.新的方法叫做循环工程(Loop Engineering)。
Te explico qué es, cómo funciona y cómo montarte uno hoy mismo 我来解释一下这是什么、如何运作,以及如何今天就搭建一个属于自己的循环工程。
EL PROBLEMA: TÚ ERES EL LOOP 问题:你自己就是循环
Así hemos trabajado con agentes los últimos dos años: 过去两年我们一直这样使用智能代理:
→ Escribes un prompt → El agente responde → Tú revisas → Tú corriges → Tú vuelves a escribir otro prompt →你写提示→智能代理回应→你检查→你修正→你再次写下另一个提示
¿Ves el patrón? El cuello de botella eres tú. 看出模式了吗?瓶颈就在你自己。
Cada iteración pasa por tus manos. El agente no aprende nada entre intentos. Y tu tiempo se va en revisar trabajo a medias. 每一次迭代都要经过你的手。代理在尝试之间学不到任何东西。而你的时间都花在了检查半成品上。
Un prompt le da instrucciones al agente. Un loop le da un trabajo. 一个提示给了代理指令。而一个循环给了它任务。
QUÉ ES UN LOOP (EXPLICADO FÁCIL) 什么是循环(简单解释版)
Un loop es un ciclo de feedback que el agente repite solo hasta cumplir un objetivo verificable. 循环是一种反馈机制,代理会自行重复运行,直到完成一个可验证的目标。
Todos los loops, simples o complejos, pasan por las mismas 5 etapas: 所有循环,无论简单还是复杂,都经历相同的五个阶段:
DESCUBRIR → PLANIFICAR → EJECUTAR → VERIFICAR → ITERAR 发现 → 规划 → 执行 → 验证 → 迭代
Si pasa la verificación: termina. Si falla: vuelve a empezar con el feedback del fallo. 若通过验证:结束。若未通过:根据失败反馈重新开始。
La clave está en la palabra “verificable”. No es “haz una landing bonita”. Es “todos los tests de /auth pasan y el lint está limpio”. 关键在于「可验证」这个词。不是「做一个漂亮的着陆页」,而是「所有/auth测试通过且代码检查无误」。
El agente sabe exactamente cuándo ha terminado. Y tú no estás en medio. 代理程序精确知晓任务何时完成。而你,尚未置身其中。
POR QUÉ FABLE 5 CAMBIA EL JUEGO 为何Fable 5颠覆了游戏规则
Aquí viene lo interesante. Anthropic probó Fable 5 contra Opus 4.7 en un reto real: Parameter Golf. 有趣之处在于:Anthropic在一次真实挑战——参数高尔夫(Parameter Golf)中,将Fable 5与Opus 4.7进行了对比测试。
El reto: entrenar el mejor modelo posible que quepa en 16MB, en menos de 10 minutos, sobre 8 GPUs H100. 挑战内容:在8块H100 GPU上,于10分钟内,训练出一个能适配16MB存储空间的最佳模型。
El agente tenía que editar el código de entrenamiento, lanzar el training, leer los logs, ver el score y decidir el siguiente experimento. Durante 8 horas. Solo. 该代理需要编辑训练代码、启动训练、读取日志、查看评分并决定下一个实验。连续8小时,独自一人。
Resultado: 结果:
→ Fable 5 mejoró el pipeline ~6 veces más que Opus 4.7 → Fable 5 对管线的改进幅度约为 Opus 4.7 的 6 倍
Pero lo importante no es el número. Es el CÓMO: 但重要的不是数字本身,而是如何实现的——
→ Opus 4.7 encontró una pequeña mejora al principio y repitió la misma plantilla 20 veces: tocar un parámetro, medir, quedarse con lo que sume → Fable 5 apostó por cambios estructurales grandes (arquitectura, no constantes) y aguantó una regresión de cuantización que acabó siendo su mayor victoria → Opus 4.7 在开始时发现了一个小改进,然后重复了同一套模板 20 次:调整一个参数、测量、保留有效结果 → Fable 5 则选择了结构性大变革(架构层面,而非常量层面),并承受了一次量化回退——而这最终成了它最大的胜利
Fable 5 no solo itera. Asume riesgos y se recupera de los fallos dentro del propio loop. Fable 5 不只是迭代。它敢于承担风险,并在循环内部自我修复。
LA REGLA DE ORO: EL QUE HACE NO ES EL QUE JUZGA 黄金法则:执行者不充当评判者
Este es el detalle que casi todo el mundo se salta. 这是几乎所有人都会忽略的关键细节。
Los modelos son malos criticando su propio trabajo. Son demasiado buenos consigo mismos. Es como corregir tu propio examen. 模型在评价自身工作时表现不佳。它们对自己太过宽容,就像自己批改自己的考卷。
La solución de Anthropic: un subagente verificador independiente, con su propio contexto, que decide si el trabajo cumple o no.Anthropic的解决方案:一个独立的验证子代理,拥有自己的上下文,由它来判断工作是否合格。
En la práctica tienes dos formas de montarlo: 实际操作中有两种搭建方式:
→ /goal en Claude Code: defines una condición medible y un modelo independiente decide si se cumplió. Si no, arranca el siguiente turno solo → Outcomes en Claude Managed Agents: defines una rúbrica con criterios evaluables y un subagente la corrige en cada iteración→ Claude Code中的/goal指令:设定一个可衡量的条件,由独立模型判断是否达成。若未达成,则自动启动下一轮迭代。→ Claude Managed Agents中的Outcomes功能:制定包含可评估标准的分项指标,由子代理在每次迭代中进行修正校验。
En el experimento de Parameter Golf, el verificador no dejó parar a Fable 5 hasta cumplir los 9 criterios de la rúbrica. 在参数高尔夫实验中,验证器坚持要求Fable 5满足评估标准中的所有9项指标才予以通过。
Sin juez independiente: el agente deriva. Con juez independiente: el agente mejora. 没有独立评判者:智能体表现逐渐偏离。有了独立评判者:智能体性能得以提升。
MEMORIA: EL LOOP QUE SOBREVIVE ENTRE SESIONES 记忆机制:在多次运行间持续运作的循环系统
Aquí está el segundo hallazgo brutal del experimento. 以下是实验中的第二大残酷发现。
Probaron Fable 5, Opus 4.7 y Sonnet 4.6 en Continual Learning Bench: preguntas secuenciales sobre una base de datos SQL, donde cada pregunta es una sesión nueva pero la memoria se comparte. 在持续学习基准测试中测试了Fable 5、Opus 4.7和Sonnet 4.6:针对SQL数据库的序列提问,每个问题都是新会话,但记忆是共享的。
Resultados finales (score medio): 最终结果(平均得分):
→ Fable 5: 0.839 → Opus 4.7: 0.700 → Sonnet 4.6: 0.364 → Fable 5:0.839 → Opus 4.7:0.700 → Sonnet 4.6:0.364
¿Por qué tanta diferencia? Porque usar bien la memoria tiene 5 niveles: 为何差距如此之大?因为善用记忆分为五个层级:
- Fallar y documentarlo 失败并记录它
- Investigar por qué fallaste 研究你为何失败
- Verificar la causa hasta convertirla en hecho 验证原因直至其成为事实
- Destilar el hecho en una regla general 将事实提炼为通用规则
- Consultar la regla en vez de rederivarla cada vez 每次查阅规则而非重新推导
Sonnet 4.6 se queda en el nivel 1: apunta fallos y suposiciones, pero casi nunca relee sus notas. Sonnet 4.6停留在第一层级:能指出错误与假设,但几乎从不重读自己的笔记。
Opus 4.7 llega al nivel 3: crea referencias con dudas marcadas, pero solo verifica un ~17% de las veces. Opus 4.7达到第三层级:会创建标有疑问的参考依据,但仅约17%的情况下会进行验证。
Fable 5 completa el ciclo: verifica hasta el 73% de sus diagnósticos y los convierte en reglas que reutiliza en tareas futuras. Fable 5完成完整闭环:对高达73%的诊断进行验证,并将其转化为可在未来任务中重复使用的规则。
El modelo olvida entre sesiones. El archivo de memoria no. Esa es la diferencia entre un agente que empieza de cero cada día y uno que acumula conocimiento. 模型会在会话之间遗忘,但记忆文件不会。这就是每天从头开始的智能体与积累知识的智能体之间的区别。
LOOPS ABIERTOS VS CERRADOS 开放循环 vs 封闭循环
Antes de montar el tuyo, la distinción práctica más importante: 在构建你自己的循环之前,最务实的区别是:
LOOP ABIERTO → Le das un objetivo amplio y dejas al agente explorar → Potente, pero quema tokens a lo bestia → Sin estándares claros se convierte en una máquina de slop开放循环 → 给它一个宽泛的目标,让智能体自由探索 → 功能强大,但极度消耗代币 → 没有清晰的标准就会变成垃圾内容制造机
LOOP CERRADO → Tú diseñas el camino: objetivo claro, pasos definidos, evaluación en cada paso, punto de parada → Fiable, mejora con cada pasada y cabe en un presupuesto normal闭环循环 → 你设计路径:清晰的目标、明确的步骤、每一步的评估、停止点 → 可靠,每次迭代都能改进,且符合正常预算
La recomendación: empieza con loops cerrados. Cuando tengas quality gates que funcionen, abre el espacio.建议:从闭环循环开始。当你拥有运作良好的质量门槛时,再打开空间。
LOS 6 BLOQUES DE TODO BUEN LOOP 每个优秀循环的6个模块
Esto es lo que construyes de verdad: 这才是你真正构建的内容:
- AUTOMATIZACIONES El latido del loop. Un prompt + una cadencia + un objetivo. /goal sigue hasta que la condición sea cierta. Tú te vas. 自动化 循环的核心。一个提示+一个节奏+一个目标。/goal 持续执行直到条件成立。你可以离开。
- WORKTREES Agentes en paralelo sin pisarse. Cada uno con su directorio aislado en su propia rama de git. 工作树 并行运行的智能体互不干扰。每个智能体在独立的 Git 分支中拥有自己的隔离目录。
- SKILLS Conocimiento del proyecto escrito una vez y leído en cada ciclo. VISION.md, ARCHITECTURE.md, RULES.md. Sin esto, el loop rederiva todo tu proyecto desde cero cada vez. 技能 项目知识一次性编写,每次循环中读取。VISION.md、ARCHITECTURE.md、RULES.md。没有这些,循环会每次都从零开始重新推导你的整个项目。
- CONECTORES (MCP) Un loop que solo ve el filesystem es un loop pequeño. Con conectores lee tu issue tracker, consulta la base de datos, abre la PR y avisa en Slack cuando el CI está en verde. 连接器(MCP)一个只能看见文件系统的循环是小循环。通过连接器,它可以读取你的问题追踪器、查询数据库、提交拉取请求,并在 CI 变绿时在 Slack 上通知你。
- SUBAGENTES El que verifica nunca es el que hizo el trabajo. Un modelo fresco decide si el loop terminó. 子代理程序 做验证的,从来不是干活的。由一个新模型来决定循环是否结束。
- MEMORIA Un simple markdown fuera de la conversación. Qué se probó, qué pasó, qué queda abierto. El loop del día 47 sabe todo lo que probaron los días 1 a 46. 记忆 一份简单的 markdown 文档,放在对话之外。记录了试过什么、发生了什么、还有什么未解决。第 47 天的循环,知道第 1 天到第 46 天尝试过的所有东西。
CÓMO MONTAR TU PRIMER LOOP (PASO A PASO) 如何搭建你的第一个循环(分步指南)
Vale, teoría clara. Ahora vamos a montarlo de verdad. 好了,理论讲清楚了。现在我们来实际操作,把它搭建起来。
Hay dos formas oficiales de hacerlo con Fable 5. Empezamos por la fácil. Fable 5 有两种官方方法可以实现。我们先从简单的开始。
OPCIÓN A: /goal EN CLAUDE CODE 选项 A:在 CLAUDE CODE 中使用 /goal
PASO 1: Define qué significa “terminado” 步骤 1:定义“完成”的含义
Esta es la parte donde la gente falla. El objetivo tiene que ser VERIFICABLE, no una opinión. 这就是人们容易失败的地方。目标必须可验证,而非主观判断。
Mal: “mejora el código de autenticación” Bien: “todos los tests de tests/auth pasan y el lint está limpio” Mal: “改进身份验证代码” 良: “tests/auth 下的所有测试均通过,且 lint 无误”
Si no puedes comprobarlo con un comando, no es un objetivo. Es un deseo. 如果无法通过一条命令验证,那就不是目标,而是愿望。
PASO 2: Dale contexto al agente 步骤 2:为 agent 提供上下文
Antes de lanzar nada, crea estos archivos en tu repo: 在发布任何内容之前,先在仓库中创建以下文件:
→ VISION.md: cómo se ve el éxito → ARCHITECTURE.md: stack y estructura de carpetas → RULES.md: lo que el agente nunca puede tocar → VISION.md:如何定义成功 → ARCHITECTURE.md:技术栈与文件夹结构 → RULES.md:代理绝不能触碰的内容
Cinco minutos escribiéndolos. Te ahorran que el loop rederive tu proyecto desde cero en cada vuelta. 写这五个文件只需要五分钟。它们能省去循环迭代时每次从头重新推导项目的麻烦。
PASO 3: Lanza el loop 第三步:启动循环
Abre Claude Code y escribe: 打开 Claude Code 并输入:
/goal todos los tests de tests/auth pasan y el lint está limpio. Máximo 30 turnos. /目标:所有tests/auth目录下的测试均通过,且代码检查(lint)无报错。最多30回合。
Fíjate en la última frase: SIEMPRE pon un límite de turnos o de tiempo dentro de la condición. Es tu freno de emergencia. 注意最后一句话:务必在条件中设置回合数或时间限制,这是你的紧急制动阀。
PASO 4: Deja que el sistema trabaje 第四步:让系统自行运作
A partir de aquí el ciclo es automático: 从此刻起,循环将自动进行:
→ El agente trabaja hacia el objetivo → Un modelo independiente (no el que hizo el trabajo) evalúa si la condición se cumple → Veredicto “no cumplido” = arranca el siguiente turno solo, con el feedback del juez → Veredicto “cumplido” = el goal se limpia automáticamente y el loop para → 智能体朝目标前进 → 独立模型(非执行任务的模型)评估条件是否达成 → 判定”未达成” = 自动进入下一轮,附带评估者的反馈 → 判定”已达成” = 目标自动清除,循环结束
Tú vuelves cuando está en verde. Y si quieres cortarlo antes: /goal clear. 当状态变绿时你即可返回。如需提前终止:输入 /goal clear。
OPCIÓN B: RÚBRICA + OUTCOMES EN CLAUDE MANAGED AGENTS 选项B:Claude托管智能体中的评分细则+输出标准
Para tareas largas (horas, no minutos) la opción es CMA, que te da el harness y el sandbox alojado. 对于长周期任务(耗时数小时而非数分钟),建议选择CMA,该方案提供托管框架和沙盒环境。
Aquí en vez de una condición escribes una RÚBRICA: un archivo con criterios evaluables, uno por línea. 这里你写的不是一个条件,而是一份**评分标准**:一个包含可评估标准的文件,每行一条。
Ejemplo real del experimento de Anthropic (el de Parameter Golf): Anthropic(即Parameter Golf实验)的真实案例:
→ Ejecutar un baseline antes de tocar nada → Correr 20 experimentos → Documentar cada resultado → …hasta 9 criterios verificables → 在修改任何内容前执行一次基线测试 → 运行20次实验 → 记录每次结果 → ……共9项可验证标准
Configuras max_iterations como límite, y Outcomes lanza un subagente corrector que evalúa la rúbrica en cada vuelta. El agente no puede parar hasta que todo pase. 你将`max_iterations`设为上限,Outcomes会在每次迭代中启动一个修正子代理来评估评分标准。在全部通过之前,代理不会停止。
Así corrió Fable 5 durante 8 horas solo. Sin nadie mirando. Fable 5就这样独自运行了8个小时,无人查看。
PASO EXTRA: AÑÁDELE MEMORIA 额外步骤:添加记忆
Si tu loop va a correr varios días, crea un MEMORY.md con tres secciones: 如果你的循环要运行数天,请创建一个 MEMORY.md 文件,包含三个部分:
→ PROBADO: qué experimentos se hicieron y su resultado → VERIFICADO: hechos confirmados (no suposiciones) → ABIERTO: qué queda por intentar → 已尝试:进行过的实验及其结果 → 已验证:已确认的事实(而非假设) → 待探索:尚待尝试的内容
Y añade una regla en RULES.md: “antes de empezar, lee MEMORY.md. Antes de terminar, actualízalo.” 在 RULES.md 中添加一条规则:“开始之前,先读取 MEMORY.md。结束之前,更新它。”
Eso es literalmente lo que hace Fable 5 mejor que nadie: convertir fallos en reglas verificadas y consultarlas en vez de rederivarlas. 这正是 Fable 5 做得比其他工具更好的地方:将失败转化为已验证的规则,并在需要时直接查询,而不是重新推导。
TU PRIMER LOOP EN 10 MINUTOS 你的第一个循环,10分钟上手
Si quieres empezar hoy sin complicarte: 如果你想今天就开始,不必搞复杂:
- Elige una tarea con verificación automática (tests, lint, un script que devuelva pass/fail) 选择一个带有自动验证的任务(测试、lint、返回通过/失败的脚本)
- Escribe el objetivo como condición comprobable + límite de turnos 将目标写成可检查的条件加上回合限制
- Lánzalo con /goal 使用 /goal 启动它
- Revisa el resultado final, no los pasos intermedios 检查最终结果,而不是中间步骤
Empieza pequeño. Un loop que funciona en una tarea aburrida vale más que diez loops ambiciosos que nunca terminan. 从小处着手。一个在无聊任务中正常运行的循环,胜过十个你从未完成的宏大循环。
4 LOOPS REALES QUE PUEDES MONTAR HOY 今天就能搭建的4个实用循环
- EL LOOP DE CÓDIGO 代码循环
Lee contexto → planifica el cambio → edita → ejecuta tests → si fallan, lee el error y corrige → si pasan, resume y para. Sin humano en medio. 阅读上下文 → 规划变更 → 编辑代码 → 运行测试 → 若失败,阅读错误并修正 → 若通过,总结并停止。无需人工干预。
- EL LOOP DE INVESTIGACIÓN 研究循环
Define la pregunta → busca fuentes → resume → verifica afirmaciones contra las fuentes → compara contradicciones → sintetiza → para cuando la confianza supera el umbral. 定义问题 → 查找来源 → 总结 → 根据来源核实主张 → 比较矛盾点 → 综合归纳 → 当信任度超过阈值时停止。
- EL LOOP DE CONTENIDO 内容循环
Tema + audiencia + objetivo → borrador → un agente crítico lo revisa → reescritura → puntuación contra criterios de éxito → si pasa, publica. Si no, otra vuelta. 主题 + 受众 + 目标 → 草稿 → 由批评者角色审核 → 重写 → 根据成功标准评分 → 若通过则发布,若不通过则再次循环。
- EL LOOP DE VENTAS 销售循环
Perfil de cliente ideal → encuentra leads → enriquece con datos → cualifica → personaliza el mensaje → revisión de calidad → envía o escala a un humano. 理想客户画像 → 寻找潜在客户 → 数据丰富化 → 资格评估 → 个性化信息 → 质量审查 → 自动发送或转交给人工处理
Todos tienen el mismo esqueleto: Objetivo → Acción → Verificación → Corrección → Repetir hasta terminar.所有流程都遵循相同的基本框架: 目标 → 行动 → 验证 → 纠正 → 重复直至完成
PROMPT ENGINEER VS LOOP ENGINEER 提示工程师 对比 循环工程师
El gap de skills que se está abriendo en 2026: 2026年正在拉开的技能差距:
PROMPT ENGINEER → Escribe mejores instrucciones → Revisa cada output a mano → Él es el feedback loop提示工程师 → 编写更好的指令 → 手动检查每个输出 → 他本身就是反馈循环
LOOP ENGINEER → Diseña mejores ciclos de feedback → Los tests revisan automáticamente → El sistema es el feedback loop循环工程师 → 设计更优的反馈周期 → 测试自动验证 → 系统本身构成反馈循环
Uno pide: “escríbeme una función”. El otro diseña: “escribe → testea → corrige hasta que esté en verde”. 一个要求:“给我写个函数”。另一个设计:“编写 → 测试 → 修正直到通过”。
Las herramientas son las mismas. La mentalidad es completamente distinta. 工具是一样的。心态完全不同。
EL MATIZ FINAL (QUE NADIE DICE EN VOZ ALTA) 最后的微妙之处(没人明说)
Dos personas pueden montar exactamente el mismo loop y obtener resultados opuestos. 两个人可以使用完全相同的循环,却得出截然相反的结果。
Una lo usa para ir más rápido en trabajo que entiende a fondo. La otra lo usa para no entender el trabajo en absoluto. 一个人用它来加速理解透彻的工作。另一个人则用它来完全逃避对工作的理解。
El loop no sabe la diferencia. Tú sí. 循环不知道其中的区别。但你知道。
Diseña loops como alguien que piensa seguir siendo el ingeniero. No como quien solo pulsa el botón. 设计循环时,要像那个仍以工程师自居的人一样思考,而不是像只懂得按下按钮的人那样。
Porque un loop fiable vale más que mil prompts perfectos. 因为一个可靠的循环,胜过一千个完美的提示词。