2026-05-22 · reviewed
LLM 即优化器:OPRO、FunSearch、ReEvo 与 LLaMEA
从 OPRO、FunSearch、ReEvo 到 LLaMEA,这篇研究笔记说明 LLM 如何在标量反馈、程序搜索和进化计算中承担候选生成与变异角色。
OPROFunSearchReEvoLLaMEA程序进化
进化计算 + LLM 给 Self Evolve 提供了清晰机制:生成候选、打分、选择、变异 / 重组,并保留谱系。
- OPRO:用自然语言任务描述和历史分数提示 LLM 生成新候选。
- FunSearch:用 LLM 生成程序,用评估器选择高价值程序并持续进化。
- ReEvo:将反思与启发式程序搜索结合。
- LLaMEA:进化的对象不只是解,而是优化器本身。
这条线可以支撑 Self Evolve 的产品架构:每个产物都有适应度函数,每次运行都有轨迹,每次改进都有谱系。