Prime Agent logo

Prime Agent

打开

PrimeIntellect 出品的自我改进编程智能体,基于递归语言模型(RLM)。持久 IPython 内核作为唯一工具,/refine 命令让智能体改进自身,还有带边界的自主模式。

分享:

Prime Agent 是 PrimeIntellect 开源的编程智能体,构建在递归语言模型(Recursive Language Model,RLM)之上。这个研究方向让智能体把上下文当作变量、把子智能体当作函数调用,全部运行在一个持久的 REPL 里。它于 2026 年 8 月 5 日发布,最出名的是 /refine 命令:智能体可以读取自己的执行轨迹,对自己的 prompt、技能和记忆做 CRUD 修改。发布头几个月就收获 15,000+ GitHub Star,是目前最能跑起来的自我改进智能体样本。

核心功能

  • 递归语言模型:上下文即变量、子智能体即函数调用,整个智能体就是可编程的 Python,跑在持久 IPython 内核里。
  • /refine 自我改进:智能体读取自己的轨迹,基于证据更新自己的配置、技能和记忆。
  • 持久内核即唯一工具:所有操作都经过一个 IPython 内核,而不是几十个定制工具。
  • 守护进程支撑的会话:终端断开后智能体继续运行,随时可以重新接管。
  • 智能体间消息:运行中的会话可以直接互相通信。
  • 可执行技能:技能是可导入的 Python 包,带类型化可调用对象,不只是 prompt 文本。
  • 有边界的自主模式:持久目标、心跳、调度计划和 token 预算,让自主运行保持可控。
  • 长时评估支持:为带质量门禁的数小时甚至数天运行而设计。

适用场景

谁应该使用这个工具?

  • Python 开发者:整个智能体都是 Python,状态、工具和技能全部可编程、可自省。
  • 研究者:RLM 是活跃的研究方向,这是一个真正能跑的参考实现。
  • 自主任务玩家:守护进程会话加有边界的自主性,适合长时间无人值守的任务。

解决的问题

  1. 智能体一成不变:大多数智能体的工作方式从不进化,Prime Agent 的 /refine 闭上了这个环。
  2. 工具膨胀:一个持久内核取代几十个脆弱的工具,提供统一的类型化执行面。
  3. 会话丢失:守护进程支撑的会话能扛住终端断连。

定价方案

方案 价格 功能
软件本体 ¥0(MIT 协议) 完整智能体,自托管,无用量限制
模型 自带 API Key OpenAI、Anthropic 或 Prime Intellect 推理服务

Prime Agent 免费且开源。你自带模型 API Key,或者按 token 付费使用 PrimeIntellect 自家的推理服务。

优势对比

相比竞品的优势

  1. 自我改进:带证据的 /refine 更新,在主流编程智能体中独一份。
  2. 单一工具:一个持久 IPython 内核,而不是蔓延的工具 API,审计和扩展都更简单。
  3. 研究血统:基于 Prime Intellect 已发表的 RLM 工作,在 ARC-AGI 3 和 GPU 内核基准上成绩有竞争力。

独特卖点

  • 智能体自己的 prompt、技能和记忆是一等公民,可以被它自己编辑。
  • 智能体间消息让多智能体拓扑有了新玩法。
  • 带预算的有边界自主模式,让长时间无人值守运行更安全。

用户评价

r/LocalLLaMA 和 r/ChatGPTCoding 的讨论集中在自我改进的新鲜感上:看着智能体在失败后编辑自己的技能,是被转发最多的演示。评测者还提到,基于内核的设计让它异常透明,每个动作都是你可以逐行读的 Python。主要的批评是它优先面向以 Python 为中心的工作流,其他语言的支持还在成熟中。

快速开始

快速上手指南

  1. 安装pip install prime-agent
  2. 配置:填入你的模型 API Key(OpenAI、Anthropic 或 Prime 推理服务)。
  3. 跑一个任务:启动会话,描述一个编程任务。
  4. 改进:它失败时运行 /refine,看它更新自己的技能和记忆。

集成

  • 模型:OpenAI、Anthropic 或 Prime Intellect 推理服务。
  • 运行时:任何装有 Python 3.12+ 的机器;守护进程模式支持无头运行。

常见问题

Prime Agent 免费吗?

免费。MIT 协议,你只需为模型推理付费。

它真的能自我改进吗?

能。/refine 会读取智能体自己的轨迹,对它的 prompt、技能和记忆做 CRUD 修改,每个改动都附带证据。

需要 GPU 吗?

不需要。它编排的是远程模型 API,本地推理是可选项。

和 Claude Code 比怎么样?

Claude Code 是面向生产、工具生态广阔的智能体;Prime Agent 是研究级、以 Python 为中心的智能体,看点在于自我修改。

替代方案

如果 Prime Agent 不合适,可以考虑:

  • Claude Code:Anthropic 的生产级终端智能体,生态成熟。
  • OpenHands:开源的自主编程智能体平台。
  • Goose:Block 出品的开源本地智能体,工具包可扩展。

使用技巧

  1. 每次失败后都跑 /refine:自我改进是它的核心价值,把它变成你工作流的一环。
  2. 用类型化 Python 写技能:可执行、带类型的技能远比纯 prompt 技能可靠。
  3. 自主模式下设预算:token 和时间预算让长时间无人值守运行可预期。

总结

Prime Agent 是目前最可信的自我改进编程智能体,它把智能体自身的配置变成了可编辑的状态。对 Python 开发者和研究者来说,如果你想要一个会随着你的工作流越变越好的智能体,而且能亲眼看着它变好,这是一个真正全新的工具品类。

评论

还没有评论。成为第一个评论的人!