学术研究
13 条记录归在这个主题下,按时间倒序。每条都写了它是什么、花了多少、卡在哪里。
档案
13
131AntOmniEvo把系统里可调的那部分抽象成一个文件目录,然后让 coding agent 反复改写它。框架负责调度、预算、选择与淘汰:父子候选跑在同一条训练批次上打分,只有越过阈值的改进才会拿到验证集上复评并留下。ClaudeClaude Code
123agent-memory一个给 AI agent 用的长期记忆运行时:Markdown 文件是唯一真相,检索在本地排序、读的时候不调用任何模型,召回返回的是路径而不粘贴正文,写入发生在对话边界而不是等 agent 想起来,另外还有一个独立的睡眠期管理层——它可以自己新增和更新,但删除永远只能以提案的形式提交。Claude Code、Codex CLI 与 Hermes 共用同一份存储,不需要任何 API key。ClaudeClaude CodeCodex
117sepia一个可移植的去 AI 味写作技能:一套规则文件配四个操作,小说先修叙事结构再谈用词,专业文稿按场合套一份薄薄的规则文件,而每条规则都标着它是被测出来的、被咨询过的,还是这个项目自己的推断。ClaudeClaude CodeCodex+4
120Easel一个给社媒创作者用的开源内容工作台:一个 agent 把整条链路跑完——聚合热榜、策划选题、生成文案与卡片与配音与视频、把成品发到七个平台上已经登录的账号,再把数据读回来,沉淀进那个决定了下一轮产出的账号画像里。ClaudeClaude CodeGemini+3
116Lemmalog一个用 Rust 写的 Datalog 引擎,它把 agent 记忆当成演绎数据库,而不是一个更大的向量库。事实在抽取边界断言,分层规则推导闭包与时态视图,每条派生事实都带着回到来源 episode 的溯源,派生视图按 epoch 增量维护,并以十二个 MCP 工具的形式交给 Claude Code 与 Kimi CLI 使用。ClaudeClaude CodeGPT
075The Fable Method把 Claude Fable 5 的工作方式写成四个任何模型都能跑的技能,再配一套拆它台的评测:十四个陷阱夹具、只靠 diff 与执行判定的盲审裁判,以及十五轮把失败和零结果都留在里面的记录。ClaudeClaude Code
073Engram一条把「学一门东西」做成流水线的办法:课程架构师拆出第一性原理的概念图,一名看不见讲课过程的评分者盲评你写下的原话。再由 FSRS 排程,每次判分都在磁盘上留下一条收据。ClaudeClaude CodeCodex+2
063book-to-skill一个转换器:把一个文档——单文件、文件夹、glob 或一串路径,格式涵盖 PDF、EPUB、DOCX、HTML、RTF、MOBI 与纯文本——读成一份 agent 技能:一份讲心智模型、带章节索引的核心文件,每章一个只在问题碰到它时才加载的文件,旁边配术语表、模式库与决策速查。ClaudeClaude CodeCursor+2
047autoresearch把一个 LLM 训练脚本、五分钟的固定预算和完全不受监督的自主权交给 AI agent——然后看你睡觉时它找到了什么。Claude CodeCodex
033MiroFish一个预测引擎:把你上传的材料建成一个有几百个 AI 智能体的平行世界,然后向前推演,看会发生什么。ClaudeGemini
017BettaFish一个舆情分析系统:几种研究型智能体被刻意安排互相辩论,好让最后交出来的不只是某一个模型的观点被写长。
015SWE-agent一个研究项目的主张:瓶颈从来不是模型,而是模型面前的界面。GPTClaude











