跳到正文

学术研究

13 条记录归在这个主题下,按时间倒序。每条都写了它是什么、花了多少、卡在哪里。

全部 13 条

档案

13
131AntOmniEvo把系统里可调的那部分抽象成一个文件目录,然后让 coding agent 反复改写它。框架负责调度、预算、选择与淘汰:父子候选跑在同一条训练批次上打分,只有越过阈值的改进才会拿到验证集上复评并留下。ClaudeClaude Code2026年9月123agent-memory一个给 AI agent 用的长期记忆运行时:Markdown 文件是唯一真相,检索在本地排序、读的时候不调用任何模型,召回返回的是路径而不粘贴正文,写入发生在对话边界而不是等 agent 想起来,另外还有一个独立的睡眠期管理层——它可以自己新增和更新,但删除永远只能以提案的形式提交。Claude Code、Codex CLI 与 Hermes 共用同一份存储,不需要任何 API key。ClaudeClaude CodeCodex2026年9月117sepia一个可移植的去 AI 味写作技能:一套规则文件配四个操作,小说先修叙事结构再谈用词,专业文稿按场合套一份薄薄的规则文件,而每条规则都标着它是被测出来的、被咨询过的,还是这个项目自己的推断。ClaudeClaude CodeCodex+42026年8月120Easel一个给社媒创作者用的开源内容工作台:一个 agent 把整条链路跑完——聚合热榜、策划选题、生成文案与卡片与配音与视频、把成品发到七个平台上已经登录的账号,再把数据读回来,沉淀进那个决定了下一轮产出的账号画像里。ClaudeClaude CodeGemini+32026年8月116Lemmalog一个用 Rust 写的 Datalog 引擎,它把 agent 记忆当成演绎数据库,而不是一个更大的向量库。事实在抽取边界断言,分层规则推导闭包与时态视图,每条派生事实都带着回到来源 episode 的溯源,派生视图按 epoch 增量维护,并以十二个 MCP 工具的形式交给 Claude Code 与 Kimi CLI 使用。ClaudeClaude CodeGPT2026年8月075The Fable Method把 Claude Fable 5 的工作方式写成四个任何模型都能跑的技能,再配一套拆它台的评测:十四个陷阱夹具、只靠 diff 与执行判定的盲审裁判,以及十五轮把失败和零结果都留在里面的记录。ClaudeClaude Code2026年7月073Engram一条把「学一门东西」做成流水线的办法:课程架构师拆出第一性原理的概念图,一名看不见讲课过程的评分者盲评你写下的原话。再由 FSRS 排程,每次判分都在磁盘上留下一条收据。ClaudeClaude CodeCodex+22026年7月063book-to-skill一个转换器:把一个文档——单文件、文件夹、glob 或一串路径,格式涵盖 PDF、EPUB、DOCX、HTML、RTF、MOBI 与纯文本——读成一份 agent 技能:一份讲心智模型、带章节索引的核心文件,每章一个只在问题碰到它时才加载的文件,旁边配术语表、模式库与决策速查。ClaudeClaude CodeCursor+22026年5月055LeanCTX一层贴在编码 agent 旁边、决定什么内容能到模型眼前的本地软件:文件读取会被压缩并缓存,命令输出按每条命令各自的规则压缩,会话里的发现跨对话留存,本地代理重写每一个请求同时不弄坏服务商的 prompt cache——还有一本节省账、一份预算和一块仪表盘,报告它究竟量到了什么。ClaudeClaude CodeCursor+22026年3月047autoresearch把一个 LLM 训练脚本、五分钟的固定预算和完全不受监督的自主权交给 AI agent——然后看你睡觉时它找到了什么。Claude CodeCodex2026年3月033MiroFish一个预测引擎:把你上传的材料建成一个有几百个 AI 智能体的平行世界,然后向前推演,看会发生什么。ClaudeGemini2025年11月017BettaFish一个舆情分析系统:几种研究型智能体被刻意安排互相辩论,好让最后交出来的不只是某一个模型的观点被写长。2024年7月015SWE-agent一个研究项目的主张:瓶颈从来不是模型,而是模型面前的界面。GPTClaude2024年4月

相邻主题