Ratel
Ratel 是一个给 AI agent 用的开源上下文引擎:把 agent 能用的全套工具和技能先建好索引,每一轮对话只挑出跟当前任务相关的那一小撮塞进 prompt,而不是把整个工具箱都糊上去。
Giacomo 和 Roberto 之前给 SaaS 公司做过 agent,这次把 Ratel 开源,2026 年 7 月 16 日通过 Show HN 发布,同时放出了基准测试数据,宣称在四个模型上最高能省下 91% 的 token;有一个已经在生产环境用的团队反馈,第一个月把一个原本挂了 300 多个工具的 agent 换上 Ratel 之后,成本降了 81%。
名字来自蜜獾,那种天不怕地不怕、能怼比自己大好几圈的对手的动物。Ratel 对付臃肿的工具列表,走的也是这个路数。
这词英文这边也才刚冒头一天,Show HN 挂出来不到 24 小时,中文圈基本还没人写。真要抢的是内容窗口,页面里已经点出了一个现成的选题:Ratel 跟同样走 Rust 核心路线的 lean-ctx 怎么比,两家目前都没有第三方中立评测;另外 MCP 原生工具搜索到底还要不要单独一层检索层,这个争论 HN 楼里已经吵起来了,正好是能蹭的角度。生产用户那句「一个月省 81% token」是创始人自己在帖子里说的,写案例向内容时照实引用就行,别加码。
比所有人早 7 天看到 nascent 新词,解锁全部阶段筛选,并获得每周提前预警。
搜索热度
-
萌芽0–7 天
-
初现 ← 当前8–30 天
-
验证中31–90 天
-
上升91–180 天
-
成熟180 天以上
为什么是现在火?
Giacomo 和 Roberto 在 2026 年 7 月 16 日把 Ratel 发到了 Hacker News,一个给 AI agent 的工具和技能建索引的开源库,每一轮只加载相关的那部分。基准测试宣称最高能省 91% 的 token,准确率基本没掉;创始人还提到有个生产用户第一个月就把成本压低了 81%。
前景
未来 6 个月的信号走势和商业化节奏。
已经有生产用户反馈省下大约 80% 的 token,接下来能不能长起来,就看它能不能比 MCP 原生的工具搜索做得更好,同时不被托管型 agent 平台绕过去。
风险 · 只要 Anthropic 或 OpenAI 哪天把渐进式工具披露做进模型原生能力,Ratel 这套检索技巧一夜之间就可能变成谁都能白嫖的标配。
类比 · retrieval-augmented generation (RAG) · API gateways / reverse proxies · lazy loading in frontend frameworks
-
现在开源势头起来了,但还没定价
MIT 协议的 SDK 已经上了 npm/PyPI/crates.io;公司这边走的是联系咨询拿线索,没有公开报价页。
-
3-6 个月托管版和对比内容会跟上
随着用的人变多,大概率会出一个付费的托管工具目录服务,配上「Ratel vs X」这类对比内容。
-
6-12 个月MCP 自己的工具能力可能把它吃掉
如果 MCP 或者模型厂商自己做出原生的渐进式工具披露,Ratel 这套核心技巧可能就被白嫖了。
“Ratel” 的竞争与机会
信号来自追踪到的搜索词、这个词的变现卡片,还有它的相关词。除标注“实测”的 Google KD 外均为启发式,仅供参考。
“Ratel” 能做的点子
把这个词做成文章、网站、产品、帖子、邮件、视频或课程,随便挑一张卡片就能开干。
目前还没有中立对比。可以写清楚什么时候 MCP 自带的工具搜索就够用,什么时候 Ratel 的 BM25/混合检索目录才值得加进来。
用 Ratel 的 TypeScript 或 Python SDK 走一遍实操教程,发布头一周搜索结果里还完全没有这种手把手的指南。
两家都是 Rust 核心加各语言绑定,瞄准的是同一个上下文膨胀问题,只是切入角度不同,适合写给 builder 看的对比内容。
团队接入开源 SDK 之后,如果不自己动手接 OpenTelemetry,就没办法审查它每次检索到底选了什么,这块留给付费的可观测性产品来补。
框架锁定是采用的主要阻力;做一个专门给已经深度绑定其他框架的团队用的迁移工具,是个很具体的切入点。
第一人称案例文,写给独立 SaaS 开发者看,引用创始人自己在 Show HN 帖子里报出的生产数据。
Ratel 公开了原始的 BFCL v3 数据,做一条视频现场把这些数字跑一遍、跟竞品对着比,是个能验证、也容易传播的形式。
Giacomo 和 Roberto 给 SaaS 客户搭 agent 的时候一直撞同一堵墙,300 多个工具的 schema 把模型直接淹了,最后干脆把解法开源成了 Ratel。
把 Show HN 帖子里生产用户的这个数字,改写成第一人称的 builder 实验,配上前后成本截图。
Ratel 的品牌调性是「小、猛、不服输」,把蜜獾这个比喻用到底,押注的就是臃肿的 agent 基础设施迟早要被掀翻。
大家在搜什么
来自 Google Suggest 和 Trends 的长尾词。热度和竞争度是估算,仅供参考,未经核实。内容类型由搜索词的写法推断。
“Ratel” 的搜索结果
现在搜索的人会看到的页面:自然结果在上,有人投广告就显示在那。广告多少是实时的商业化信号。
常见问题
什么是 Ratel?
Ratel 是一个给 AI agent 用的开源上下文引擎:把 agent 能用的全套工具和技能先建好索引,每一轮对话只挑出跟当前任务相关的那一小撮塞进 prompt,而不是把整个工具箱都糊上去。
Ratel 为什么现在火?
Giacomo 和 Roberto 在 2026 年 7 月 16 日把 Ratel 发到了 Hacker News,一个给 AI agent 的工具和技能建索引的开源库,每一轮只加载相关的那部分。基准测试宣称最高能省 91% 的 token,准确率基本没掉;创始人还提到有个生产用户第一个月就把成本压低了 81%。
Ratel 是什么时候出现的?
约于 2026-07-16 公开出现(截至 2026-07-25 约 9 天前)。EarlyTerms 最早于 2026-07-17 记录到信号。
相关词
同一领域里的其他词:别名、子类、竞品,以及值得接着看的邻近词。
- 属于 context-engineering Context engineering 是一门学问:送进大模型上下文窗口的每一个 token,都要经过设计。系统提示、工具定义、检索内容、对话历史、记忆、文件,一个都不能随手堆进去。Anthropic 把它定义为 prompt engineering 的自然延伸。 →
- 竞品 lean-ctx Lean-ctx(LeanCTX)是给 AI 编程 agent 用的本地优先上下文智能层:一个 Rust 二进制文件加 MCP server,决定模型能读什么、记住什么、能碰哪些文件,官方宣称能把文件读取和 shell 输出压掉 60-90% 的 token 消耗。 →
- 相关 context-rot Context Rot 指大模型输出质量随输入长度增加而出现的可测量衰退,即便提示词还远没触及广告宣传的 context window 上限。模型处理第 10,000 个 token 的可靠程度,远不如处理第 100… →
- 相关 tool-layer Tool layer 是 AI agent harness 里独立的一层架构组件,负责注册、校验和管控模型能调用的所有函数。它夹在上方的编排循环(orchestration loop)和下方的数据层之间,把原始的工具定义转成有权限约束、有 schema 校验的执行面。 →
- 相关 mcp-tool MCP tool 是 MCP server 通过 JSON-RPC 暴露给大模型的一个可调用函数,由名称、描述和 JSON-Schema 格式的输入定义三部分构成。Model Context Protocol 有三个原语:resources、prompts,还有… →
- 相关 mcps 「MCPs」是 MCP(Model Context Protocol,Anthropic 于 2024 年 11 月 25 日发布)的非正式复数。开发者说「我一直在加 MCPs」时,指的是 MCP Server 或 MCP Tool,即 agent… →
- 相关 model-context-protocol Model Context Protocol (MCP) 是基于 JSON-RPC 2.0 的开放标准,定义了 AI… →
- 相关 managed-agents Managed Agents 是云平台托管并运行 AI agent 的基础设施模式。开发者以前要自己搭 agent 循环,记忆管理、工具路由、状态控制、沙箱隔离、错误恢复,全部自己处理;现在这些都由平台打包成 runtime 服务。 →
- 相关 agent-harness Agent harness 是大模型和真实世界之间的那层中间件,负责跑 agent 循环、调工具、管记忆、守护栏、从错误里恢复。圈子里现在流行一个公式:「Agent = 模型 + Harness。你不是模型,你就是 harness。」 →
- 相关 token-maxxing Token-maxxing 是把 AI token 消耗量当生产力指标来卷的风气:在内部排行榜上比拼,让 agent 全天候自主运行,把花掉多少钱当成地位信号。批评者说这是大模型时代的「代码行数」,数的是投入,不是产出。 →
- 相关 vault-context Vault Context 是指把本地 Markdown vault 的内容(文件、目录结构、frontmatter、标签,以及检索到的片段)喂给大模型,让模型拿你自己的笔记来回答问题,跳过那些泛泛的网络知识。这里的「vault」是 Obsidian 式的:磁盘上一个放满… →
来源
这份报告引用的一手链接,点开任意一条都能自己核对。
- 01 Show HN: Ratel launch thread news.ycombinator.com ↗
- 02 Ratel — GitHub repository github.com ↗
- 03 Ratel — company site ratel.sh ↗
- 04 Ratel — BFCL v3 benchmarks benchmark.ratel.sh ↗
- 05 Ratel — documentation docs.ratel.sh ↗
- 06 @ratel-ai/sdk on npm npmjs.com ↗
- 07 Ratel — LinkedIn brand post linkedin.com ↗