跳转到内容
OmniRoute source

Free Tiers & Free-Token Budget (中文 (简体))

2026-06-17 更新——自 2026-06-05 以来有哪些变化

Section titled “2026-06-17 更新——自 2026-06-05 以来有哪些变化”

通过 50 个代理开展的网络研究(官方文档 + 最近 7 天的新闻,并经过对抗性验证)更新了整个目录。重点如下:

  • 已移除/2026 年无免费层: chutes(免费层已于 2026-03 结束)、phind(公司已于 2026-01 关闭)、kluster(于 2026-06-09 停止服务 → MITO)、gitlawb + gitlawb-gmi(MiMo 免费权限已于 2026-05-24 撤销,Nemotron 推广活动已于 2026-06 结束——于 2026-06-18 再次验证)、aimlapi(免费层已暂停——于 2026-06-18 再次验证)、yi(Yi-Light 已退役,改为按量付费——于 2026-06-18 再次验证)、featherless-ai(目前没有免费层)、chipotle(Chipotle 的“Pepper AI”——该提供者所连接的、经逆向工程的 amelia.chipotle.com Amelia 聊天组件目前在包括根路径在内的所有路由上均返回 404;后端已停用或迁移,于 2026-09-15 确认——已从目录中完全移除,#13131/#4037)。iflytek / sparkdesk 仍保留在列表中,但附有服务条款注意事项(Spark Lite 免费;其服务条款限制代理/中继用途)。
  • Gemini——2.0 Flash / 2.0 Flash-Lite 已于 2026-06-01 停止服务,2.5 Pro 也已退出免费层(2026-04);现在的免费层仅包含 Flash 系列(2.5/3/3.1/3.5 Flash + Gemma)。目录现在会将 Flash 系列合并统计(此前因分别计算每个变体而导致数据虚高:462M → 60M)。
  • 数据修正:cloudflare-ai 122M → 30M(实际为每天 10k Neurons)、doubao 被重新归类为一次性注册赠金(并非周期性赠送)、llm7 4M → 150M(文档注明每天 5M tokens)、together 的“-Free”端点已停止提供 → $25 注册赠金也已移除(要求最低购买 $5,无免费试用)、longcat Preview 已结束且 Flash 模型已退役 → 仅保留 LongCat-2.0,重新归类为一次性 10M tokens 注册赠金(需要完成 KYC,并非周期性赠送)。
  • 新发现的免费提供者:⭐ Kilo Code(kilo-gateway——轮换的“Auto Free”模型集:NVIDIA Nemotron 3 系列、StepFun、Poolside、Nex-N2-Pro)、⭐ OpenCode Zen(opencode-zen——6 个轮换的免费编程模型)、⭐ Z.AI / Zhipu(glm-cn——GLM-4-Flash / 4.5-Flash / 4.7-Flash 永久免费 + 20M 注册奖励),以及 arcee-ai Trinity Large Preview。
  • 新增的如实分层(参见方法论):一个_永久免费但无明确额度上限_类别(真正可周期性使用,但没有可统计的 token 上限),以及一个_存款解锁加成_类别(OpenRouter $10 → 每月增加 24M);二者均单独展示,因此绝不会抬高概要数据。

下方详细的各提供者表格是 2026-06-05 快照;以上变更将其取代。实时的规范来源是按模型编制的目录 open-sse/config/freeModelCatalog.ts。


OmniRoute 通过两种机制来回答“它是否免费?”,这两种机制会有意读取 不同的数据源:

机制 事实来源 应用范围
统计/显示 解析后的目录——已发布的基线数据叠加 Radar 数据源(getRadarCatalog) 免费层级总量、预算卡片、仪表板
判定 仅使用已发布的目录(open-sse/config/freeModelCatalog.data.ts 中的 FREE_MODEL_BUDGETS)及本地启发式规则(:free 后缀、零定价、grantsFreeAccess) src/shared/utils/freeModels.ts 的所有使用方:模型导入、auto/* 路由、GET /v1/models 以及浏览器预览

只要数据源可用,统计结果便可随时改进。判定则始终依据 发布产物,因此浏览器和服务器给出的答案完全一致, 可以离线复现,也能在不依赖数据库的情况下进行测试。如果允许浏览器 预览读取一个数据源,而服务器导入读取另一个数据源,就会导致 预览结果与点击后的实际行为不一致——因此有意保留了这种 机制分离。

  • 这些数字是根据截至 2026-06-17 各提供者记录在案的免费套餐限制,通过网络调研得出的上限估算值。免费套餐经常变化——在依赖某个数字之前,请重新核实。
  • 每个条目实际保证的内容。 任何条目都没有逐行置信度评级,API 也不提供此类评级——应将上述每个数字都视为质量相同但未明确说明的估算值。另有两类事实有所不同,因为它们是人工整理而非推断得出的:44 个条目具有独立记录的硬性停止机制(其中 39 个是 xKiro 条目,它们共享同一每日额度),另有 13 个条目提供了提示词训练披露。仅当提供者自己的条款明确说明超出免费额度后会拒绝请求,而不是在没有提示的情况下开始计费时,才会设置 hardStopGuaranteed,且来源会写在条目旁的注释中;该字段绝不会默认为 true,尚未经过任何人验证的条目会保持未设置状态。因此,缺少硬性停止标志意味着“尚未证实”,而不是“已知会向你收费”。STRICT 模式(需主动启用的 freeAccessPolicy=strict 路由保护机制)只信任带有该标志的条目;其他所有免费套餐都会以 no-hard-stop 为由被排除(参见 open-sse/services/autoCombo/strictZeroCostFilter.ts)。
  • estMonthlyFreeTokens = 仅包含每月重复发放的 token。一次性注册赠金不会重复发放,因此按 0 计算。已终止的套餐也按 0 计算。
  • 每日 token 上限 → monthly = daily × 30。如果只记录了 RPD → RPD × ~800 个输出 token × 30。如果只有 RPM/TPM(没有每日上限)→ 无上限(见下文)。
  • 永久免费,但没有公布 token 上限(siliconflow、glm-cn、tencent、baidu、kilo-gateway、opencode-zen、gemini、ollama-cloud):这些确实是持续提供的免费访问,但受速率/并发限制。我们将其归类为 recurring-uncapped,并且绝不将它们计入总和——用 RPM × 24/7 × 30d 计算会产生一个脱离现实的上限(我们拒绝这种虚增方式)。将它们列出是为了让你知道它们确实存在。
  • 充值解锁提升: 一次性小额充值可永久提高免费配额(OpenRouter:$10 → 1000 次请求/天 ≈ 每月增加 24M)。该数字单独报告,不计入稳定额度的主要汇总数字。
  • 受资格限制的配额(eligibilityGate: "regional-identity"):这是一项真实、持续发放的配额,但只有完成与特定地区绑定的身份验证后才会开放(目前为中国大陆实名认证)。按照相同的配额池去重规则,将其计入单独的数字(gatedRecurringTokens),绝不计入稳定额度的主要汇总数字。其类型(freeType)保持不变,因此路由行为也保持不变。
  • 证据类别。 规则如下:目录中的数字会在条目旁的 // evidence: 注释中注明来源——public-page(任何人都可以访问的提供者页面)、api-public(提供者无需身份验证即可访问的端点,例如 NaraRouter 位于 router.bynara.id 的公开套餐端点),或 console-verified <date> por <who>(该数字仅在账户控制台中可见;注释会记录查看者及查看时间,并附上说明该上限确实存在的公开页面)。当前状态:在 2026-09-02 重新审核的五个区块都带有此信息(gemini、groq、mistral、ollama-cloud、nara);早于 2026-09-02 重新审核的条目会沿用此前的研究结果,直至它们被修改;任何新增或变更的数字如果没有证据注释,都属于缺陷。目前只有 mistral 经过控制台验证。

为什么我们的数字小于其他聚合器的数字

Section titled “为什么我们的数字小于其他聚合器的数字”

在这一领域,大多数“每月免费 token”数字都是各模型标注额度的总和。我们有意不这样计算:

  • 每个共享额度池只计算一次。 Mistral 的免费计划为每个组织提供每月 1B 的统一额度;将其列在五个模型下并不会使其变成 5B。若按模型相加,我们自己的目录将显示 ~7.4B(于 2026-09-03 重新计算;该数字不受 CI 检查约束——每当目录发生变化时都应重新测算)——标题中显示 ~1.47B,因为这才是每个提供者各使用一个账户时实际可用的额度。
  • 每日上限会被换算,速率限制不会。 有明确文档说明的每日 token 上限会按 × 30 换算;有明确文档说明的每日请求上限会按 RPD × ~800 tokens × 30 换算;如果提供者只公布每分钟请求数,则不会计算月度额度,并会将其列为_无上限_,绝不计入总和。将速率限制按 24/7 全天候运行来相乘,正是我们拒绝采用的虚增方式。
  • 需要区域身份验证才能获得的额度会单独列出(+~6M behind regional identity verification),因为大多数读者无法使用这些额度。
  • 注册赠金仅适用于首月,并作为第二个数字报告,绝不会混入稳定的月度数字中。
  • 该数字由 CI 强制校验。 npm run check:docs-counts 会根据目录重新计算总额;当此文件、README 或预算卡片中的数字与计算结果不一致时,构建将失败。

ToS 标记仅供参考,并非路由门槛。 标记为 tos 的提供者默认仍会包含在路由以及组合/回退中;该标记仅显示在 /dashboard/free-tiers 和 /api/free-tier/summary 上。excludeTosAvoid 查询参数仅影响摘要视图,不影响全局路由。判定结果位于 open-sse/config/freeTierCatalog.ts 中(仅供参考,路由引擎不会读取)。

以下是对各提供者条款的快速解读,适用于自托管的单用户个人代理。caution = 有值得核查的个人使用或代理相关条款;ambiguous = 含义不明确;ok = 明确允许。仅供参考,不构成法律建议——由你自行决定。

⚠️ 谨慎 — 值得核查的个人使用/代理条款 (16)

Section titled “⚠️ 谨慎 — 值得核查的个人使用/代理条款 (16)”

它们确实提供免费访问,OmniRoute 也可以将请求路由至它们;以下条款只是值得了解。使用 OAuth/无密钥方式的服务无法按令牌量化,因此未计入醒目的汇总数字(并非因为它们无法使用)。

提供者 说明
agy Google Antigravity ToS 明确禁止使用第三方软件、工具或服务(包括代理)通过 OAuth 访问该服务;这样做……
ai21 ToS §4.2/§8.2 禁止向第三方分许可或分发 API 访问权限;§3.3 将试用/评估产品的用途限制为“内部评估……”
amazon-q 该产品已停止接受新用户注册;现有用户受 AWS Customer Agreement 约束,该协议规范托管服务的使用——自托管个……
blackbox ToS 明确禁止分许可、转售、向第三方提供服务以及构建衍生服务——自托管的个人……
coze Coze ToS 明确将使用限制为“个人和非商业用途”,并禁止出租、分发、分许可或转售该服务;……
duckduckgo-web Duck.ai ToS (duckduckgo.com/duckai/privacy-terms) 明确禁止“自动查询以及开发或提供 AI 服务”,并禁止规避……
featherless-ai 个人方案明确限制为“由购买者进行交互式使用或原型设计和实验”——推理转售和代理使用需要……
fireworks ToS 明确禁止代理/中介用途、API 密钥转让和分许可(第 2.1 和 2.2(i)(j) 节);自托管个人代理不……
friendliai ToS 第 8(e) 和 8(f) 节明确禁止将 FriendliAI 用作代理,或以独立方式允许第三方访问,并禁止转售/……
iflytek iFlytek Spark LLM Service Agreement 第 2.4(3) 节明确禁止“使用任何自动化或程序化方法提取数据或输出……
kiro Kiro FAQ 明确禁止与“OpenClaw 以及类似的、利用第三方工具框架的工具”配合使用——通过自托管 AI 代理(如 OmniRoute)路由……
modal ToS 第 1.3 节明确禁止“出租、转售或以其他方式允许任何第三方直接访问或使用服务”——构建自托管……
muse-spark-web Meta ToS 明确禁止未经事先许可的自动访问、未经书面许可的逆向工程以及规避技术……
nlpcloud ToS 明确禁止“设置允许他人通过其访问服务的代理或其他设备”,并且仅授予不可转让的……
opencode ToS (Anomaly Innovations, Inc.) 明确将使用限制为“仅供你自己的内部使用,不得代表任何第三方或为任何第三方的利益使用”——ope……
t3-web ToS 明确将账户限制为仅供个人使用,禁止与第三方共享凭据,并禁止自动化/机器人/抓取访问——自……

✅ 通常较宽松 — 谨慎 / 不明确 / 允许(其余提供者)

Section titled “✅ 通常较宽松 — 谨慎 / 不明确 / 允许(其余提供者)”
提供者 服务条款 备注
aimlapi 不明确 服务条款授予非独占使用许可,但未明确允许或禁止自托管代理或转售;没有“个人…
baichuan 不明确 在可公开访问的文档中未发现明确禁止自托管个人代理的规定;但是,M3 Plus 免费方案…
bluesminds 不明确 未发现关于自托管代理或转售的明确服务条款;定价页面主要关注功能/速率限制…
bytez 不明确 无法访问明确的服务条款页面(404);文档中未发现仅限评估或禁止代理的公开条款,但该平台…
doubao 不明确 在公开索引的文档中未发现明确禁止代理/转售的规定;Volcengine 是面向开发者的云…
gitlawb-gmi 不明确 未发现明确禁止自托管个人代理用途的服务条款;免费的 Nemotron 模型附带 NVIDIA 免责声明…
monsterapi 不明确 研究期间无法访问 MonsterAPI 的服务条款页面(monsterapi.ai/terms-of-service);未发现关于代理/转售/个人…
nous-research 不明确 Nous Portal 本身是一项聚合器/代理服务;将其用作另一个自托管代理的后端会形成代理套…
ollama-cloud 不明确 服务条款禁止使用该服务“开发竞争产品”,但未明确禁止自托管个人代理…
stepfun 不明确 未发现明确禁止自托管个人代理的规定,但 Step Plan 服务条款面向使用特定代…
api-airforce 需谨慎 服务条款明确禁止“未经许可构建竞争性服务”和“共享凭据”——自托管个人…
arcee-ai 需谨慎 免费访问通过 OpenRouter 的 :free 路由层提供(而非适用 Arcee 的直接 API 条款);OpenRouter 服务条款允许个人开发…
baidu 需谨慎 尚未明确审查服务条款中有关代理/转售的条款,但该平台要求实名认证(通常需要中国身份证…
baseten 需谨慎 服务条款将用途限制为“客户的内部业务目的”,并明确禁止再许可、转售或允许…
bazaarlink 需谨慎 服务条款明确禁止向第三方转售 API 密钥或对其进行再许可;供个人使用的自托管个人代理…
brave-search 需谨慎 服务条款禁止重新分发、转售搜索结果或对其进行再许可;使用 API“复制或试图复制…
byteplus 需谨慎 Token 不可转让且仅限单一账户使用;未明确禁止代理,但 BytePlus 保留…
cerebras 需谨慎 服务条款授予用于个人或商业用途的非独占、不可转让且不可再许可的权利;禁止转售、再…
cloudflare-ai 需谨慎 Cloudflare 自助服务条款 §2.2.1(j) 禁止使用服务“提供虚拟专用网络或其他类似的代…
cohere 需谨慎 Cohere 明确禁止将试用密钥用于“生产或商业目的”;用于路由请求的自托管个人代理…
deepinfra 需谨慎 服务条款广泛允许合法的商业用途,但禁止“与该公司的任何业务直接或间接竞争”的用途…
deepseek 需谨慎 开放平台服务条款(自 2026-04-29 起生效)允许广泛用途,包括“衍生产品开发”以及个人/商业…
dify 需谨慎 根据修改后的 Apache 2.0 许可证,允许自托管单用户个人代理;但是,多租户部署…
exa-search 需谨慎 未发现明确的“禁止代理”或“仅限评估”条款;Exa 积极提供允许 API …的经销商合作伙伴计划
firecrawl 需谨慎 未发现云 API 服务条款明确禁止个人代理,但开源自托管版本采用 AGPL-3.0(要…
gemini 需谨慎 服务条款明确指出,免费层适用于“使用 Google AI 模型构建专业或商业用途产品的开发者…
groq 需谨慎 服务协议 §6.3 禁止转售、再许可或分发 API 访问权限;§3.2 禁止转售/出租账户…
huggingchat 需谨慎 Hugging Face 服务条款未明确禁止个人自托管代理,但补充条款(已引用但未完整…
huggingface 需谨慎 服务条款授予访问/使用服务的有限许可;该文档未明确允许或禁止单用户…
hyperbolic 需谨慎 服务条款授予 API 访问权限,“仅供您自己的个人或内部业务目的使用”,并明确禁止许可、…
inference-net 需谨慎 服务条款明确禁止“再许可、转售、分发”以及未经书面同意转让 API 密钥;单用户…
jina-ai 需谨慎 免费的 10M Token 明确限于非商业用途(CC-BY-NC 4.0 模型许可证);用于个人 L… 的单用户个人代理
jina-reader 需谨慎 服务条款禁止使用输出构建竞争性服务,并禁止“通过抓取等自动化方法提取信息…
llm7 需谨慎 服务条款将该服务定位为用于“实验、开发和研究”;未明确禁止自托管个人…
longcat 需谨慎 API 平台服务协议(longcat.chat/platform/private/)允许商业集成和自托管应用…
mistral 需谨慎 消费者服务条款明确指出,API 只能用于“个人需求”,并禁止向第三方提供 API 密钥…
morph 谨慎 ToS 通常允许商业用途;自托管代理部署需要与销售团队明确协商。第 18 节……
nebius 谨慎 ToS(第 5f 节)明确禁止转售、再分发或“以独立形式”提供服务——自托管……
nomic 谨慎 ToS 授予非独占、不可转让的 API 许可;第 6.b 节禁止构建竞争性服务。使用该……
novita 谨慎 ToS 禁止转售和竞争性服务,但未明确涉及个人自托管代理;个人使用……
nscale 谨慎 AUP 禁止“复制、修改、复刻……框架化、镜像、重新发布……分发 Nscale Platform 的全部或任何部分……
nvidia 谨慎 免费套餐明确仅限原型设计/开发/研究/评估——生产用途(为真实最终用户提供服务)需要……
openrouter 谨慎 ToS 明确禁止转售 API 访问权限或开发竞争性服务;单用户自托管个人代理……
pollinations 谨慎 API 文档中引用的 MIT License 表明可宽松复用;未发现明确禁止自托管代理的条款。但是,……
predibase 谨慎 Predibase 被定位为企业级微调/服务平台;免费试用明确用于探索和……
publicai 谨慎 ToS(publicai.co/tc)将服务指定为“主要用于研究和教育用途”;没有明确的代理或转售……
qoder 谨慎 ToS 页面未返回可读内容;Qoder 是一个编程 IDE 客户端(并非公共 API),而第三方代理封装……
reka 谨慎 Business Terms 禁止向第三方进行再许可或分发访问权限;个人单用户代理可能没问题……
sambanova 谨慎 ToS 第 1.5(c) 节明确禁止转售、再许可或向第三方提供服务;……
sensenova 谨慎 在审查的 ToS 中未发现明确禁止代理或转售的条款,但免费套餐是没有 SLA 的促销性测试版,Sen……
serper-search 谨慎 ToS 明确禁止“在任何其他服务器上按原样镜像材料且不提供附加价值”——简单的直通式代理……
siliconflow 谨慎 ToS(第 3.4(e)(f)(p) 条)明确禁止向任何第三方提供服务、转售/再许可,……
sparkdesk 谨慎 SparkDesk User Agreement 仅授予个人、非商业用途权利;API Interface Policy 禁止自动化数据……
tavily-search 谨慎 ToS 明确规定,该 API“不得转让、让与、共享或以其他方式提供给任何第三方……
tencent 谨慎 Tencent Cloud ToS 明确禁止对 API 访问权限进行再许可或转售;用于个人……的自托管个人代理
together 谨慎 ToS 第 4.3(d) 节明确禁止转让、分发、转售、出租或以……方式提供服务
uncloseai 谨慎 个人代理用途可能可行,但未得到明确许可;ToS 禁止构建“具有……的竞争性机器学习服务
veoaifree-web 谨慎 ToS 明确禁止以“非人类速度”运行的自动化机器人或脚本,并禁止复制平台以创建……
vertex 谨慎 Google Cloud Service Terms 将转售限制为仅限授权经销商(第 14 节要求签订 Reseller Agreement);……
voyage-ai 谨慎 ToS 授予网站内容的“个人、非商业用途”权利,并禁止与第三方共享凭据/账户;……
xkiro 谨慎 ToS(2026-07-30)禁止转售/再分发服务以及违反上游提供者的条款;个人代理……
360ai 未知 开发者 API 的 ToS 在未注册的情况下无法公开访问;访问需要申请批准,这意味着……
chutes 未知 ToS 页面位于 chutes.ai/terms,但无法通过抓取访问其内容;在……中未发现明确的代理/转售条款
freemodel-dev 未知 Terms of Service 页面(freemodel.dev/terms)通过 WebFetch 仅返回了标题,没有可读内容;没有条款……
gitlawb 未知 未找到 ToS 或可接受使用政策;代理/转售限制未知——自托管代理用途应谨慎处理。
liquid 未知 不存在可供代理的托管 API;对于年收入低于 $10M 的组织,开源模型可免费用于商业用途。没有自托管……
yi 未知 未登录时无法公开访问 ToS;因此无法审查代理/转售条款。自托管个人代理用途仍……
comfyui 可用 GPL-3.0 开源许可明确允许自托管个人代理用途;Comfy Org ToS 确认……的商业用途
scaleway 可用 Scaleway 的 General Terms of Services 是标准商业云服务协议,其中没有明确禁止自托管……
sdwebui 可用 AGPL-3.0 许可:可免费自托管用于个人用途,且对使用量没有限制;使用该……的个人代理
searxng-search 可用 AGPL-3.0 开源许可明确允许自托管个人代理用途,对使用类型、转售……没有限制

各提供者免费额度(重新审计的行更新于 2026-09-02;其余更新于 2026-06-17)

Section titled “各提供者免费额度(重新审计的行更新于 2026-09-02;其余更新于 2026-06-17)”

根据各模型目录(open-sse/config/freeModelCatalog.ts)重新生成,并按池去重。按每月稳定持续提供的 token 数排序。uncapped* = 永久免费,但未公布 token 上限(受速率/并发限制)——可实际使用,但未计入标题汇总。— = 仅限赠金 / 无需密钥 / 无法以 token 量化。

提供者 免费类型 每月稳定令牌数 首月赠送额度 服务条款 模型数
mistral 定期赠送 ~1.00B — 谨慎 5
nara 定期赠送 ~210M — 谨慎 8
llm7 定期赠送 ~150M — 谨慎 4
xkiro 定期赠送 ~150M — 谨慎 39
longcat 一次性 — 10M 谨慎 1
cerebras 一次性 — $5 额度 谨慎 2
cloudflare-ai 定期赠送 ~30M — 谨慎 9
groq 定期赠送 ~30M — 谨慎 5
api-airforce 定期赠送 ~24M — 谨慎 7
bluesminds 定期赠送 ~7M — 模糊 22
sambanova 定期赠送 ~6M — 谨慎 5
arcee-ai 定期赠送 ~5M — 谨慎 1
bazaarlink 定期赠送 ~4M — 谨慎 32
openrouter 定期赠送 ~1M — 谨慎 1
cohere 定期赠送 ~800K — 谨慎 6
huggingchat 定期赠送 ~500K — 谨慎 4
morph 定期赠送 ~400K — 良好 2
huggingface 定期赠送 ~200K — 谨慎 6
kiro 定期赠送 ~25K — 避免 12
glm-cn 无上限 无上限* ~20M 良好 4
baidu 无上限 无上限* — 谨慎 1
gemini 无上限 无上限* — 谨慎 4
kilo-gateway 无上限 无上限* — 谨慎 7
ollama-cloud 无上限 无上限* — 模糊 8
opencode-zen 无上限 无上限* — 谨慎 6
siliconflow 无上限 无上限* — 谨慎 10
tencent 无上限 无上限* — 谨慎 1
vertex 注册赠送额度 — ~300M 谨慎 10
agentrouter 注册赠送额度 — ~200M 谨慎 4
predibase 注册赠送额度 — ~25M 谨慎 1
doubao 注册赠送额度 — ~15M 模糊 1
ai21 注册赠送额度 — ~10M 避免 2
deepseek 注册赠送额度 — ~5M 良好 2
hyperbolic 注册赠送额度 — ~5M 良好 8
nscale 注册赠送额度 — ~5M 谨慎 6
bytez 注册赠送额度 — ~1M 模糊 3
deepinfra 注册赠送额度 — ~1M 谨慎 22
fireworks 注册赠送额度 — ~1M 避免 10
nebius 注册赠送额度 — ~1M 谨慎 1
qoder 注册赠送额度 — ~1M 谨慎 14
scaleway 注册赠送额度 — ~1M 良好 6
novita 注册赠送额度 — ~500K 谨慎 1
agy 无需密钥 — — 避免 16
baichuan 无需密钥 — — 模糊 1
blackbox 无需密钥 — — 避免 6
coze 无需密钥 — — 避免 1
duckduckgo-web 无需密钥 — — 避免 6
freemodel-dev 无需密钥 — — 未知 4
friendliai 无需密钥 — — 避免 2
iflytek 无需密钥 — — 避免 1
inference-net 无需密钥 — — 谨慎 3
liquid 无需密钥 — — 未知 1
monsterapi 无需密钥 — — 模糊 1
muse-spark-web 无需密钥 — — 避免 3
nlpcloud 无需密钥 — — 避免 1
nous-research 无需密钥 — — 模糊 2
nvidia 无需密钥 — — 谨慎 13
opencode 无需密钥 — — 避免 7
pollinations 无需密钥 — — 谨慎 31
publicai 无需密钥 — — 谨慎使用 3
reka 无需密钥 — — 谨慎使用 2
sensenova 无需密钥 — — 谨慎使用 1
sparkdesk 无需密钥 — — 谨慎使用 1
stepfun 无需密钥 — — 正常 1
t3-web 无需密钥 — — 避免使用 23
uncloseai 无需密钥 — — 谨慎使用 3

与已发布目录 (freeNote) 相比有哪些变化

Section titled “与已发布目录 (freeNote) 相比有哪些变化”

v3.8.0 时期的 freeNote 字符串已过时。本次研究发现的修正如下(这些修正推动了 _tasks/features-v3.8.12 中的目录更新):

  • 360ai — 内置的 freeNote“免费 360 AI Brain 模型”似乎已过时。目前需要申请才能访问,且为付费服务。2023 年发布初期的一次性推广 token(100M–250M)可能是该说明的依据……
  • agentrouter — 我们内置的 freeNote 写着“注册即送 $200 免费额度”。目前的实际情况是,标准(非推荐)注册用户仅可获得 $100;通过推荐注册的用户可能获得 $200,但 2026 年 4 月的一条社区评论……
  • agy — 我们内置的 freeNote 写着“(无)”,暗示没有免费层级,但 Antigravity 确实提供一个需要 OAuth 授权的免费层级。不过,ToS 明确禁止通过 OmniRoute 之类的代理使用此免费层级……
  • ai21 — 条件收紧:试用期从“3 个月”缩短至 7 天。$10 的额度金额保持不变,但有效期从约 90 天大幅缩短至 7 天。
  • aimlapi — 变化显著。内置的 freeNote 宣称“每天 $0.025 免费额度 — 200+ 个模型”,但免费层级现已暂停/终止。每天 $0.025 的额度分配(每天 50,000 个积分,10 次请求/天……
  • amazon-q — 我们内置的 freeNote 写着“(无)”——实际情况更糟:该产品现已停止接受新用户注册(2026 年 5 月 15 日)。此前,免费层级每月提供 50 次智能体请求和不限量的内联……
  • api-airforce — 目录中的 freeNote 为“(无)”,但实际上存在有文档记录的免费层级:持续提供 1 RPM / 1,000 RPD,需要注册账户,仅限基础模型。
  • arcee-ai — 内置的 freeNote(“免费 Trinity Large Thinking 模型(262K 上下文)”)部分准确——Trinity Large Thinking 确实可通过 OpenRouter 免费使用,并提供 262K 上下文——但该说明遗漏了……
  • baichuan — 我们内置的 freeNote 写着“免费 Baichuan 模型”,暗示可持续免费访问,但目前的实际情况是,新用户仅可获得一次性的 80 CNY 试用额度(有效期 3 个月)。并不存在永久……
  • baidu — 目录写着“免费 ERNIE Speed/Lite 模型”,总体准确,但低估了覆盖范围:ERNIE-Tiny 和多个上下文窗口变体(8K 和 128K)也可免费使用。该免费层级似乎……
  • bazaarlink — 基本一致——内置的 freeNote 准确描述了用于零成本推理的 auto:free 路由。不过,目前的实际情况还包括明确的速率限制(10–20 RPM,约 150 RPD),而说明中并未提及……
  • blackbox — 我们内置的 freeNote 声称“无限量基础聊天以及 Minimax-M2.5”。实际上,无限量 Minimax-M2.5 智能体请求是付费方案(Pro+)的功能,并不属于免费层级。免费层级有……
  • bluesminds — 我们内置的 freeNote 是“(无)”——但 BluesMinds 确实提供有文档记录的免费层级:500 pi 积分、20 RPM、300 RPD,以及永久免费的方案。目录明显低估了其服务内容。
  • brave-search — 目录标注“(无)”,表明未追踪到免费层级,但实际上在 2026 年 2 月 12 日之前,曾有每月 5,000 次查询的免费层级(无需银行卡),此后已由每月 $5 的……
  • byteplus — 我们的目录内置为“(无)”,但 BytePlus ModelArk 确实提供免费层级:新账户可针对每个 LLM 模型获得一次性的 500k token 试用额度。目录漏报了这一点。
  • cerebras — 无需银行卡、每天 1M token 的试用已取消。cerebras.ai/pricing 的实时信息(2026-09-03)显示,注册时可获得一次性的 $5 额度,但需要提供付款方式,有效期为 30 天。已重新分类为 one-time-initial(LongCat 形式);并从 LEGACY_FREE_PROVIDERS 和经常性预算中移除。
  • chutes — 内置的 freeNote 写着“提供免费层级”,但截至 2026 年 3 月 15 日,免费层级已正式终止。目录说明已经过时,应更新以反映不再有持续……
  • coze — 内置说明“免费的 ByteDance 智能体平台”大体准确,但遗漏了免费层级目前受到严格的积分上限约束(每天 10 个积分,约等于 5–100 条消息,具体取决于模型),这一限制……
  • deepinfra — 我们内置的 freeNote 写着“用于 API 测试的免费注册额度”——这似乎已经过时。官方定价页面现在要求绑定银行卡/预付款,且没有记录任何普遍适用的免费注册额度。免费层级……
  • deepseek — 我们内置的说明写着“注册即送 5M 免费 token — 无需信用卡”——就一次性赠送而言,这仍然准确,但重要的是,这些额度会在 30 天后过期(内置说明中未提及……
  • dify — 内置的 freeNote(“免费的开源 AI 应用构建器 + RAG”)大体准确,但并不完整。云端免费层级的限制比描述中暗示的更严格:200 条消息额度似乎是一次性……
  • doubao — 内置的 freeNote“免费 Doubao 模型(ByteDance)”大体正确,但描述不够具体。目前的实际情况更为结构化:存在有明确量化标准、每日重置的免费层级(每天 2M token,……
  • duckduckgo-web — “免费匿名访问”这一核心描述仍然成立,但该服务已显著成熟:目前提供明确的付费层级(Plus/Pro),具有更高的限额,这意味着免费层级受到速率限制……
  • exa-search — 目录内置的 freeNote 为“(无)”,但 Exa 提供有文档记录、持续有效的免费层级,每月包含 1,000 次请求。这是一个重大缺漏——该免费层级确实存在且为永久性方案。
  • featherless-ai — 我们内置的 freeNote 写着“提供免费层级”,但实际上并不存在面向普通用户的免费层级。唯一的免费访问方式是仅限受邀/申请制的 Builder Series 计划,这并不是标准的免费……
  • firecrawl — 我们目录内置的 freeNote 为“(无)”,暗示不存在免费层级。实际上,Firecrawl 提供有文档记录、持续有效的免费方案,每月包含 1,000 个积分——该目录条目有误。
  • freemodel-dev — 我们内置的 freeNote 是“(无)”——这可能只是一个占位符,表示该提供者尚未被编入目录。实际上,该提供者确实提供 $300 的一次性试用额度。不过,这只是一个一次性……
  • friendliai — 随附的 freeNote(“无服务器推理的免费层”)部分准确,但具有误导性。用户可通过 Tier 0 和指定免费模型获得免费访问权限,但速率限制尚未明确,并且 ada…
  • gemini — 随附的 freeNote 称“Gemini 2.5 Flash 每天 1,500 个请求”——这在 2025 年 12 月之前是准确的。Google 于 2025 年 12 月将免费层限制削减了 50-80%,使 Gemini 2.5 Flash 从 1,500 R…
  • gitlawb — 随附的 freeNote“提供免费层”实际上已过时。最初的免费 MiMo 访问权限已于 2026 年 5 月移除;目前唯一剩余的“免费”选项是一个临时推广模型(Nemotron 3 U…
  • gitlawb-gmi — 部分仍然准确——免费层依然存在,但在 2026 年 5 月下旬撤销 MiMo 免费访问权限后,现已缩减至单个模型(Nemotron 3 Ultra)。随附的说明“提供免费层”未充分说…
  • groq — 随附的 freeNote“30 RPM / 14.4K RPD”仅对 llama-3.1-8b-instant 准确。大多数其他模型(包括 llama-3.3-70b-versatile)的上限要低得多,仅为 1K RPD。该说明遗漏了特定于模型的… 已于 2026-09-02 解决:freeNote 现为“免费计划:每个模型均设有上限(每个聊天模型每天 200K tokens;有关 RPM/RPD,请参阅 console.groq.com/docs/rate-limits)——未登记付款方式。”,且目录包含五个按模型计算的 6M 上限(llama-3.3-70b-versatile 已于 2026-08-16 从免费层中移除)——请参阅 2026-09-02 重新审核说明。
  • huggingchat — 随附的 freeNote(“免费 LLM 聊天——无需订阅。适用速率限制。”)部分准确,但严重淡化了限制。免费层现在实行严格的 $0.10/…
  • huggingface — 已大幅收紧。随附的 freeNote(“面向数千个模型的免费 Inference API”)暗示免费访问不受限制或额度宽裕,但截至 2025 年年中,免费层的每月循环额度上限为 $0.10…
  • hyperbolic — 我们随附的 freeNote 称“注册可获 $1-5 试用额度”——其中 $1 试用额度的部分准确,但“$5”是指解锁 GPU 租用所需的最低充值金额(并非赠送的免费额度…
  • iflytek — 目录称“免费的 Spark Lite 模型”——这大体准确。不过,当前实际情况更为复杂:只有 Spark Lite 免费(Max 的 100M token 优惠是一次性促销,而非循环提供);…
  • inference-net — 随附的 freeNote 称“注册可获 $25 免费额度,另有研究资助”。当前定价页面仅显示每月循环提供 $1 额度,未提及 $25 注册奖励或研究资助…
  • jina-reader — 我们随附的 freeNote 为“(none)”,这是不正确的。Jina Reader 自推出以来一直提供公开记录的免费层:无密钥访问为 20 RPM,并且使用免费 API key 可获得一次性的 10M token 赠额。…
  • kiro — 目录随附的 freeNote 为“(none)”——但 Kiro 有一个有明确文档说明、永久有效的免费层,每月提供 50 credits。该免费层自 Kiro 公开发布以来便已存在(定价约于 2025 年 10 月正式确定)。这是一个…
  • llm7 — 速率限制已从随附 freeNote 中的数值上调(20 RPM / 100 req/hr → 40 RPM / 200 req/hr)。“无需注册”的说法现已过时——现在需要从 token.llm7.io 获取免费 token(尽…
  • longcat — 公开预览版/测试版已结束,Flash 模型也已停用;目前仅剩正式发布的 LongCat-2.0。免费层是在完成账户注册和KYC 验证后解锁的一次性 10M-token 赠额——它不会按天或按月重置。用完赠额后按使用量付费。
  • mistral — 随附的 freeNote(“免费 Experiment 层:对所有模型提供有速率限制的访问权限”)方向上正确,但描述不充分。当前实际情况还包含明确记录的具体限制:2 RPM、500K TPM、1B tokens/…
  • monsterapi — 随附的 freeNote 称“用于去中心化 GPU 推理的免费额度”,这部分准确——注册时会获得一次性试用额度。不过,循环免费层每月提供 0 credits…
  • morph — 随附的 freeNote 提到“每月 250K credits”,这与当前额度分配相符;不过,更重要的限制是每月 200 个请求,而原始说明中并未体现这一点…
  • muse-spark-web — 随附的 freeNote(“登录后免费——提供 Llama 模型的 Meta AI 平台”)在登录要求和 Llama 模型访问方面大体准确。未发现免费层有所收紧;它仍…
  • nlpcloud — 随附的 freeNote 称“新账户可获试用额度”,这暗示它是一次性试用。实际上,NLP Cloud 的免费层是一个每月循环的免费计划(每月 10,000 个请求),而非试用额度…
  • nomic — 我们随附的 freeNote 称“免费的 Nomic Embed API”,未附加任何限定条件,暗示可持续免费访问。实际情况是仅提供一次性的 1M-token 试用额度——用完该 token 额度后,需要付费订阅…
  • nous-research — 随附的 freeNote(“免费层:50 RPM、500,000 TPM”)与当前 Nous Portal 产品不符。该门户于 2026 年 4 月 27 日推出,其免费层采用每月循环提供 $0.10 额度的结构…
  • nvidia — “40 RPM、70+ 个模型”这一速率限制要素与目录相符,但 freeNote 将其描述为简单的开发访问层,淡化了旧的一次性额度池已被移除这一事实——现在的访问实际上…
  • ollama-cloud — 我们随附的 freeNote 为“(none)”——这已过时。Ollama Cloud 推出了云推理产品,其中包含真正的免费层,可按每周 GPU 使用时间提供对托管开放模型的轻量访问。
  • openrouter — 零额度账户的 RPD 从 200 收紧至 50(RPM 仍为 20)。目录说明中的 RPM 准确,但对于无额度的基础层级,RPD 被夸大了 4 倍。运行时跟踪 (#6842):这不再只是一条静态说明 — open-sse/services/openrouterQuotaFetcher.ts 会轮询 /api/v1/key + /api/v1/credits,以获取每个密钥的额度上限、剩余额度、重置时间,以及每日/每周/每月美元支出;open-sse/services/openrouterFreeWindow.ts 则在本地跟踪上述 :free 模型每日 50 或 1000 次 + 20 RPM 的窗口(收到 429 响应时根据 X-RateLimit-* 响应标头进行校正),并显示在“仪表板 → 提供者配额”中。
  • phind — Phind 已于 2026 年 1 月 16 日停止运营。该提供者现已从目录中完全移除(包括注册表、执行器,以及 Web Cookie 和 API 密钥目录条目)— 与失效服务移除的先例一致(#5246 Gemini CLI)。
  • pollinations — 部分相符 — 对匿名访问而言,“无需 API 密钥”的说法仍然属实,但目录中的 freeNote 遗漏了以下信息:(1) 确实存在速率限制(匿名用户约每 6–15 秒 1 个请求的间隔节流限制……
  • predibase — 当前发布的 freeNote($25 免费试用额度,有效期 30 天)仍与现有文档一致。不过,目录遗漏了试用期间适用的并发 20,000 tokens/day 无服务器速率限制……
  • publicai — 当前发布的 freeNote(“免费社区推理层级”)总体准确,但缺乏具体信息:目前已明确记录 20 RPM 的速率限制。未发现重大收紧;该服务仍然免费……
  • puter — 应 Puter 所有者 Nariman Jelveh 的要求,已从目录中完全移除(包括注册表、执行器、免费模型目录和 API 密钥条目)— 请参见上文的失效服务移除先例(phind)。
  • qoder — 我们目录中的 freeNote 为“(none)”,但 Qoder 确实提供免费层级:社区版提供不限次数的基础模型补全(设有未公布限额的每日上限),另有一次性的 14 天/300 额度 Pr……
  • sambanova — 我们当前发布的说明仅描述了一次性的 $5 额度(有效期 30 天)。目前实际还包含一个永久、周期性重置的免费层级,并有明确记录的速率限制(20 RPM、20 RPD、200k TPD),该层级会持续……
  • sensenova — 我们当前发布的 freeNote 称“免费 SenseTime 模型”,这种说法含糊但方向上正确 — 免费访问确实存在。不过,实际情况更为复杂:免费访问是有时间限制的公开测试版(Token……
  • serper-search — 当前发布的 freeNote 为“(none)”,这部分准确 — 不存在周期性重置的免费计划 — 但 Serper 确实会在注册时提供一次性的 2,500 试用额度。目录说明可以更精确……
  • siliconflow — 部分相符,但实际情况更复杂:$1 免费额度是一次性试用额度(并非周期性发放),而“永久免费模型”部分仍然成立 — 免费的 $0 模型依然存在(Qwen3-8B、D……
  • sparkdesk — 部分相符 — 当前发布的 freeNote“免费 iFlytek Spark 模型”在 Spark Lite 永久免费这一点上是准确的,但没有充分说明限制条件(每个 App ID 为 2 QPS),且夸大了适用范围(仅 S……
  • stepfun — 当前发布的 freeNote“免费 Step-2 模型”已过时。Step-2 LLM 已不再提供免费访问;该平台已转向按 token 付费的 Step 3.x 模型,不再提供免费 LLM 层级。仅……
  • t3-web — 当前发布的 freeNote 总体准确(模型访问受限,Pro 以 $8/月的价格解锁 50 多个模型),但遗漏了两项重要更新:(1) 免费层级目前按日重置,而非按月重置(大约于……
  • tavily-search — 目录中的 freeNote 为“(none)”,暗示没有免费层级,但 Tavily 实际上确实提供有明确文档记录、周期性重置的免费层级:每月 1,000 额度,且无需信用卡。这是一个重大差异……
  • tencent — 基本相符 — 当前发布的 freeNote(“免费 Hunyuan Lite 模型”)准确。Hunyuan-lite 自 2024 年 5 月起一直永久免费,截至 2026 年仍然如此。目录说明没有充分体现其详细信息……
  • together — 当前发布的说明为“$25 注册额度 + 3 个永久免费模型”,但 Together 现在要求至少购买 $5 额度,且不提供免费试用。$25 注册额度已从目录中移除(#12526)。该提供者仍托管约 80 个永久免费模型,但其 ToS(第 4.3(d) 节)明确禁止转让、分发、转售或提供这些服务。
  • uncloseai — 基本相符 — 仍然永久免费,且无需注册。不过,ToS(terms-of-use.html)明确说明,过度使用时会实施基于 IP 的节流,并禁止在未经……
  • veoaifree-web — 当前发布的 freeNote 称“每小时 6 个请求”,但目前在 veoaifree.com 的任何地方都没有明确记录此类限制。该网站声称可无限次免费生成且无需登录。列出的模型……
  • voyage-ai — 当前发布的 freeNote“用于嵌入和重排序的 200M 免费 token”在 token 数量方面方向正确,但具有误导性 — 它遗漏了这是每个账户的一次性分配,而非周期性……
  • yi — 当前发布的 freeNote“免费 Yi-Light 模型”提到了一个模型名称(“Yi-Light”),但该名称并未出现在 01.AI 当前的任何文档或模型目录中 — platform.01.ai 上未列出此类模型,……

术语 含义
RPM / RPD / RPH 每分钟 / 每天 / 每小时请求数
TPM / TPD 每分钟 / 每天 token 数
明确授予额度 提供者公布的明确每日/每月 token 上限(可作为预算依据)
理论上限 速率限制 × 24/7 × 30天——这是最大值,而非授予的预算
Neuron Cloudflare 计算单位(约等于 1 个输出 token)

根据 2026-06-05 对各提供者的研究生成。请重新运行研究工作流(参见 _tasks/features-v3.8.12)以刷新。


OmniRoute 源码 (a58000c7685f)

HagiCode

HagiCode 是一套智能体编码工作台:结构化工作流、多 Agent 并行执行与 Hero Dungeon 视图,把想法变成真正交付的软件。

让想法更快变成好用的软件,让智能编码更聪明、更高效,也更有趣。

HagiCode 浅色主题主界面截图
  • Smart结构化工作流将意图转化为从想法到交付的可执行路径。
  • Efficient多 Agent 工作流让调研、实现与审阅并行推进。
  • FunHero Dungeon 让长时间编码协作更直观、更有参与感。
访问 HagiCode