RelayLLM · 纯血 AI API 中转站
一个 Key 直调 Claude 与 GPT 全系。原生上游,不复用他人响应、不降级 —— 你发出的每个 Token 都抵达官方服务器,收到的每个回复都是模型的真实输出。
🔗 接入只改一行
兼容 OpenAI 与 Anthropic 两种接口规范,官方 SDK、Cursor、LobeChat、Dify 即插即用,其余代码一个字不动
💰 价格摆在明面
官网逐个模型列出官网价与本站价,Claude 全系 2 折、GPT 4 折,随时可对照
🧮 缓存不糊弄
Prompt 缓存命中按缓存价计费,不当普通输入收。Claude 全系为输入价的 1/10
🔒 隐私边界清楚
不存储 Prompt 与模型响应内容,仅保留用量元数据供你对账
📊 用量透明
后台实时用量看板,每个 Key、每个模型花了多少一目了然
👉 注册与实时价格 https://relayllm.cc
💬 有问题找 https://t.me/relayllm?direct
💳 充值支持 USDT / TRX / 支付宝
一个 Key 直调 Claude 与 GPT 全系。原生上游,不复用他人响应、不降级 —— 你发出的每个 Token 都抵达官方服务器,收到的每个回复都是模型的真实输出。
兼容 OpenAI 与 Anthropic 两种接口规范,官方 SDK、Cursor、LobeChat、Dify 即插即用,其余代码一个字不动
官网逐个模型列出官网价与本站价,Claude 全系 2 折、GPT 4 折,随时可对照
Prompt 缓存命中按缓存价计费,不当普通输入收。Claude 全系为输入价的 1/10
不存储 Prompt 与模型响应内容,仅保留用量元数据供你对账
后台实时用量看板,每个 Key、每个模型花了多少一目了然
Please open Telegram to view this post
VIEW IN TELEGRAM
一种常见做法:后台挂响应缓存,你的问题和别人问过的够像,就把旧回复返给你,上游一分钱没花。
自查:temperature 设 1,同一段 prompt 连发两次,让它写长一点。真模型两次不可能一字不差,完全相同就是有缓存层。
RelayLLM 不复用他人响应,欢迎拿来查。
#Tips
Please open Telegram to view this post
VIEW IN TELEGRAM
同样的 Claude,省下 80%
Claude 全系 2 折,GPT 全系 4 折。官网逐个模型列出官网价与本站价,注册前就能对照。
缓存也一起打折
Claude 全系缓存读写同步 2 折。重度用户的账单里缓存往往占大头——这一项才决定「2 折」是不是真的 2 折。
便宜不等于掺水
原生上游,不复用他人响应、不降级 —— 省的是中转差价,不是模型。
Standing prices, not a promo — Claude at 20% of list, GPT at 40%, on native upstream with no response reuse.
👉 https://relayllm.cc
💳 USDT / TRX / 支付宝
#About
Claude 全系 2 折,GPT 全系 4 折。官网逐个模型列出官网价与本站价,注册前就能对照。
缓存也一起打折
Claude 全系缓存读写同步 2 折。重度用户的账单里缓存往往占大头——这一项才决定「2 折」是不是真的 2 折。
便宜不等于掺水
原生上游,不复用他人响应、不降级 —— 省的是中转差价,不是模型。
Standing prices, not a promo — Claude at 20% of list, GPT at 40%, on native upstream with no response reuse.
#About
Please open Telegram to view this post
VIEW IN TELEGRAM