OpenAI 兼容 API 一行接入 · 竞价市场自动拿全网最低价 · LLM/绘图/视频生成全任务类型 · 分片执行 + 交叉验证的可信算力 · 按有效产出计费
从协议层到产品层的完整闭环,不是 PPT 架构——每个能力都在公网运行中
/v1/chat/completions 完整协议(含 SSE 流式)。openai SDK、LangChain、ChatBox 等 ChatGPT 生态客户端改一个 base_url 即可接入,零改造成本。
models.list ✓ 流式 ✓ usage 真实计量节点利用率驱动动态报价:空闲降价抢单、繁忙涨价限流。:floor 变体自动按全网最低价计费路由,实时价差最高 5 折。
任务拆分多分片并行执行:角色匹配 + 模型能力路由 + 负载感知 + 信誉风控。32B 大模型任务精确路由到唯一具备该能力的节点。
模型精确路由 · 断线任务迁移确定性输出哈希重算比对,LLM 输出审计证明(模型/输入/输出哈希/token 数证据链)。作弊节点信誉扣分停止派单,全网公示。
交叉验证 · 审计证明只按真实计量收费:LLM 按实际生成 token(eval_count)、绘图按 kpx·step、视频按渲染帧数。托管控费 + 幂等结算 + 拒绝退款,账目永平可审计。
真实计量 · 账目守恒开源视频模型一键接入:Wan2.1 / HunyuanVideo / CogVideoX / LTX-Video,节点装好 ComfyUI 即入网接单。/v1/videos 异步作业 API,按渲染帧计费,产出 mp4 直接分发。
家庭宽带、宿舍、机房——无公网 IP 也能接入。单 WebSocket 连网关即入网,断线指数退避自动重连归网,收益实时入账。
一条命令 · 断线自动归网致敬 NVIDIA PAIR 的「Personal AI Router」理念,并把它推向更远——设备不挑网络、大任务多机分片、闲置时段自动出租
游戏 PC、Mac、旧笔记本——家庭宽带无公网 IP 也能入池。mTLS 加密通道,断线自动归网,人在公司也能调家里的卡。
NAT 友好 · 断线归网请求级择优执行:哪台空闲用哪台。32B 大模型任务自动分片到多台设备并行计算,单机跑不动的任务全家一起跑。
分片并行 · 模型精确路由OpenAI / Anthropic / Ollama 三协议兼容:ChatBox、LM Studio、Claude Code、Codex CLI 改一个 base_url 直连家庭算力池。
Ollama · LM Studio 直连睡觉、上班的闲置时段,算力自动进入竞价市场出租——这是与 PAIR 最大的不同:你的路由器不只是路由器,还是收益节点。
闲置出租 · 费用回流# 游戏 PC(RTX 4090 · 大模型岗) python3 scripts/public_node.py --gateway wss://t2pool.com/ws \ --id home-pc --models qwen2.5:14b,llama3.1:8b --ollama # Mac Studio(中模型 + 嵌入岗) python3 scripts/public_node.py --gateway wss://t2pool.com/ws \ --id studio-mac --models qwen2.5:7b --ollama # 旧笔记本(调度/计量岗 · 零 GPU 也有收益) python3 scripts/public_node.py --gateway wss://t2pool.com/ws \ --id old-laptop --hw low
from openai import OpenAI client = OpenAI( base_url="https://t2pool.com/v1", api_key="门户账号token", ) r = client.chat.completions.create( model="qwen2.5:14b:floor", messages=[{"role": "user", "content": "帮我总结这份周报"}], ) print(r.model_extra["mesh"]) # 看:这次跑在哪台设备上
| 能力维度 | ◆ Token2Pool 个人路由 | NVIDIA PAIR |
|---|---|---|
| 定位 | 个人路由 + 全球算力市场 | 个人 AI 路由器(局域网) |
| 组网范围 | 广域网——设备在任何网络均可入池,NAT 友好 | 同一局域网,mDNS 自动发现 |
| 路由粒度 | 请求级择优 + 分片并行,多机协同跑大模型 | 请求级,单节点执行 |
| 硬件门槛 | 任意 GPU / CPU 设备,旧笔记本也能上岗 | RTX 20 系+ / Apple M4+ |
| 客户端协议 | OpenAI + Anthropic + Ollama 三协议 | Ollama / LM Studio 兼容 |
| 闲置算力 | 自动进入竞价市场出租,按有效产出计费 | 仅限自用 |
| 信任机制 | mTLS 加密 + 交叉验证 + 信誉风控 | 自有设备,天然可信 |
| 开源 | 节点软件开源(Apache-2.0 兼容生态) | Apache-2.0 |
PAIR 解决了「一个人的算力怎么路由」,Token2Pool 回答「全世界的算力怎么撮合」——而当你的设备闲置时,它自动成为市场的供给方。
以下价格来自正在运行的网络——节点竞价形成的真实市场价,每 8 秒刷新
| 模型 | 类型 | 参数量 | 最低价 / 1k tokens | 牌价 | 节省 | vs 官方 API | 供给节点 | 变体 |
|---|---|---|---|---|---|---|---|---|
| 加载实时报价中… | ||||||||
调用 qwen2.5:7b:floor 即按最低价消费 · 完整数据见 市场 API
官方对比口径:网络实时最低价(按积分→人民币参考汇率 0.01 折算)vs 官方牌价(输入/输出均价,2026-09 核实)· 差价随节点竞价实时变动
四套界面一个端口,覆盖消费者、节点运营者、开发者、运维全角色
OpenAI Chat / Responses + Anthropic 三协议,你的现有代码只需要改一个 base_url
from openai import OpenAI client = OpenAI( base_url="https://你的网关/v1", api_key="门户账号token", ) r = client.chat.completions.create( model="qwen2.5:7b:floor", # :floor = 全网最低价 messages=[{"role": "user", "content": "你好"}], ) print(r.choices[0].message.content) print(r.model_extra["mesh"]) # 扩展:执行节点/费用/计量
GET /v1/models 模型清单(含三档实时报价)POST /v1/chat/completions 对话补全(流式/非流式)POST /v1/responses Responses 协议(Codex CLI ≥0.5 直连)POST /v1/messages Anthropic 协议(Claude Code 直连)POST /v1/videos 视频生成(Sora 风格异步作业)GET /api/market/prices 市场价格矩阵WS /ws 节点接入 + CLI 会话入口
Claude Code:ANTHROPIC_BASE_URL 两行环境变量,claude-* 模型名自动映射(支持 :floor 五折通道);Codex CLI 走 /v1/responses(新版原生协议);Cline / ChatBox 等 OpenAI 兼容工具同理。
三协议均支持 tools 定义透传:请求带 tools 数组即注入工具契约,模型按协议返回结构化调用(chat 层 tool_calls / Responses 层 function_call / Anthropic 层 tool_use),Agent 工具循环开箱即用。
每个响应带 usage(真实计量)与 mesh 扩展字段(task_id / executor / fee)。充值走卡密,提现走审核工单,流水全程可审计。
# Claude Code(Anthropic 协议,claude-* 自动映射网络模型) export ANTHROPIC_BASE_URL="https://你的网关" export ANTHROPIC_API_KEY="门户账号token" export ANTHROPIC_CUSTOM_HEADERS='{"X-Auth-Token": "门户账号token"}' # 公网代理场景 # Codex CLI(Responses 协议,0.5x+ 原生支持) export OPENAI_BASE_URL="https://你的网关/v1" export OPENAI_API_KEY="门户账号token" # ~/.codex/config.toml 中 model_provider 指向上方网关即可, # gpt-*/codex-* 自动映射网络模型,tools/function calling 直接可用
闲置 GPU / 工作站 / 机房服务器,5 分钟变成网络中的收益节点
安装 Python 3.11+,一条命令接入。无公网 IP 要求,自动探测硬件跑分入网。
--models 声明可跑模型;装了 Ollama 用 --ollama 直接真实推理计费。
执行/计量/调度多岗位分润,实时入账 JSONL 账本;后台报表随时查看、申请提现。
# 模拟算力接入(零依赖演示) python3 scripts/public_node.py --gateway wss://你的网关/ws --id my-gpu-node --hw high # 真实推理接入(本机 Ollama) python3 scripts/public_node.py --gateway wss://你的网关/ws --id my-gpu-node \ --models qwen2.5:7b,llama3.1:8b --ollama
每笔任务费用按贡献分配,实时结算
国内积分版:生态池定向补贴早期节点;通缩版支持销毁通道