任务感知分类
代码、长文档、翻译、摘要、写作、多模态 —— 网关读你的 prompt,识别任务类型,把请求派给该类任务国际权威评测(以 Artificial Analysis 为主)最强的候选模型。代码走最强代码模型,长文档走最大上下文窗口。
AI 原生工具,已在全球 App Store 上架。
下面每一款应用都围绕同一个问题展开:AI 究竟在哪里能让一项真实任务变得显著更简单、更快、更准?我们不做噱头 —— 每个功能都物有所值。
健康
健康教练
DailyKit 把一位私人健康教练装进你的口袋。内置番茄钟、具备频率目标的智能习惯追踪,以及能发现你可能忽略的规律的心情日记 —— 全部由一个能根据你的周节律自适应学习的端侧大模型驱动。
效率
厨房助手
ShelfSense 知道你的冰箱里有什么。拍一张货架、手动记录、或扫一张小票 —— AI 会跟踪保质期,推荐能消耗你现有食材的菜谱,并告诉你什么时候该补货。
健康健身
宠物营养教练
PetPlate AI 是你的私人宠物营养教练,基于 AAFCO 与 AAHA 公开标准。拍一张宠物食品包装袋的照片,就能按物种与生命阶段对照官方营养表打分。每只宠物独立跟踪体重、体况评分与喂食历史 —— 为把宠物当家人的主人而生。
财务
自由职业者税务估算
QuarterlyTax 是一款专为自由职业者每年向 IRS 缴纳的 4 次预估税款设计的 iOS 应用。2 分钟内算出本季联邦税额,按类目跟踪 1099 收入与可抵扣支出,并在每个截止日前 7 天提醒 —— 再也不会因为少缴而被罚息。
更多应用即将推出。
HOUJIAYAN Intelligence · 智能路由网关
不用选模型,让平台替你挑。一个 OpenAI 兼容端点、一把 key 覆盖五家厂商 16 个模型 —— 不用注册 5 个平台。智能路由把每个请求自动派给最合适的模型。
我们把五家大模型供应商聚合成单一 OpenAI 兼容 API —— 但我们不止于聚合。网关会读你的请求、识别任务类型,然后路由到当下最便宜且最合适的模型。把 model 设为 auto,告诉我们你的偏好(成本 / 效果 / 均衡),剩下的交给网关。按量付费,无最低消费,不走企业采购流程。
AI 时代的导诊台 —— 告诉我们你要做什么,我们把你领到对的专家面前。
走进一家医院,让你自己选科室、选医生,你大概率挂错号。走进一家有专业导诊台的医院,根据你的症状直接把你领到最对的医生面前,效率最高,也绝不挂错。HOUJIAYAN 的智能路由,就是你的 LLM 调用导诊台。
代码、长文档、翻译、摘要、写作、多模态 —— 网关读你的 prompt,识别任务类型,把请求派给该类任务国际权威评测(以 Artificial Analysis 为主)最强的候选模型。代码走最强代码模型,长文档走最大上下文窗口。
候选模型按国际公开评测分排序,只有与第一名差距 ≤5 分的一流模型才进质量带。水平不够的模型再便宜也不派 —— 先定质量,再谈价格。
preference: quality(默认)只求带内最强 —— 默认推荐,追求最好结果;balanced 成本、质量、延迟均衡可选;cost 在带内能省则省 —— 自动选带内最便宜,同价时选延迟更低、更稳定的通道。每个请求都按你的偏好来。
网关每 30 秒探测一次上游。一个通道故障,流量自动切到健康通道,任务不中断 —— DeepSeek 限流了请求落到 Qwen,Qwen 尾延迟飙升切到 MiniMax。你的代码不用处理任何一家供应商的故障。
每个响应都带 routing_decision 字段:选了哪个模型、候选有哪些、为什么赢、评分来自哪个评测源。没有国际权威评分的新模型绝不混入智能路由,只能手动指定 —— 强弱判断全部可追溯国际公开评测。model: "deepseek-v4-pro" 显式锁定仍然有效。
curl https://api.houjiayan.com/v1/auto/chat/completions \
-H "Authorization: Bearer $HOUJIAYAN_KEY" \
-H "Content-Type: application/json" \
-d "{\"model\": \"auto\", \"preference\": \"cost\", \"messages\": [{\"role\": \"user\", \"content\": \"写一个验证邮箱地址的 Python 函数。\"}]}" {
"id": "chatcmpl-hjy-...",
"model": "deepseek-v4-flash",
"routing_decision": {
"selected": "deepseek-v4-flash",
"candidates_considered": ["qwen3.7-max", "doubao-seed-code"],
"reason": "code 任务 + preference=cost,deepseek-v4-flash $/1M 最低且代码能力评分 0.82",
"estimated_savings_vs_runner_up": "31%"
},
"choices": [{
"message": {
"role": "assistant",
"content": "def is_valid_email(email: str) -> bool:\n ..."
}
}]
} 注意:你没选模型。你只告诉网关你想要什么(一个 Python 函数,快且便宜),它替你选了 deepseek-v4-flash。routing_decision 块告诉你为什么、比其他候选便宜多少。
我们不是「卖 key 的人」,而是一层把多家上游聚合起来的技术路由层 —— 你的请求被送到当下最合适的那一家。
一个端点,OpenAI 兼容;同时支持 OpenAI / Anthropic / Gemini 的消息格式。任何写给这三家 API 的客户端,只需改一行 base_url,其余代码不变。
一把 Key 背后是五家上游供应商、16 个模型 —— 不用注册 5 个平台、不用签 5 份合同、不用走 5 遍财务流程。换模型只需要改一个请求字段。
按 token 计费(输入/输出分开计),价格为模型官方原价;充值时按支付通道外加服务费:加密货币 5.0%、非加密支付 5.5%(充值 ¥100 到账 ¥100,实付 ¥105.00 / ¥105.50)。没有最低充值、没有余额过期、没有按席位收费。每个模型的分级费率表对外公开、按月更新。
由 Cloudflare 在全球边缘节点加速回源。故障切换与单 Key 限流都在网关层处理,上游是否健康对你的代码完全透明。
把 model 设为 auto,网关自动识别任务类型(代码/长文/翻译/总结/写作等),派给该类任务国际权威评测最强、且落在质量带内的模型 —— 带内选最便宜,同价选更稳。双通道容灾:一个通道故障自动切换,任务不中断,你的代码侧基本无感知。
公开端点 99% 月度可用性目标,公开状态页可查。多上游路由意味着单一供应商故障很少会转化为用户可见的停机。
混搭都行 —— 同一个端点、同一种请求格式。或者直接交给智能路由。
性价比高、速度快,代码与结构化推理能力强
→ 高并发场景默认选择。聊天用 flash,复杂推理用 pro。
阿里旗舰 —— 中文与多语种任务表现突出
→ 中文 Agent、翻译、带中文注释的代码。
轻量、多语种、低延迟
→ 短文本生成、端侧级别的响应速度、低成本实验。
字节系模型 —— 中文表现强,面向 C 端调优
→ 中文内容、对话口吻、面向消费者的产品界面。
k3 旗舰全能、编程顶尖;k2.7-code 系列编程专项;k2.6 高性价比通用
→ 智能体编程与长上下文推理(k3,1M 上下文)、专项代码负载(k2.7-code)、成本敏感的通用任务(k2.6)。
OpenAI 兼容。任何写给 OpenAI API 的客户端都可以直接替换 base_url 接入。
https://api.houjiayan.com/v1 curl https://api.houjiayan.com/v1/chat/completions \
-H "Authorization: Bearer $HOUJIAYAN_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "Hello"}]
}' curl https://api.houjiayan.com/v1/models \
-H "Authorization: Bearer $HOUJIAYAN_KEY" 自助注册已上线。注册、生成 Key、开始调用,一分钟内完成。新用户注册即送 10 万免费额度(约 ¥6.6)。
充值在控制台「钱包」在线完成:微信支付或 USDT-TRC20,外加支付通道服务费(5.5% / 5%),支付确认后即时到账、即充即用。新账户注册即送 10 万免费额度(约 ¥6.6),无需信用卡。
按量付费,以人民币 (¥) 定价与计费。详细费率表随 API Key 一同发送。
| 模型 | 输入 / 1M tokens | 输出 / 1M tokens |
|---|---|---|
| DeepSeek v4-flash | ¥1.00 | ¥2.00 |
| DeepSeek v4-pro | ¥3.00 | ¥6.00 |
| Qwen3.7-Plus | ¥2.00 | ¥8.00 |
| MiniMax M3(≤512K 档) | ¥2.10 | ¥8.40 |
| MiniMax M3(512K~1M 档) | ¥4.20 | ¥16.80 |
| 火山方舟(豆包) | ¥1.24 | ¥8.10 |
模型按 token 计费(输入/输出分开计),价格为模型官方原价,网关对 token 分文不加。充值时按支付通道外加服务费:加密货币 5.0%、非加密支付 5.5% —— 充值 ¥100 到账 ¥100,支付时加密通道实付 ¥105.00、非加密实付 ¥105.50。服务费用于覆盖网关运营成本(算力、隧道带宽、回复你工单的时间)。无任何隐藏费用,无最低充值额。
同一档模型能力,两种抵达方式。模型官方原价(充值外加服务费:加密 5.0%、非加密 5.5%) vs 直连国际厂商公开报价,2026 年 7 月。
| HOUJIAYAN 上的模型 | 输入 / 输出 (¥/1M) | 对标国际厂商 | 直连价 | 节省 |
|---|---|---|---|---|
| DeepSeek v4-flash | ¥1.00 / ¥2.00 | GPT-5.4-mini | ¥5.09 / ¥30.52 | 80% / 93% |
| DeepSeek v4-pro | ¥3.00 / ¥6.00 | GPT-5.4 | ¥16.95 / ¥101.73 | 82% / 94% |
| MiniMax M3(≤512K 档) | ¥2.10 / ¥8.40 | Claude Sonnet 4.6 | ¥20.35 / ¥101.73 | 89% / 91% |
| Qwen3.7-Plus | ¥2.00 / ¥8.00 | Gemini 2.5 Flash | ¥2.03 / ¥16.95 | 1% / 52% |
声明:我们不是 OpenAI / Anthropic / Google 的授权经销商。右侧国际列仅供对比参考 —— 本网关并不代理这三家。HOUJIAYAN 当前聚合五家中国持牌模型供应商(DeepSeek / 阿里 / MiniMax / 火山方舟 / Moonshot),对外暴露单一 OpenAI 兼容接口。
同一档模型,三种抵达方式。免费档、我们的付费网关、西方主流聚合 —— 给正在选「生产流量往哪发」的开发者参考。
| 维度 | NVIDIA NIM(免费) | HOUJIAYAN(付费) | OpenRouter(付费) |
|---|---|---|---|
| 价格 | ¥0 | 官方原价 + 充值外加服务费(加密 5.0% / 非加密 5.5%) | 透传 + 加价 |
| 限速 | ~40 RPM,软 | 按等级 60 / 200 / 600 RPM,硬 | 1000 RPM(付费) |
| 模型 | ~140(含中文开源) | DeepSeek / Qwen / MiniMax / 火山方舟 / Moonshot | ~200(各主流实验室) |
| SLA | 无 — 「开发和测试」 | 99% 月目标 + 公开 status page | 按等级 |
| 发票/收据 | 无(免费层) | 有 | 有 |
| 人工支持 | 论坛 | 邮件,工程师本人 | 邮件(付费) |
| Failover | 无 | 多上游自动重试 | 按 provider |
| 国内访问 | 不稳(GFW) | Cloudflare 边缘,稳定 | 不稳 |
NVIDIA NIM 是笔记本跑 demo、周末黑客松的好选择 —— 那场景我们也会推荐它。当 API 是面向客户的界面、周一早上宕 6 小时你不好意思解释的时候,「官方原价 + 充值外加服务费(加密 5.0%、非加密 5.5%)」就回本了。
2026-07-11 在 build.nvidia.com 实测验证
NVIDIA 自己说得很清楚:免费层定位开发与测试。小字部分比大字更重要:
免费 key 是好的起点。可靠的 key 才是你敢上线的东西。
开发者在注册前最常问的几个问题。