外观
第三方自部署指有算力的公司自己部署开源模型再对外卖 API。优点是模型全、价格低、一个 Key 通用;缺点是质量参差,而且不等于没有审核——开源模型自带安全训练,各平台是否再叠加外审则没有统一规律。
闭源模型请走官方渠道,本页只讲开源模型。
国内平台
硅基流动
- 模型:开源模型集散地,DeepSeek、Qwen、GLM、Kimi、混元等基本都能找到;上架快、下线也快,以模型广场为准。
- 审核:平台没有外审,内容限制来自模型自身。
- 限制:国内直连;强制实名,未实名账号功能受限;按速率分档限速。
- 注意事项:官方公告 Chat 模型会忽略
repetition_penalty,酒馆预设里的重复惩罚参数完全失效,需要改用其它采样参数缓解复读;是否支持上下文缓存取决于具体模型,接入前先确认。
ModelScope 魔搭
- 获取方式:模型社区附带的 API-Inference 服务,OpenAI 兼容。
- 免费额度:长期口径是每日 2000 次调用,单模型另有更低限额,以实际为准。
- 限制:需要绑定阿里云账号并完成实名;调用的是社区托管实例,长上下文与并发稳定性一般。
- 注意事项:适合轻度试用,不建议当长期主力。
PPIO 派欧云
- 模型:新开源模型上架很快,Kimi 系列多次首发于此。
- 审核:用户协议明确禁止色情等内容,违规封号、数据 7 天后删除、预付费不退。
- 限制:必须实名;未验证账号速率极低;按充值档位分层限速。
- 注意事项:对角色扮演类内容基本不可用。
无问芯穹
- 限制:无免费额度、按 token 后付费;基础档仅 12 RPM / 12K TPM,对酒馆的高频长对话偏紧。
- 注意事项:更新积极,DeepSeek 新版本跟进较快。
云厂商托管(腾讯云 / 百度千帆)
- 定位:云厂商同时托管自研模型与开源模型,如腾讯云 TokenHub 上就有混元、DeepSeek、Qwen。
- 审核:条款明确会对输入输出进行审核并拦截违规内容,违规可封号。
- 注意事项:合规、可开票、面向企业;个人玩酒馆性价比低,角色扮演内容免谈。
海外平台
共同点:不额外加平台外审,审核来自模型自身;需要海外支付方式与网络条件。
DeepInfra
- 上新快、并发高,常见的开源新模型基本首日可上;免费额度口径不一,以官网为准。
Together AI / Fireworks AI
- 老牌推理平台,模型齐全,按 token 计费;无通用免费额度,个别免费模型除外。
Groq
- 速度极快,有免费层;但模型偏小,且 TPM 上限会卡长 prompt,不适合长上下文角色扮演。
Chutes
- 去中心化算力,价格便宜;账号体系特殊,系统分配的密码丢失后无法找回;稳定性取决于节点。
Nebius AI Studio
- 欧洲平台,以开源模型为主;模型目录更新稍慢,偶尔有大额试用额度活动。
通用注意事项
- 「自部署」不等于「不降智」:量化精度、部署水平、上下文长度都可能缩水,同一个开源模型在不同平台的表现可能差很多。
- 「自部署」不等于「没有审查」:开源模型自带安全训练,拒答倾向并不低;各平台是否再叠加外审没有统一规律,接之前先确认。
- 参数陷阱:部分平台会忽略或固定某些采样参数(如上面的
repetition_penalty),酒馆预设需要相应调整。 - 一切以模型广场和控制台为准:模型名、价格、免费额度、限速政策变动极快,国内平台还要留意实名要求。