酒馆用什么 API?按文笔、价格、上下文一次排清楚

最后更新:

大多数酒馆玩家直接用 deepseek-v4-flash 就够了,性价比全场第一,重度玩家月成本也只有几十元。追求文笔上限选 Claude(仅限普通创作向),超长对话选 kimi-k2.6,中文卡优先看 glm-5。

直接抄结论:四类玩家对号入座

接入方式全部一样:OpenAI 兼容接口,Base URL 填 https://api.kkaiapi.com/v1,一个 key 通吃所有模型,换模型只改一个模型 ID。觉得 Flash 细节不够,直接把模型名改成 deepseek-v4-pro 就是升级位,其余配置一个字不用动。 下面按四个维度解释为什么这么排。

  • 不想研究,只想便宜好用:deepseek-v4-flash。社区首选,性价比之王,响应快,拒答少,天天玩也不心疼。
  • 主玩中文卡,想要更细腻的对白:glm-5。中文语感在同价位里最好,情绪描写不生硬。
  • 群聊卡、百层楼长对话:kimi-k2.6。超长上下文,几百层之后人设依然稳。
  • 追求文笔上限的普通创作向玩家:claude-sonnet-4-6 日常写,claude-opus-4-7 留给关键剧情点播。

四个维度排型:文笔、上下文、稳定性、定位

文笔看两件事:描写有没有层次,角色会不会写着写着变成另一个人。Claude 系在这两点上断层领先,缺点是内容政策最严格,只适合普通创作向的剧情和世界观写作。DeepSeek V4 系胜在均衡,文笔在线、速度快、几乎不拒答,是酒馆社区当前用量最大的一系。GLM-5 的中文对白最自然,Kimi 的强项是长线叙事,几百轮之后仍记得早期伏笔。 稳定性一列写的是社区长期反馈,不是实验室数据。用量越大的模型,坑被踩得越干净,出问题也越容易搜到解法,这本身就是新手该选热门模型的理由。

具体上下文窗口与参数以模型页为准。
模型 ID文笔上下文角色扮演定位
deepseek-v4-flash流畅自然,节奏快标准,单人卡足够默认首选,性价比之王
deepseek-v4-pro比 Flash 细节更足标准预算宽裕的升级位
glm-5中文对白细腻标准中文卡优先
kimi-k2.6长线叙事稳,不崩人设超长,群聊卡首选百层楼长对话
claude-sonnet-4-6描写层次感强普通创作向的文笔上限
claude-opus-4-7全场最强文笔关键剧情点播

每晚烧多少 token,每月花多少钱

酒馆的计费特点是:每发一条消息,角色卡、世界书、聊天记录会整体重发一遍,所以输入 tokens 占开销的绝对大头,上下文越长单轮越贵。按社区常见强度分三档:轻度玩家每晚约 30 轮、烧 50 万 tokens 上下;中度玩家每晚约 100 轮、约 155 万 tokens;重度玩家 200 轮起步,每晚 300 万 tokens 以上。 下表按中度玩家计算月成本:每晚 100 轮、单轮平均 1.5 万 tokens 上下文,每月 30 晚,合计约 4500 万输入加 150 万输出 tokens。轻度玩家把估算除以三,重度玩家乘以二,量级就出来了。grok-4.5 同为按 token 计费,按同一口径估算。

按量计费,余额只在实际调用时扣,不玩不花钱。
模型kkaiapi 价格(¥/1M,输入/输出)官方价中度玩家月成本估算
deepseek-v4-flash¥0.5 / ¥1¥1 / ¥2约 ¥24
glm-5¥3 / ¥13.5¥4 / ¥18约 ¥155
kimi-k2.6¥5 / ¥20¥6.5 / ¥27约 ¥255
claude-sonnet-4-6¥3 / ¥15美元结算约 ¥158
claude-opus-4-7¥5 / ¥25美元结算约 ¥263
gpt-5.5¥4 / ¥25美元结算约 ¥218
grok-4.5¥2 / ¥6¥14 / ¥42约 ¥99

三分钟接入酒馆

第一步,到充值页用支付宝或微信充值,拿到 sk- 开头的 API key。第二步,在酒馆的 API 连接页按下面的参数填。第三步,点连接测试,亮绿灯就能开聊。

SillyTavern 连接配置
API 类型:        聊天补全 (Chat Completion)
聊天补全来源:     自定义 (兼容 OpenAI)
自定义端点:       https://api.kkaiapi.com/v1
API 密钥:        sk-你的密钥
模型 ID:         deepseek-v4-flash

换模型只改最后一行,例如 glm-5、kimi-k2.6、claude-sonnet-4-6。
注意:JanitorAI 这类网页工具要填完整端点
https://api.kkaiapi.com/v1/chat/completions
连不上时,先用 curl 验证 key
curl https://api.kkaiapi.com/v1/chat/completions \
  -H "Authorization: Bearer sk-你的密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [{"role": "user", "content": "自我介绍一下"}]
  }'

内容政策:选模型前先看清规则

不同厂商对生成内容有各自的公开政策,选错模型最直接的后果就是频繁拒答,体验稀碎。Anthropic 明确禁止露骨内容,所以 Claude 只推荐给普通创作向玩家写剧情、搭世界观,越界内容它会直接拒绝,别浪费钱去试。xAI 的公开政策对成人向虚构文本相对宽松,想了解可以自己去读官方条款。国产模型各有平台规范,拿捏不准就先看我们整理的各模型内容政策科普。 选模型的正确思路是比较创作自由度、角色一致性和长上下文表现,在规则内把卡玩好。任何绕过平台审核的所谓技巧都不在本文范围内,那类玩法既不稳定,也可能导致账号被上游封禁。

常见问题

酒馆用什么 API 最省钱?

选 deepseek-v4-flash。按上文的估算表,中度玩家一个月二十多元,轻度玩家个位数,重度玩家也就几十元。它同时还是社区反馈最多的模型,便宜和好用在这里不冲突。

酒馆可以用 Claude 吗?

可以,claude-sonnet-4-6 和 claude-opus-4-7 都能直接在酒馆里用,文笔是全场上限。但 Anthropic 内容政策严格,只适合普通创作向剧情。常见玩法是日常挂 DeepSeek,写关键剧情时临时切 Claude。

为什么榜单里没有 Qwen?

Qwen 综合能力不差,但在角色扮演场景容易出戏,叙事套路化明显,社区反馈一般,所以不推荐拿它玩卡。写代码、做翻译它更合适。

酒馆连接报错怎么排查?

先用上文的 curl 命令验证 key 是否可用。最常见的三个错误:端点漏了 /v1、密钥没带 sk- 前缀、余额不足。curl 通了酒馆还报错,就是酒馆侧配置问题,按报错关键字查代理报错排查手册。

上下文要多长才够用?

单人卡把发送的历史控制在 1 万 tokens 左右就很流畅,标准上下文的模型全部够用。群聊卡和百层楼玩法选 kimi-k2.6。注意上下文越长每轮越贵,酒馆里限制发送的历史层数是最有效的省钱开关。

充值支持支付宝吗?最低充多少?

支持支付宝和微信支付,按量计费,没有订阅,余额用完再充。到充值页付款后 key 即时生效,填进酒馆就能玩。