两条路线
| 路线 | 成本 | 适合 |
|---|---|---|
| API 派 | 月 ¥0-50 | 大多数人:DeepSeek-V3 / GLM-5-Flash,任意电脑 |
| 本地派 | 整机 ¥7-10k | 隐私刚需、无限量:Qwen3-32B 需 24G 显存 |
一致性工具链(比模型更重要)
- 大纲分层:总纲(200 字)→ 卷纲 → 章纲,每次生成只注入当前章纲 + 上一章摘要;
- 角色卡:JSON 格式(身份/目标/口癖/当前状态),每章开头注入,章末更新;
- 向量库:世界观设定、伏笔、地名存 SQLite + embedding,按剧情检索 Top-3;
- 温度分层:大纲 0.3、正文 0.7、对话 0.9——不同环节不同随机度。
本地派硬件
GeForce RTX 5060 Ti 16GB
· 入门首选。带宽是短板,但 16G 显存让 Flux 和 14B 模型进得去,入门唯一推荐。
16G 显存
AI 算力 36
本地写作甜点:32B Q4 长上下文(轻度 offload)流畅输出
¥3,599
京东比价DDR5 6000 64GB(2×32)
· 大模型玩家甜点。CPU offload 跑 32B、多开 ComfyUI 都从容。
64GB
offload 余量 + 向量库常驻,写作机的隐形主力
¥1,199
京东比价常见问题
AI 写小说,最好的模型是哪个?
付费 API:DeepSeek-V3 综合最强且便宜;免费:GLM-5-Flash 起步。本地:Qwen3-32B 中文长文质感最好(需 24G 显存),预算低就 14B(12G)。文笔差距 < 一致性管理的重要性——工具链才是分水岭。
几十万字后人物性格崩了怎么办?
三件套:①角色卡(固定格式的人设/口癖/关系,每章注入);②向量库存世界观设定,按需检索而非全量塞入;③每章结尾生成摘要,滚动替换原文。这套流程能把上下文压在 32K 内,中小模型也能稳。