AI 写小说:模型选择与工具链完整指南

短答案

API 派:DeepSeek-V3 + 大纲分层;本地派:Qwen3-32B(24G 显存)。一致性靠工具链(向量库 + 角色卡 + 章节摘要),不靠硬塞上下文。

两条路线

路线成本适合
API 派月 ¥0-50大多数人:DeepSeek-V3 / GLM-5-Flash,任意电脑
本地派整机 ¥7-10k隐私刚需、无限量:Qwen3-32B 需 24G 显存

一致性工具链(比模型更重要)

  1. 大纲分层:总纲(200 字)→ 卷纲 → 章纲,每次生成只注入当前章纲 + 上一章摘要;
  2. 角色卡:JSON 格式(身份/目标/口癖/当前状态),每章开头注入,章末更新;
  3. 向量库:世界观设定、伏笔、地名存 SQLite + embedding,按剧情检索 Top-3;
  4. 温度分层:大纲 0.3、正文 0.7、对话 0.9——不同环节不同随机度。

本地派硬件

GeForce RTX 5060 Ti 16GB · 入门首选。带宽是短板,但 16G 显存让 Flux 和 14B 模型进得去,入门唯一推荐。
16G 显存 AI 算力 36

本地写作甜点:32B Q4 长上下文(轻度 offload)流畅输出

DDR5 6000 64GB(2×32) · 大模型玩家甜点。CPU offload 跑 32B、多开 ComfyUI 都从容。
64GB

offload 余量 + 向量库常驻,写作机的隐形主力

完整三档配置见 AI 写作场景指南,模型显存明细见模型库。

常见问题

AI 写小说,最好的模型是哪个?
付费 API:DeepSeek-V3 综合最强且便宜;免费:GLM-5-Flash 起步。本地:Qwen3-32B 中文长文质感最好(需 24G 显存),预算低就 14B(12G)。文笔差距 < 一致性管理的重要性——工具链才是分水岭。
几十万字后人物性格崩了怎么办?
三件套:①角色卡(固定格式的人设/口癖/关系,每章注入);②向量库存世界观设定,按需检索而非全量塞入;③每章结尾生成摘要,滚动替换原文。这套流程能把上下文压在 32K 内,中小模型也能稳。
↑