
大家好分享一个我最近初步完成的项目今天正式开源GitHubhttps://github.com/YonRen-code/Novel-factory这个项目旨在为想写小说但是词穷的朋友解决问题基本做到了长文不崩。你给一份大纲它按批产出章节每批带一份 24 项指标的量化体检报告便于你的排查和解决。现在ai写小说常常会遇到以下的问题失忆设定漂移与自相矛盾。角色性格前后不一致、物品凭空出现又消失、人物关系悄悄变形。成因是模型没有持久记忆上下文又装不下全书。对策角色/物品/势力三本账本外置每章新事实强制入账校验写下一章前把账本当前状态装配进上下文再用向量检索召回“相似情节”补足细节记忆。时间线混乱。故事内年份倒流、跳跃、角色年龄错乱。对策时间推进只允许走计划里显式声明的额度每章推进多少正文与计划做机械核对对不上就打回蓝图层再加一道年份/年龄的合法区间校验。伏笔挖坑不填。模型极爱埋钩子也极爱忘。还有反向问题剧情实际收了坑账本却没记形成僵尸伏笔。对策伏笔做成排期状态机计划埋设章、计划兑现章、状态流转卷末强制清账——兑现、弃置或限期回收不允许悬空。叙事退化。典型形态三种对白坍缩成独白叙述、原地循环情绪的注水、以及主线连续多章停在同一悬念档位不推进。对策写手前下硬约束对白密度、事件密度、时间衔接写完有段落密度审校和体检指标把关规划层根据上一批的密度反馈调整下一批的供给。上下文预算冲突。前情摘要、账本、检索结果、伏笔视图都要进上下文加起来远超预算。对策前缀按优先级分块装配超限先裁低价值块保证写手每次拿到的都是最相关的前情。结构化输出不合规。模型偶尔在 JSON 前后拖人话、字段缺失、类型漂移。对策解析失败不允许中断流程每个结构化调用都有兜底路径降级到保守方案重试或采用默认策略。供应商不稳定。挂起、限流、质量忽好忽坏。对策按场景路由模型——写手、审校、评审等 16 个场景各自配置模型任何场景可以独立换供应商配合失败降级链和预算熔断。所以现在的工程设计是这样规划分四层卷蓝图 → 阶段蓝图 → 段计划 → 章计划。每批只章节由你决定写完之后摘要、新入账的事实、新埋的伏笔全部作为“既定事实”回灌下一批的输入。也就是说计划是滚动的但账本是永久的。每章动笔前写手拿到的输入是装配出来的本章计划、前情摘要、三本账的当前状态角色/物品/势力、一致性索引、向量检索召回的“相似情节”Qdrant、在途伏笔视图。这个输入有总预算上限约 1.8 万字符超了按块的优先级裁剪保证写手上下文永远装的是最相关的前情——这就是前后文衔接的落地方式不是模型记性好是每次都只喂它该看的。写完不算完还有一条质量管线段落密度审校挤“原地循环情绪”式的注水→ 审校门BLOCKING 级问题必须修→ 修订 → 对重要章节触发“候选挑战者”让另一个模型盲写一版、盲评审分谁赢用谁。时间推进也是锁死的每章计划必须声明 timeAdvance这章故事内推进几天/几个月正文核对不通过就打回杜绝“作者开挂快进”。每批写完跑一次批末体检24 项量化指标、四档分级。这个报告是我自己看得最多的东西举两个真实读数某批“候选挑战者触发率 83%、采纳率只有 24%”——意思是大部分重写根本没通过盲评这条链路在烧钱我据此收紧了触发条件某批“清账静默兑现 16 条”——剧情其实收了坑但摘要漏记了伏笔跨度被系统性低估得先修摘要侧再谈指标。配置要什么环境JDK 17、Maven、一个 Qdrantdocker 起一个容器就行、任意一家 OpenAI 兼容的 API keyDeepSeek / 百炼 / Kimi 我都跑过。配置集中在 novel-generation.yml 三段llm默认对话模型的 base-url / model / api-key。key 不进仓库yml 里写的是 ${LLM_API_KEY}、${LLM_BASE_URL} 占位符从环境变量注入module.scene-models16 个生成场景写手、审校、修订、盲评、摘要…各自指定模型、输出上限、温度还支持某几个场景挂独立的 base-urlkey比如评审用异供应商的模型保证盲评真是“盲”的module.embedding-api嵌入独立分区自己的地址、密钥、模型、向量维度。输入是一个 JSON书名、题材、大纲chapterGoal按“章段时间标记”格式写仓库 sample 里有 3 章的试点样例、总章数。然后 mvn package 起服务浏览器打开 docs/dev-ops/static/index.html 就是工作台。跑起来之后模型、key、场景路由、嵌入分区全部可以在设置页运行时热改存本地 override 文件跨重启保留不用动 yml 重启。成本和没做好的每章 8-25 万 token一批 5 章 80 万上下这是“全链路审校候选”的定价。代码约 5.5 万行 测试接近一半。对于模型的配置代码中给的不同职责的示例模型算是比较成功的案例有钱的朋友也可以开gpt和claude试试。就我的测试来看其实已经做到了50w字的长文不崩但是还做不到完全不需要人工审核所以我没有选择设计一次跑多本小说的架构。对于手头不宽裕的朋友如果是学生那么可以领取阿里的300元学生优惠对于qwen3.8-flashdeepseek-4.1-flashdeepseek-v4-proglm-5.2包括嵌入式模型等等部分模型是可以免费调用API在上述模型的搭配下跑出来的小说质量上比我搭配的示例模型效果可能差点但是经过Gemini或者豆包修改后也勉强做到能发布了。最后总结一下这个项目还在早期能跑通但不算完美还需要不断的调整欢迎试用、提 issue。觉得有意思的话可以给个 Star 支持一下。