文笔层:AI 味机检、标点规范化、分块大量扩写(第 1 集成稿 10805 字)
- 修复上次提交把 dfannals/cli.py 写成 0 字节的问题(它是唯一入口,导致管道不可运行) - 性别:解析 <caste>,人物表与写作素材带性别(Ral Fastenhatchets 实为女性) - 新增 dfannals/deslop.py:AI 味机械诊断(硬伤词/句式/标点,按千字密度报告) - 新增 dfannals/normalize.py:标点与结构清理(引号配对、重复段落与句子、模型自加的小节标记) - 新增 dfannals/expand.py 与 prompts/literary-expander.md:按年份场景分块大量扩写 - 专名防幻觉:每块附史料专名白名单,事后按段自动修复可疑专名 - episode 命令并进文笔层(骨架稿另存 .skeleton.md),新增 expand 命令做 A/B 对照 - 新增 notes/switched-threads.md 与 test_deslop / test_normalize 回归测试 - 提交前拦截「已跟踪文件为空」,防止上述事故复发
This commit is contained in:
@@ -44,6 +44,9 @@ PI_AUTH_JSON = HOME / ".pi/agent/auth.json"
|
||||
PI_MODELS_JSON = HOME / ".pi/agent/models.json"
|
||||
PROVIDER = "workbuddy"
|
||||
MODEL = "cn:deepseek-v4-pro"
|
||||
# 文笔层(扩写)单独选模型:创作向模型写叙事更贴地,
|
||||
# 而推理向模型(deepseek-v4-pro)天然偏总结陈词,容易写成报告。
|
||||
LITERARY_MODEL = "cn:minimax-m3"
|
||||
# 该模型是推理模型:思考与正文共用 max_tokens,必须留足
|
||||
MAX_TOKENS_CHAPTER = 16000
|
||||
MAX_TOKENS_UTIL = 4000
|
||||
@@ -66,6 +69,16 @@ WORLD_HISTORY_YEARS = 250
|
||||
CHAPTER_MIN_CHARS = 800
|
||||
CHAPTER_MAX_CHARS = 1500 # 严格按访谈定的 800–1500,不留“余量”
|
||||
|
||||
# ---------------------------------------------------------------- 文笔层(扩写)
|
||||
# 用户口径:要的是「大量扩写」——原稿是骨架,文笔层把它逐事件展开成现场。
|
||||
EXPAND_TARGET_CHARS = 8000 # 目标字数(用户选定:每集约 8000 字)
|
||||
EXPAND_FLOOR = 6000 # 低于此判太短,继续展开
|
||||
EXPAND_CEILING = 11000 # 高于此判太长,压缩
|
||||
# 一次调用写 8000 字很容易跑偏、漏事件,所以按场景分块展开,每块目标这么多字
|
||||
EXPAND_CHUNK_TARGET = 2600
|
||||
# 长文 + 可能的思考 tokens,预算要给足
|
||||
MAX_TOKENS_EXPAND = 32000
|
||||
|
||||
|
||||
@dataclass
|
||||
class Gateway:
|
||||
|
||||
Reference in New Issue
Block a user