文章目录
承接上一篇:载体能控了,曲线能不能控?
承接AI网文写作实验笔记(十):AI 写情绪只有对话拿得出手。
系列走到 Part 10,能控制的东西又多了一样:每段用什么载体承载情绪(载体蓝图,80% 遵守)。但"一段之内情绪怎么起伏"还是靠 AI 自由发挥——写之前我们只规定了"这段是对话、那段是动作",没说"情绪第几段最高、压抑多久才爆"。
这篇问的是下一个层次:情绪曲线的"形状",能不能按指令控制?
具体是两个结构参数:
- 峰值位置:情绪最高点能不能放到指定的位置(50%?70%?90%?)
- 压抑-释放:"压抑多久、释放多猛"能不能指定?
如果这两个能控,配合 Part 10 的载体蓝图,“情绪曲线"就能从"AI 随机发挥、看完再调"走向"人先指定,AI 照做”——这是从"写作"到"编程"的关键一步。
本篇实测下来:一强一弱——压抑-释放能控(统计显著),峰值位置只有趋势(统计不显著)。下面细说。
写给谁: 看完 Part 10、想知道"除了载体,情绪的高度和节奏能不能也控制"的作者。
本篇的实验目的(两个实验,各回答一个问题)
实验一(峰值位置): 让 AI 把情绪峰值放到 50% / 70% / 90%,它会不会照做?放得准不准?——第一节设计、第二节测量、第三节给结果。
实验二(压抑-释放): 让 AI"压抑得久一点、再爆",它会不会自动把释放推得更猛?——第一节设计、第二节测量、第四节给结果。
最终问题: 这两个参数能不能都进正稿流程(配合载体蓝图),把"情绪曲线"变成一个可以指定的环节?——第五节回答。
30秒极简版
两个结构参数实测,结果一强一弱:
- 压抑-释放——可靠:压抑段越多,释放越猛(强度差从 1.0 升到 1.7),"先抑后扬"AI 会自动落实,统计显著(B vs C p=0.000)。
- 峰值位置——只有趋势:让 AI 放 50%/70%/90%,实测中位数 50%/50%/59%,有"越靠后越偏后"的方向,但三组差异统计不显著、测量本身有波动。
结论:压抑释放能控,峰值位置只能"试着指定",不能指望精确。
一、 实验设计:两个参数,各三组
沿用系列一贯的攻心戏场景(陆清玄×情魔)、doubao 模型、每组 20 篇。
为什么选这两个参数: 峰值位置和压抑-释放是"情绪曲线"最核心的两个形状参数——一个管"最高点放在哪",一个管"涨跌的节奏"。每组 3 个档位分别覆盖"中 / 偏后 / 末"和"短 / 中 / 长压抑",其余完全同素材、同 prompt,只改这一个变量,才能把差异归因到参数本身。
实验一:峰值位置
| 组 | 指令 | 含义 |
|---|---|---|
| A | 峰值在 50% 位置 | 情绪最高点在场景中间 |
| B | 峰值在 70% 位置 | 偏后段 |
| C | 峰值在 90% 位置 | 接近结尾 |
prompt 里用"段数"落地(不说百分比,直接说"峰值放第 3 段"):场景分 5 段,A 组峰值放第 3 段、B 组第 4 段、C 组第 5 段。峰值段统一用对话承载——固定载体,避免峰值落到 AI 弱项载体上写崩、干扰位置测量(Part 10 已证对话相对最不烂)。
实验二:压抑-释放比例
| 组 | 指令 | 含义 |
|---|---|---|
| A | 前 1 段压抑 + 后 4 段释放 | 压抑 20%,快速进入释放 |
| B | 前 2 段压抑 + 后 3 段释放 | 压抑 50% |
| C | 前 3 段压抑 + 后 2 段释放 | 压抑 70%,压抑时间长 |
压抑段要求低强度(压制/铺垫),释放段要求高强度(爆发/绝杀)。
二、 测量方法:粒度必须匹配场景
这次的测量,先要过一个粒度关。 场景只有 5 段(每段一两百字),用 Part 9 那套 500 字窗口去切,一整篇也就剩下 1-2 个窗口。窗口一压,段与段之间的强度差异就被抹平了——峰值位置直接退化成"0% / 50% / 100%"几个死值,根本测不出 50/70/90 的区别。
实测确实撞墙了:初版用窗口测,标注输出全是 [7,0]、[7] 这种二值噪声(一两段里只挑出一个最高强度),峰值位置要么 0、要么 50、要么 100,完全不可用——A 组的窗口版数据现在还在库里,翻开就是一片死亡值。
改法:按段落标强度。 场景就 5 段,每段标一个 0-10 的强度值,峰值 = 强度最高段的位置,归一化到 0-100%。5 段分别对应 0 / 25 / 50 / 75 / 100 五档,比窗口版细多了,才看得出 50/70/90 的差别。
这印证了系列反复出现的一条铁律:测量粒度必须匹配内容粒度。 短场景按段测,长章节才用窗口(Part 9 测整章用窗口、Part 10 测短场景用段落级,都是同一回事)。
三、 结果一:峰值位置——有趋势,但统计上不显著
每组 20 篇,按段落标强度,取最高强度段的位置(归一化 0-100%):
| 组 | 目标位置 | 实测中位数 | 实测均值 |
|---|---|---|---|
| A | 50% | 50% | 43% |
| B | 70% | 50% | 53% |
| C | 90% | 59% | 55% |

三个关键观察:
- 有方向趋势但统计不可靠:中位数 50 → 50 → 59%,均值 43 → 53 → 55%,指令越靠后,峰值确实偏后。但 A/B/C 两两 Mann-Whitney 检验均不显著(p=0.15/0.65/0.08)——只能说有趋势,不能说"能控制"。
- A 组正中目标:要求 50%,实测中位数正好 50%。中段位置相对最准。
- 越靠后越提前(偏保守 20-30%):B 组要 70% 只到 50%,C 组要 90% 只到 59%。模型到不了真正的末段——倾向于在靠后段就达到峰值,不一定落在指定的最后一两段。
用单篇看"能到哪": A 组一篇的段落强度是 [6,7,8,9,8]——峰值 9 落在第 4 段(75% 位置),然后回落。这个"爬升→触顶→回落"的形状做得对,说明 AI 理解"情绪得有起伏";但它落在第 4 段而不是正中的第 3 段,说明"精确到段"做不到。反过来,C 组也有个别篇真的把峰值放到了末段(强度 [7,7,8,6,10],峰值第 5 段)——个别能到,但从整组中位数看,峰值总是被提前到倒数第二段附近。
测量稳定性说明:峰值位置这个指标对同一批文本重测,中位数会有 ±10% 左右的波动——本身不够稳定,这可能是三组差异不显著的原因之一。
四、 结果二:压抑-释放——先抑后扬,AI 自动会
每组 20 篇,算"释放段平均强度 − 压抑段平均强度":
| 组 | 压抑段数 | 强度差中位数 | 压抑段均值 | 释放段均值 |
|---|---|---|---|---|
| A | 1 | 1.0 | 6.5 | 7.5 |
| B | 2 | 1.0 | 6.5 | 7.5 |
| C | 3 | 1.7 | 6.3 | 8.0 |

强度差是什么: “释放段平均强度 − 压抑段平均强度”,衡量"先抑后扬"的落差有多陡。真人写先抑后扬,压抑段通常压到情绪谷底(强度很低),落差会更大;AI 的 1.0→1.7 说明"有落差、够用,但还不够陡"。
两个关键观察:
- 压抑越久,释放越猛:压抑 1-2 段时强度差 1.0,压抑 3 段时跳到 1.7——"先抑后扬"AI 会自己落实,并按压抑长度自动调节释放力度。
- 但压抑段压得不够狠:压抑段均值 6.3-6.5,在 0-10 的尺子上还是偏高。模型能做出"前低后高"的落差,但"低"得不够低——它理解的"压抑"更像"略平静",不是"被压到谷底"。
五、 结论:情绪曲线部分"可编程",部分存疑
对应篇首的两个实验目的,逐个回答:
实验一(峰值位置)能控吗?——只有趋势,不能指望精确。 三组中位数 50→50→59% 方向是对的(指令越靠后、峰值越偏后),但两两 Mann-Whitney 都不显著(p=0.15/0.65/0.08),且指标本身重测有 ±10% 波动。用途有限:只能当"粗调方向",不能当精确控制手段。
实验二(压抑-释放)能控吗?——能,统计显著。 压抑 3 段比 1 段的强度差显著更大(B vs C p=0.000、A vs C p=0.029),"压抑越久释放越猛"AI 自动落实。唯一的保留:压抑段压得不够低(均值 6.3-6.5)。
对照 Part 10,情绪曲线"骨架"可编程成立吗?——成立,但只限三个参数:
| 参数 | 能不能控 | 检验结果 |
|---|---|---|
| 载体(Part 10) | ✅ 能 | 80% 遵守(卡方 p<0.0001 显著) |
| 峰值位置 | ⚠️ 趋势,不显著 | 三组两两 p 均>0.05,测量本身有波动 |
| 压抑-释放 | ✅ 能 | A vs C p=0.029、B vs C p=0.000 显著 |
一句话:情绪曲线的"骨架"(载体、压抑释放)可以按指令搭,峰值位置只能粗调。 具体怎么用在落地节。
六、 落地:写场景时怎么用
- 峰值位置:可以试,但别指望精确——有"越靠后峰值越偏后"的趋势(中位数 50→59%),可以指定"峰值放第 X 段"或"靠后段",但统计不显著、测量有波动,别当精确控制手段
- 要先抑后扬更狠,把压抑段拉长——这个可靠(B vs C p=0.000):压抑 3 段比 1 段的强度差大 70%
- 把精力放在压抑释放上——它统计显著、效果明确;峰值位置只能作为粗调方向
七、 本期数据与样本
- 峰值位置实验:A/B/C 三组各 20 篇 + 段落级强度标注
- 压抑-释放实验:A/B/C 三组各 20 篇 + 段落级强度标注
- 生成脚本、标注 JSON——评论区或私信找作者要。
八、 实验边界与局限
按影响核心结论的程度排序:
- 峰值位置指标本身不稳(最关键):同一批文本重测中位数有 ±10% 波动——“三组不显著"里有一部分是"测不准"造成的,不显著不等于"没效果”,只能说"够不稳"。
- 5 段档位粗:峰值只能落到 0/25/50/75/100 五档,50/70/90 的间隔近乎小于档间距离,测量天然只落"最近档"。段数越多可能越准。
- 20 篇/组,探索性结论:峰值组间 p 值在 0.08-0.15 边缘,扩大样本可能改变"不显著"的判断。
- 压抑段压不狠:均值 6.3-6.5,可能是 prompt 表述问题、也可能是模型对"低强度"理解弱,未深挖。
- 单场景、单模型:攻心对话戏 + doubao 生成 / deepseek 标注,跨题材、跨模型未验证。
- 未做双模型一致性校验(系列一贯局限)。
九、 一句话总结
情绪曲线两个结构参数,一强一弱:压抑-释放能控且统计显著(压抑 3 段比 1 段强度差大 70%),峰值位置只有方向趋势、三组差异不显著、测量有波动。配合 Part 10 的载体蓝图,"情绪曲线的骨架"部分可编程(载体、压抑释放),峰值位置还不能当精确控制手段。
附录:段落级强度标注与两个指标的计算(可复现)
段落级强度标注 prompt(逐段调用,每段输出一个 JSON):
你是网文情绪分析工具。下面是一段修仙网文的局部段落。
判断这段文字承载情绪的真实强度(0-10)。
【重要】:情绪词的密集出现不等于情绪强度高。请基于整体叙事效果
判断情绪被压得有多狠、有多高涨。
文本:
---
{text}
---
输出严格 JSON(不要其他内容):
{"emotion_intensity": 0到10的整数}
两个指标怎么算:
- 峰值位置:找出强度最高段;归一化到 0-100%(5 段场景对应 0/25/50/75/100)。强度最高的段有并列时取靠前段。
- 强度差(压抑-释放):释放段强度均值 − 压抑段强度均值。压抑段=指令要求低强度的段,释放段=指令要求高强度的段。
复现注意点(与上篇一致):
- 标注固定用同一模型(deepseek)、temperature=0,保证同批样本口径一致、结果可复现。
- 场景只有 5 段,峰值位置天然只落在五档之一,组的中位数也一样——对比不同组时看"落在哪一档",别当连续变量苛求。(对应局限第 2 条)
本系列进度: Part 1(实验框架)→ Part 2(样本量)→ Part 3(约束数量)→ Part 4(规则形态)→ Part 5(文风标杆)→ Part 6(大纲端的剧情设计上限)→ Part 7(剧情蓝图)→ Part 8(追问优化)→ Part 9(情绪测量 + 载体单一化)→ Part 10(载体蓝图 + 载体能力不均)→ Part 11(情绪曲线工程化,本篇) → Part 12(81 章长文实测:OOC/伏笔/记忆)→ Part 13(系列总结)
:AI 的情绪曲线,只能控制一半——压抑释放能控,峰值位置只有趋势&spm=1001.2101.3001.5002&articleId=163957309&d=1&t=3&u=131fbdbf66184875bf9f38fa2ff51b82)
442

被折叠的 条评论
为什么被折叠?



