一、本研究的边界(先说清楚)
公开资料能可靠地告诉读者的,是这门生意的骨架:商业模式怎样发明、平台怎样易主、流派怎样更替、政策怎样收紧又怎样激励、头部作者挣到了什么量级的钱。这些有财报、有文件、有判决、有报道支撑,本书在这些地方说话有底气。
公开资料说不清楚的,主要有五类:底层写手的真实生存状态、私域社群里的内部话语、平台不愿单独披露的读者画像、灰色交易(盗版、同人志私印)的链条细节、以及“AI写作占比”这类各方都有动机虚报的数字。本书在触及这些地方时一律把话说轻,并标注了证据等级。它们不是被忽略了,是被诚实地留在了玻璃的另一侧。
以下五节,按“重要性 × 可达性”把这些房间排了个序。
二、需要田野才能从 C 级升到 A/B 级的核心判断
-
底层作者的收入分布(关联第07期)。现有证据:自媒体调查与作者零散口述,口径不一,“有收入者仅一成”“月入几元”这类说法无法独立复核。田野能提供:对某一平台某一批次签约作者的匿名收入抽样,或对编辑的结构化访谈,把“金字塔”从一个比喻变成一条可画出来的曲线。成本与伦理:涉及收入隐私,需严格匿名。
-
全勤奖与断更惩罚的实际运作(关联第07期)。现有证据:行业自媒体与作者口述给出的日更字数、奖金区间、“关小黑屋”等说法,随平台和年份变动。田野能提供:合同文本、后台数据截图、编辑沟通记录的脱敏样本,确认惩罚机制到底是制度还是个案。
-
AI生成内容的真实占比(关联第09期)。现有证据:平台的对外表态与媒体测算互相矛盾,各方都有动机高报或低报。田野能提供:平台内部审核口径、被限流作品的样本分析。这一项可达性最低,因为没有任何一方愿意让外人看真实数据。
三、值得访谈的人(按“可达性 × 重要性”排序)
-
类型一:腰部与底层的签约作者。 最容易接触,信息密度也高。他们既不是被反复采访的头部明星,也不是完全沉默的弃坑者,最能讲清楚日更、断更、分成、转平台的真实体感。
-
类型二:平台的责任编辑。 处在作者与算法之间,知道推荐位怎么给、新书怎么判生死、什么样的开头能过算法这一关。可达性中等,多有保密约束。
-
类型三:从付费平台转去免费平台、或反向回流的作者。 他们一个人身上带着两套经济学的对比,是理解“留不住读者/留不住作者”最省力的访谈对象。
-
类型四:同人圈的资深参与者。 关于个人志、关于二〇二〇年前后那几桩案子在圈内引起的震动,他们的记忆是公开报道之外的另一层。访谈需格外注意保护,话题敏感。
四、值得进入的场域(按“可观察密度 × 信息独占性”排序)
-
作者交流社群。 作者群、写作课、线下笔会,是行业话语密度最高的地方。日更焦虑、平台政策的真实反应、对AI的态度,都在这里第一时间发酵,且几乎不外流。
-
短剧的拍摄与投流现场(关联第09期)。网文IP怎样被改成竖屏短剧、投流话术怎样测试、什么样的“爽点前置”能在三秒内留住人——这条把网文和短视频缝在一起的链路,公开资料只能看到结果(市场规模),看不到过程。
-
下沉市场的真实读者。 免费App的主力用户大量分布在公开网络声量很低的人群里。他们为什么读、读的时候在想什么、把这些故事当真还是当消遣——这是关于“这一代人”最关键、也最难隔着屏幕看清的一问。
五、需要通过田野渠道才能获得的数据集
-
单平台的读者画像原始数据。 晋江、番茄、起点各自的性别、年龄、地域、付费分布。公开渠道只有零散口径,平台不单独披露完整数据。本书因此只能用“全网持平、平台分化”这样粗的结论,没法再细。
-
作者收入的分层数据。 平台掌握完整分布,但视为商业机密。田野或可经由行业协会、个别平台合作获得脱敏样本,替代方案是上市公司财报里能反推出的总量数字。
-
盗版流量的真实规模。 现有的“损失三百多亿”是媒体测算,无独立审计。田野或可经由反盗版技术服务商获得抽样数据。
六、需要私域观察才能解码的“内部话语”
公开材料里能看到很多网文黑话的字面意思,但有些词的真正分量只有在语境里才显出来。“上架”“均订”“太监”“黄金三章”“数据扑了”这些词背后,是一整套作者用来衡量自己生死的标准;“歪嘴”“节奏”“钩子”这些词在投流团队嘴里又是另一套语言。把这些词从字典义还原成它们在从业者口中的真实重量,需要长期泡在社群里,是任何一次性的检索都给不了的。
这本书停在公开资料能到达的地方。它画出了这门生意的骨架与肌理,也老实承认了骨头之间那些看不真切的软组织。把这些软组织一一摸清,是另一项工作的开始——属于愿意走进那些房间的人。