Chaoslive · 主播视觉调研

唱歌模式视觉方案

为单循小猫做的画面调研。目标是让「聊天」和「唱歌」成为观众一眼可辨的两套画面, 同时不牺牲她现有的柔光美学与美颜效果。本页含现状拆解、根因分析、两套可执行方案、 美颜地基对比与分步路径。

调研对象 单循小猫 · B站唱见 · 1.7 万粉 当前工具 直播姬(有 OBS 使用经验) 画面规格 1080×1920 竖屏 日期 2026-09-07 状态 待确认项已列出,见 Q1–Q7

结论摘要

已验证 本次调研实际看到的 待实测 需在她机器上验证 待确认 需要问她本人
核心发现
她唱歌和聊天的画面差异,目前只有一条歌词。

对比《接受》歌切与 55 分钟 PK 录播:同一机位、同一套光、同一构图。 唯一区别是唱歌时底部多了实时歌词条,聊天时多了点歌/舰长贴片。已验证

根因
不是灯的问题,是构图与美颜互相锁死。

超近景大特写 + 正面平光 + 低对比高亮度,三者互为因果。 舞台冲击感所需的空间、方向光、明暗对比,被这三条同时挡住。加滤镜绕不过去。

能力边界
软件能做「仪式感」,做不了「冲击感」。

构图、UI、遮幅、色调、背景压暗都能纯软件实现; 光真正照在脸上的立体感做不了,那需要一支物理灯。这个分界决定选哪套方案。

建议起点
先用直播姬跑简化版,零成本验证假设。

构图 + UI 清空 + 遮幅 + 曲名条,一场试 2–3 首歌。 有效果再解决美颜迁 OBS,最后才考虑加灯。先验证,再上工程量。

一个已经存在的好基础

她画面底部已经有一条实时歌词——半透明深色底,当前句橙红高亮,上下句灰白小字。 说明她已经有「唱歌模式」的意识和一套能出实时字幕的工具链,本方案的增量成本比从零开始低。 待确认 这条歌词是用什么做的(桌面歌词软件窗口捕获 / 插件 / 其他), 因为它决定了迁移到 OBS 时这块能不能平移。

现状拆解

画面构成

从投稿封面、歌切与录播反推。录播与直播画面基本一致,因此以下即她的实时画面特征。

现状判断
取景超近景大特写,脸占画面高度约三分之一,肩以上颜值优势最大化,但没有空间
镜头大光圈光学虚化,背景成暖色 bokeh 光斑最大资产,滤镜做不出来
主光大直径柔光正面略高,脸上几乎无硬阴影为美颜服务,方向性为零
调色提亮、降对比、暖偏、磨皮皮肤优先,天然反冲击
背景白/米色实景,暖色灯串、花束、装饰温馨,虚化后质感好
道具大振膜电容麦故意入镜最强的「唱歌」视觉符号
画幅1080×1920 竖屏横向空间受限,纵向可做文章

已有 · 缺失

已经有的

  • 实时歌词条(当前句高亮)
  • 贴片素材能力(点歌/舰长提示)
  • 精修封面的排版设计能力
  • 棚拍级的布光与镜头
  • OBS 使用经验

缺的

  • 唱歌与聊天的构图差异
  • 遮幅/画幅变化
  • 唱歌时的 UI 清空
  • 色调差异
  • 光的方向感(轮廓光)

工具门槛:她没有门槛

B站第三方推流(OBS)权限门槛为 5000 粉(2025-05-26 起生效,此前为 100 粉)。 她 1.7 万粉,完全满足。已验证 所以她回到直播姬是主动选择,不是被平台卡住—— 真正需要搞清楚的是她当初为什么退回来(见 Q1)。

根因分析

舞台冲击感需要三样东西。她三样都被结构性挡住,而且三者互相咬死。

要素她的现状为什么改不动
空间感画面 80% 是脸和虚化的墙物理上装不下一个舞台
光的方向正面平光侧光在脸上留阴影,与美颜算法打架
明暗对比提亮压对比拉对比皮肤瑕疵就出来
三者互锁

要空间就得拉远 → 脸变小,削弱最核心的颜值资产; 要方向光就有阴影 → 与美颜冲突;要对比就露细节 → 也与美颜冲突。 任何绕过这组取舍的方案(例如全屏套彩色滤镜)只会让画面变脏,不会变得有冲击力。

方向判断:冲击感可能不是正确目标

她的歌单——《接受》《天梯》《月光》《甲乙丙丁》《崇拜》——全是抒情, 整个视觉资产是「温柔、亲密、治愈」。硬上舞台冲击感会与人设正面冲突。

在她这条线上更该追求的是「进入感」:从「在房间里和你聊天」变成「进入她的世界」。 压暗、聚焦、色温转冷就能做到,比彩光更贴她,成本也更低。

例外:快歌单独开一套

《处处吻》《我的宣言》这类粤语快歌撑得起真正的舞台光。 如果要做冲击感,按歌路分 look 比全局改造更安全,也更容易验证效果。

方案 A · 直播姬简化版

推荐起点 零采购、零迁移、保留内置美颜。今天就能配,用来验证「模式切换到底有没有用」。

可行性依据

直播姬 PC 版支持多场景预设 + 多图层素材(摄像头/图片贴片/视频循环/文本)+ 快捷键切换。 这意味着「聊天场景」和「唱歌场景」可以直接在直播姬里做,不用换 OBS,美颜也保住。

两个场景的配置

场景 1 · 聊天

  • 摄像头层:当前近景取景
  • 贴片层:点歌提示、舰长提示
  • 美颜:现有参数不动

场景 2 · 唱歌

  • 摄像头层:中景裁切(背景进画面)
  • 遮幅层:letterbox PNG
  • 曲名条:歌名 / 原唱,放角落
  • 歌词层:保留现有
  • 贴片全部关闭

素材规格

素材规格说明
letterbox 遮幅 1080×1920 PNG,带 alpha 上下各 220–260 px 纯黑,中间全透明。数值可调,越厚越「电影」,但会压缩人物空间
曲名条 宽约 420 px PNG 或文本层 放左下或右上。歌名主字号,原唱小一级。避开歌词条与脸
过渡 1.5–2 秒淡入淡出 不要硬切。切换前留一句口播衔接

能力边界

能做做不了
构图切换 · UI 清空 · 遮幅 · 曲名条 · 歌词 · 快捷键一键切 色调差异(美颜滤镜大概率全局)· 背景单独压暗 · 光的方向
三个必须实测的点 待实测
  • 图片素材支不支持 PNG 透明通道——决定 letterbox 和曲名条能不能叠
  • 图层能不能自由裁切——决定构图切换能不能做
  • 美颜滤镜是全局还是跟场景走——决定色调差异有没有可能
前置约束:摄像头原始分辨率 待确认

构图切换依赖裁切余量。源是 4K 推 1080×1920 → 随便裁,画质无损; 源只有 1080p 而当前特写已经是裁出来的 → 再裁就糊,这条就废掉, 只能靠物理移动摄像头。这是整个方案 A 成不成立的第一个前提。

方案 B · OBS 完整版

一个热键触发,构图、色调、背景、遮幅、UI 全部同时切。 能力上限高出方案 A 一大截,代价是必须先解决美颜与 GPU 开销。

唱歌场景的图层结构

  • L5歌词条 / 曲名条现有歌词来源 + 曲名文本或 PNG
  • L4letterbox 遮幅带 alpha 的 PNG,最上层
  • L3假轮廓光层人物遮罩偏移相减得到单侧边缘,着色后 Screen 混合
  • L2人物层摄像头副本 → AI 抠像输出 alpha → 美颜滤镜。不加任何调色
  • L1背景层摄像头副本 → 色彩校正(压暗、转冷)+ 暗角。脸被 L2 盖住,不受影响

核心手法一:背景单独压暗,脸完全不动

obs-backgroundremoval (开源 AI 人像分割)——但不是拿它换背景,而是拿它生成的遮罩做分层: 摄像头源复制两份,一份当背景层加调色,一份当人物层用遮罩抠出来叠上去、不加调色。

结果是背景压暗转冷了,脸的曝光和肤色一点没动。 而且因为背景只是被调暗调色、不是被替换,边缘就算有几像素误差也几乎看不出来—— 这比绿幕换背景的容错率高一个量级。

为什么不用绿幕

她是长直发、发丝多,画面卖点是皮肤和发质,而抠像最难的恰恰是发丝边缘: 要么带绿边、要么被抠掉一层,皮肤还会反射绿光偏青。 加上绿幕需要独立布光和 1–1.5 m 纵深(居家小空间多半没有), 以及磨皮会让边缘判断更容易出错——失败点全落在人的边缘上,对她是负收益。 而且换背景会丢掉她最大的优势:光学虚化。

核心手法二:假轮廓光

光的方向严格说软件做不出来,但可以骗,而且效果不差:

  1. AI 抠像得到人物遮罩
  2. 遮罩往一个方向偏移几像素(例如 x+6, y-6
  3. 偏移后的遮罩减去原遮罩 = 单侧边缘环
  4. 边缘环着色(暖橙或冷蓝)+ 高斯模糊约 4 px
  5. Screen 混合模式叠回人物层上

obs-shaderfilter 写一个 shader, 或者用遮罩 + 模糊 + 混合模式硬凑也行。 关键是第 2 步的偏移——不偏移就是均匀发光一圈,一眼假;有了方向才骗得过, 尤其在背景已经压暗的情况下。

诚实的极限

假轮廓光骗的是「边缘」,真灯给的是「体积」:真光照上去,脸颊有明暗过渡、鼻梁有高光、下颌有阴影,这些软件给不了。 但她本来就要磨皮平光,脸上的立体感是主动放弃的东西—— 假轮廓光 + 背景压暗,已经能覆盖她需要的大部分效果。

色调差异

聊天唱歌
背景层亮度不变降低约 15–30%
背景层色温暖白偏冷 / 转琥珀(按歌路选)
背景层饱和不变略降
人物层两个模式完全一致,不做任何调整
暗角轻微

一键控制

「一键」这个诉求本身就把方案推向 OBS:直播姬的快捷键只能切它自己的场景、没有对外 API; OBS 有 obs-websocket,才是能当总控的那个—— 未来要联动伴奏、点歌队列,甚至一盏灯,都挂在这一层上。

两个前置卡点
  • 美颜必须先解决——这是她当初退回直播姬最可能的原因,不解决她试一次就会再退回去。见下一节。
  • GPU 开销 待确认——美颜插件 + AI 抠像 + shader 同时跑, 还要保证推流不掉帧。她的显卡配置必须先确认。

任何一条不过,就得降级回方案 A(构图 + UI + 遮幅,没有色调和抠像)。

地基 · 美颜方案

直播姬内置美肤滤镜、五官微整(瘦脸/大眼)、一键美妆,OBS 原生一个都没有。 对颜值向唱见来说美颜是刚需不是加分项,这一条是整条 OBS 路线的地基

方案能力成本GPU风险
OBS 美颜插件
obsworks.com
瘦脸、大眼、磨皮、美白、身材、美妆、背景虚化、贴纸 价格未公开 国产闭源插件,稳定性与隐私待验证;官网称兼容 OBS 27–32
手机美颜 App
+ 虚拟摄像头
美颜质量最好(成熟消费级 App) App 订阅 + 连接软件
手机端算
延迟、连接稳定性、二次编码画质损失;且丢掉微单的光学虚化
自写 shader 磨皮
obs-shaderfilter
只有磨皮,没有瘦脸大眼 免费 效果远不如专业美颜,大概率不达她的标准
放弃 OBS
留在直播姬
美颜最好,但没有色调/抠像/轮廓光 能力上限锁死在方案 A
建议的验证顺序

先问清 Q1(她当初为什么退回直播姬)。 如果答案不是美颜,那这一节的优先级大幅下降,可以直接上方案 B; 如果答案就是美颜,那必须先把美颜方案跑通并让她认可效果,再谈迁移—— 否则做完整套配置她试一次就会退回去,前面全白做。

分步路径

核心原则:先验证假设,再上工程量。每一步都有明确的退出条件。

  1. 验证「模式切换有没有用」 在直播姬里配方案 A(构图 + UI 清空 + 遮幅 + 曲名条),一场试 2–3 首歌。 零成本零风险。
    退出条件:看弹幕反应、唱歌段的留存与礼物。没有可感知的变化就停在这里,不要继续投入。
  2. 解决地基 确认 Q1 的答案。若是美颜,跑通一个 OBS 美颜方案并让她本人认可效果;同时确认 GPU 能不能扛。
    退出条件:美颜达不到她的标准,或 GPU 扛不住 → 永久留在方案 A,不要硬迁。
  3. 迁到 OBS 做完整版 背景分层压暗 + 假轮廓光 + 色调差异 + 一键热键。这一步拿到软件能给的全部效果。
    退出条件:推流稳定性下降、她操作负担变重 → 回退。
  4. 要真正的立体感才加灯 一支轮廓光,接进已经搭好的 obs-websocket 总控。 灯的一键控制并不复杂(见下),别把它当作不可能。
    触发条件:前三步做完,仍觉得「不够立体」才做。

补充:物理灯的一键控制没那么复杂

做法复杂度
带遥控器的 RGB 灯棒,唱歌前按一下零集成。不是严格一键,但成本几乎为零
WLED(ESP32 灯带控制器)有 HTTP API,切场景时脚本发一个请求就改色
Lumia Stream就是为这个做的产品:OBS 场景切换直接绑定灯光变化
Stream Deck一个物理按键同时触发场景 + 灯光 + 伴奏

一旦用了 OBS + websocket,接一盏灯的边际成本很低。建议先不做,但不要因为「要连物联网」就排除它。

补充:让灯进虚化区(她的独有优势)

如果最终决定加灯,把 RGB 灯棒藏在背景景深里而不是打人。 大光圈会把灯化成柔和的大色块光斑——同一支便宜灯,别人拍出来是廉价彩光,她拍出来是高级光斑。 唱歌时改灯色,背景就变了,零抠像风险、零画质损失。

待确认清单

调研的缺口全在这里。这几个答案会直接改变上面的方案排序,建议先问完再动手。

  1. 当初为什么从 OBS 回到直播姬? 美颜 / 卡顿 / 太麻烦 / 掉帧。最关键的一题——决定整条路线怎么走,以及美颜地基的优先级。
  2. 摄像头是什么型号,输出多少分辨率? 微单 + 采集卡 / 网络摄像头 / 手机。直接决定构图切换(方案 A 第一条)成不成立。
  3. 电脑配置,特别是显卡? 决定 OBS 美颜插件 + AI 抠像 + shader 能不能同时跑而不掉帧。
  4. 现在有几盏灯、什么型号、能不能调色调亮度? 决定第 4 步加灯时是买新的还是改现有的。
  5. 唱歌时是坐着不动,还是会站起来或换位置? 决定固定构图的两套裁切是否够用。
  6. 底部那条实时歌词是用什么做的? 桌面歌词软件窗口捕获 / 插件 / 其他。决定迁到 OBS 时这块能不能平移。
  7. 她自己想要什么感觉:更亲密,还是更有舞台感? 这两个方向相反。她全部视觉资产都是「温柔亲密」,突然上舞台彩光会与人设打架。 这题必须她本人定,不能替她决定。

附录 · 对标

做得最好的样本:西野柚子(B站 VTuber)

本轮调研看到的最完整的双模式实现。同一个模型,两套画面。

维度聊天模式表演模式
色调粉白高亮暗色夜景,冷调降饱和
打光平光,零色偏侧光 / 轮廓光,明暗结构清晰
画幅满幅上下 letterbox 遮幅
UI极密:聊天窗、时间卡、航海进度、点歌列表、二维码、域名水印全部清空,只留竖排歌词
背景浅粉房间暗色都市 bokeh;一首歌一套视觉

可以搬到真人身上的

手法真人能不能搬说明
letterbox 遮幅可以一张 PNG,成本最低效果最明显
UI 清空可以唱歌场景不放贴片
背景变暗 / 色调转冷有条件需 AI 抠像分层,或物理灯
歌名 / 歌词条可以她已经有歌词了
模型侧光、轮廓光搬不了硬约束:真人的光在物理世界,后期加不出方向光。软件只能做假轮廓光
注意区分

她的表演模式画面来自投稿切片,字幕肯定是后期加的。 但模型是实时驱动的,背景 + 打光 + 遮幅这套应该就是 OBS 实时场景。 待实测

横向扫描的结论

国内单人唱见

B站唱见分区在播样本:清一色柔光美学,没有人做双 look。 单循小猫本人的画面质量在这批里属于上游。

国内团播

确实在做舞台效果,但全是物理搭建——LED 背景屏 + 真实灯具 + 棚。 重资产路线,与单人主播不可比。原则一致:动背景,不动脸

Twitch 真人音乐

灯光普遍不如西野柚子。有主播整个房间被 RGB 紫光笼罩、脸也被染色——反面教材。 他们强的是运营层:点歌队列、曲目条、目标进度条。

工具生态

国外工具成熟(VNyan 的 audio-reactive lights、Warudo、Lumia Stream、Captivate、TouchDesigner), 但没有一个在做「模式切换」本身——全是单点能力。

一个空白

西野柚子那套双 look 是她自己在 OBS 里手搭两组场景做出来的,没有产品化过。 而她做对的最关键一点——表演时把 UI 全清空——恰恰是纯灯光工具永远覆盖不到的, 因为那属于场景编排层。