JokerHu直播控制台 · Studio
正在加载模型…
总进度 0.0%
当前文件:准备中…
加载慢?直接进入 →
JH
JokerHu
在线
发送
上一步
下一步
JokerHu直播控制台 · Studio v1
使用帮助
OCR
语音 弹幕
0
视频源
抠像
文字
画面
视频列表
+
上传文件
使用摄像头
模式
循环
随机
原声
图片
s
视频音量
100
语音库
清空
+
随机
顺序
不停(0s)
间隔1s
间隔2s
间隔4s
随机1-5s
语音音量
100
冷却CD
s
冷却中不重复
渐入
s
渐出
s
掐头
s
去尾
s
播报/主播/AI 的声音都在这里;可 + 添加音频/背景音乐。每条可播▶可删,神经音生成带进度条。
环境音
+
循环
随机
顺序
不停(0s)
间隔1s
间隔2s
间隔4s
随机1-5s
音量
70
互动语音库
互动存档·可复用
互动语音(主播回复/手动)播完1次后自动存到这里;相同内容会优先从这里复用。两库共用一个播放位。
左:拖放视频、无限重放 · 右:统一声音控制台
抠像视频
+
模式
循环
随机
原声
音量
100
抠像参数
AI 智能抠人物(无需绿幕),去背景只留人,合成到舞台最上层。
边缘柔化
3
阈值
50
反选(抠背景)
大小
100%
未加载抠像模型
在画面上直接
拖动定位
,用「大小」缩放。选中列表某条即播、实时抠人合成。
画面文字
给舞台加文字(会被直播助手一起采集)。加好后在下方列表选中,直接在画面上拖动。
+ 添加文字
内容
字号
6%
粗细
常规
加粗
特粗
描边
6
颜色
描边色
删除此文字
还没有文字。点「+ 添加文字」新建,选中后可在画面拖动、改颜色描边字号。
画面比例
比例
手机竖屏 9:16
横屏 16:9
方形 1:1
3:4
自定义
自定义 宽:高
:
舞台即被直播助手采集的窗口。点「放大」可全屏预览。
运镜
滤镜
动画
转场
视频源运镜
间隔
s
保持
s
待命中…
抠像运镜
间隔
s
保持
s
待命中…
间隔
s
保持
s
待命中…
间隔
s
保持
s
待命中…
转场素材
+
图片
视频
图片停留
s
数据监控
总控台
运行数据
00:00
--:--
报时倒计时
--
轮间倒计时
--
本轮进度
--
视频源运镜
--
抠像运镜
0
弹幕总数
0
播报次数
0
互动回复
0
AI 调用
0
空闲播报
00:00
运行时长
语音生成
空闲中,无生成任务
进度
—
队列 / 已生成
0
/
0
内存
本页占用
—
JS 堆
—
设备 / 核心
—
·
—
性能
帧率
—
主线程负载
—
各系统开关
弹幕识别
共
0
条
弹幕播报
系统音读弹幕(默认关)
舞台弹幕
画面上滚动弹幕(默认关)
主播空闲
0
次
互动回复
0
次
AI 回复
0
次
舞台字幕
画面下方显示朗读文字
自动报时
神经音定时报当前时间
视频源运镜
视频源夸张/缓慢运镜
抠像运镜
抠像人物夸张运镜
转场
切换视频源时播转场素材
滤镜
CSS色调滤镜轮换(极低负载)
动画
CSS画面动效轮换(极低负载)
点「开始」后各环节工作;这里可单独关某个子系统。运镜/转场素材在左侧「运镜」「转场」区。
主播待命中…
开始
放大
重置
弹出
总音量
100
识别区域
高级设置
识别弹幕 · 三步搞定
在你的
直播助手 / 弹幕姬
里,把
弹幕区域单独显示
成一个窗口(弹幕文字尽量大而清晰)。
点下面的
「共享屏幕」
,在弹出的列表里
选中那个弹幕窗口
。
共享后下方会出现画面;若框没对准,点
「调整弹幕区域」
把框拖到只圈住弹幕文字。
共享屏幕(选弹幕窗口)
调整弹幕区域
已设为整屏
未共享屏幕。
识别到的弹幕会自动播报、AI 互动。想调识别精度、预处理、间隔等,去右上「高级设置 → OCR」。
识别结果(每轮新增文字)
—
共享屏幕后,这里只显示每轮新出现的文字(增量)。
OCR
识别结果
播报
主播
AI
报时
轮播
OCR 识别参数
共享屏幕、框选弹幕区域在「识别区域」里操作;这里只调识别参数。
OCR引擎
PaddleOCR(中文准·推荐)
Tesseract
语言
中文
中英
英文
模型
高精度
标准
间隔
1.5s
2.5s
4s
预处理
二值化(Otsu)
仅灰度
原图彩色
反色
自动
强制反色
不反色
放大到
1200px
1600px
2000px
2600px
分页模式
整块(6)
分栏(4)
稀疏(11)
自动(3)
送入 OCR 的处理后画面(据此调预处理/反色,字越清越黑白分明越准):
「识别结果」(每轮新增文字)已放到左边「识别区域」里,方便边共享边看。
识别弹幕结果
清空
开播后识别到的弹幕会显示在这里。
弹幕播报(系统音·快速)
语音
语速
1.6
模板
仅本地语音
主播/旁白(回复+文案)
主播引擎
神经真人音(ZipVoice)
系统音(机器)
神经音色
女声·带货真人2(新)
女声·带货真人
男声·雷军
自定义(克隆)
参考音频
参考文字
加载/试听神经音
未加载神经音模型(首次约220MB,缓存后不下)。
主播语音
语速
1.0
生成
「空闲文案」已挪到右侧「互动」列顶部。神经音把文案预生成到「语音库」后循环/随机播,主播嘴不闲;系统音是快速机器音(弹幕播报也用系统音)。
AI 回复(已接入 DeepSeek)
开关在左下「总控台 · AI 回复」。连接与密钥已由服务器端安全预设,无需填写。
显示名称
模型 ID
API 平台
API Key
Key 只存服务器端(网站目录外/浏览器拿不到),已禁止查看与复制,不怕直播时露出或被盗刷。
主播人设
(可自由编辑)
你是热情幽默接地气的带货女主播。跟弹幕互动时,先自然地把观众这条弹幕读/复述一遍(比如"有宝子问…""这位姐妹说…"),紧接着结合下方产品知识库口语化回复。整体两句话以内、简短自然。直接说话,不要加括号、不要写动作神态或语气提示词、不要念知识库原文。
这段人设你随便改,改完自动保存、刷新也在,我不会覆盖你的修改。
测试连通
自动报时
用主播神经音定时报当前时间。总开关在左下「总控台 · 自动报时」。
报时间隔
分钟一次
提前报
秒(报未来时间, 给生成留时间)
连续播放
次
播放后
播完删除(不进备用库)
进备用库(可复用)
格式示例(大写):现在是北京时间二零二六年七月三十日十点五十二,今天是周四
试报一次
轮播 / 轮间隔
每轮 N 个空闲文案按语音库间隔连播,一轮完成后休息随机秒数再开下一轮(此机制常驻,不可关闭)。另外:下一条一定不与上一条相同,若列表只剩一条无法避免重复,则直接结束本轮进入休息。
每轮个数
个算一轮
轮间休息
~
秒随机
默认 10 个一轮、轮间休息 5~30 秒随机。轮内间隔沿用「语音库」的间隔设置。
互动
0
空闲文案
知识库
每行一条。没人互动时,主播按这些文案在语音库循环/随机轮播(间隔在左侧语音库调),嘴不闲。
商品信息 + 常见问题。AI 回复弹幕时会结合这里作答(不照读原文)。随时可改,自动保存。
手动输入一句,主播立即用神经音说出来(进左侧语音库循环体系)。下方汇总全部互动,与底部「互动记录」同源。
触发
这里汇总所有互动:弹幕自动回复、手动触发的内容都会显示,并同步到底部「互动记录」。
运行日志
互动记录
0
说明
清空
日志类型:
OCR
识别 ·
DM
弹幕 ·
TTS
语音 ·
AI
调用 ·
SYS
系统 ·
ERR
错误。
「互动记录」只记主播对弹幕的回复:谁的弹幕、怎么回的、来源(AI/文案库),本次会话内保留。
设置弹幕裁剪区域
在大图上
拖拽框选
弹幕区域;拖
四角/四边手柄
缩放、框内拖动移动,框外半透明遮罩;
双击
恢复整屏。
完成
确认
取消
确定