VTuber Original Character Maker
日本語English简体中文

使用指南

从一张插画开始,到做出属于自己的VTuber模型并开始直播的完整步骤。

WINDOWS / MACOS开发中版本的画面
截图为开发中版本的日语界面。菜单名称保留日语原文,并在括号内附上中文含义。

这款应用能做什么

一张插画 → 3D模型

从接近正面的全身或上半身插画,自动生成带骨骼的3D角色。没有图片时,用文字描述角色特征也能生成。

只用麦克风就能做口型同步

对着麦克风说话时,应用会从声音推定元音并驱动口型。不需要动作捕捉,也不需要额外设备。

说了什么,表情就跟着变

语音识别与表情切换由本机的本地AI完成。会根据说话内容自动切换表情差分。

AI生成的动画会自动播放

用「挥手」这样的文字描述动作来生成短动画。直播中会根据说话内容或待机状态自动播放。

生成会消耗付费点数。3D模型 800pt / 表情套装 200pt / 背景 60pt / 动画每秒 85pt / 用特征生成输入图片 25pt。点数在应用内的商店购买,余额始终显示在画面右上。直播本身(口型同步、切换表情、播放动画、输出到OBS)不消耗点数。

整体流程

在「模型生成/设置」模式下依次完成下面5个阶段,最后切换到「直播」模式驱动角色。阶段可以随时从画面左侧的「制作阶段」列表来回切换。

13D生成2表情生成3直播设置4动画生成5背景等直播对着麦克风说话
01

选择模式

启动后首页会并排显示两个模式。要制作或调整角色时进入「モデル生成/設定」(模型生成/设置),要用做好的角色直播时进入「配信」(直播)

首页画面
首页画面。左侧为「模型生成/设置」,右侧为「直播」。右上角是点数余额与商店。
选择「模型生成/设置」后,可以选新規作成(新建)从头制作角色,或保存済み選択(选择已保存)继续之前的角色
选择「模型生成/设置」后,可以选新規作成(新建)从头制作角色,或保存済み選択(选择已保存)继续之前的角色。
02

生成3D模型 阶段 1 · 3D生成

只需选择一张输入图片,然后点击「3D生成を開始」(开始3D生成)。推荐使用接近正面的全身或上半身插画。每生成一体消耗800点数(付费)

从「画像を選択」(选择图片)读取插画
从「画像を選択」(选择图片)读取插画。没有图片时,也可以用文字描述角色特征,使用「特徴から生成」(从特征生成),消耗25点数。
选好图片后,下方的「3D生成を開始」(开始3D生成)就可以点击了
选好图片后,下方的「3D生成を開始」(开始3D生成)就可以点击了。
生成期间会显示进度与工序(角色单体图片生成 → 正面视图生成 → 骨骼绑定 → 待机动画生成等)
生成期间会显示进度与工序(角色单体图片生成 → 正面视图生成 → 骨骼绑定 → 待机动画生成等)。只需等待即可。
完成后会弹出对话框
完成后会弹出对话框。点击 OK 后模型即被载入。
生成模型预览
生成模型预览。右上角的按钮可切换正面 / 横 / 回転(正面 / 侧面 / 旋转)来确认成品。
用旋转预览做360°检查
用旋转预览做360°检查。下方的「作成済みの3Dモデル」(已创建的3D模型)可以载入以前的模型。
关于点数:3D生成、表情生成、背景生成、动画生成都在云端执行,并且都会消耗付费点数。余额始终显示在画面右上,可从商店购买。生成失败时消耗的点数会自动返还。
03

生成表情与口型 阶段 2 · 表情生成

选择表情模板(笑脸、生气、悲伤等)后点击「表情を生成」(生成表情),会一并自动生成脸部差分与口型同步用的口型(闭口以及各个元音)。每套消耗200点数(付费)

选择表情模板
选择表情模板。已生成的表情会排列在下方的一览中。
生成中
生成中。一个表情的脸部差分与口型套装会依次生成。
在表情预览中确认成品
在表情预览中确认成品。这里做好的表情,会用于直播中的自动表情切换与口型同步。
04

调整位置与姿势 阶段 3 · 直播设置

一边预览实际的直播画面,一边决定角色的呈现方式。背景默认为绿幕,因此可以直接按在OBS中做色度键合成的前提来设置。

用右侧的滑块调整纵向位置、横向位置、放大、旋转
用右侧的滑块调整纵向位置、横向位置、放大、旋转。「ポーズ微調整」(姿势微调)可以做更精细的调整。
用「位置保存」(保存位置)保存当前的呈现方式
用「位置保存」(保存位置)保存当前的呈现方式。保存的位置会直接用于直播画面,也能从「位置の保存履歴」(位置保存记录)中调回。
05

生成动画 阶段 4 · 动画生成

像「一边挥手一边轻轻点头致意」这样用文字指示动作,生成角色的短动画。生成的动画会在直播画面中叠加在角色上自动播放。每秒消耗85点数(付费),5秒则为425点数。

在右侧面板设置是否口型同步、秒数、用途、动画内容后点击「動画を生成」(生成动画)
在右侧面板设置是否口型同步、秒数、用途、动画内容后点击「動画を生成」(生成动画)。用途(例:打招呼 / 待机、无言时 / 聊游戏)中写的词语与说话内容相近时,就会自动选中该动画。写「待機」(待机)则会在无言时播放。
生成中的进度显示
生成中的进度显示。完成前需要稍等一会儿。
做好的动画可以当场播放确认
做好的动画可以当场播放确认。「保存」会登记到已保存动画中,「クロマキー」(色度键)还能调整抠像程度。
06

设置背景 阶段 5 · 其他

既可以保持绿幕直播、在OBS一侧合成,也可以替换为应用内的背景。随附的背景与读取自己的图片都是免费的;用AI生成背景则消耗60点数(付费)。动画会按背景分别保存。

选择背景后,直播画面预览会立即反映出来
选择背景后,直播画面预览会立即反映出来。
07

开始直播

回到首页进入「配信」(直播)模式。选好角色后直播画面就会启动。之后只要对着麦克风说话,口型同步、表情切换、动画播放就会全部自动运行。

从「配信するキャラを選択」(选择要直播的角色)中选择已保存的角色
从「配信するキャラを選択」(选择要直播的角色)中选择已保存的角色。
左上的配信ステータス(直播状态)可以确认麦克风的开关、输入设备选择、语音识别(STT)与AI(LLM)的状态、识别文本以及当前表情
左上的配信ステータス(直播状态)可以确认麦克风的开关、输入设备选择、语音识别(STT)与AI(LLM)的状态、识别文本以及当前表情。也能从左下的表情面板手动切换表情。
对它说话后语音识别就会运行(認識: あ、こんにちは
对它说话后语音识别就会运行(認識: あ、こんにちは。=识别:啊,你好。),与内容相符的生成动画(这里是挥手打招呼)会自动播放。
用右上的「UIを隠す」(隐藏UI)可以清除所有面板,得到适合捕获的干净画面
用右上的「UIを隠す」(隐藏UI)可以清除所有面板,得到适合捕获的干净画面。
在本机运行的AI:直播中的语音识别(STT)与表情、动画的选择(LLM)都由本机的本地AI运行。首次启动时会自动获取并展开AI数据,状态会显示在直播状态面板中。
08

接入OBS

有两种方法。使用「选项」中的 OBS联动 更简单,而且应用界面不会被拍进去。

方法1(推荐) 使用「选项」中的 OBS联动

  1. 打开画面右上的「オプション」(选项),把「OBS連携」(OBS联动)中的「OBS出力」(OBS输出)开启
  2. 用「URLをコピー」(复制URL)复制显示出的URL(例如 http://127.0.0.1:58090/
  3. 在OBS中添加「来源」→「+」→「浏览器」,并把URL粘贴到URL栏
  4. 把宽设为 1920,高设为 1080
  5. 让应用进入直播模式并选好角色,画面就会开始传送(首页与制作画面会是黑色画面)

方法2 用窗口捕获接入

  1. 在OBS中添加「来源」→「+」→「窗口捕获」(或显示器捕获),选择本应用
  2. 在应用一侧点击右上的「UIを隠す」(隐藏UI),得到干净的画面

背景为绿幕时(默认)

常见问题

生成需要多长时间?

3D模型生成需要几分钟到十几分钟(画面会显示进度与当前工序)。表情生成与动画生成各需几分钟左右。生成期间只需等待,完成后会有对话框提示。

点数是什么?

用于云端生成功能的付费点数。3D模型 800pt / 表情套装 200pt / 背景 60pt / 动画每秒 85pt / 用特征生成输入图片 25pt。余额显示在画面右上,可从应用内的商店购买。直播本身(口型同步、表情切换、动画播放、输出到OBS)不消耗点数。若因系统故障导致生成失败,点数会自动返还。

直播时的声音会被发送到什么地方吗?

不会。直播中的语音识别以及表情与动画的选择,都由本机的本地AI处理。

麦克风没有反应

请确认直播状态面板中的「マイク」(麦克风)是否为 ON,以及输入设备下拉框中是否选择了正确的麦克风。macOS 还需要在系统设置中授予应用麦克风权限。

做好的角色要从哪里继续?

在首页选择「モデル生成/設定」(模型生成/设置)→「保存済み選択」(选择已保存),即可从带缩略图的列表中选择过去创建的角色并继续。

所示画面来自开发中版本,规格可能会有变更。