セットアップ
Inkubus を起動するまでの手順です。ポイントは Ollama を先に起動しておくことと Node.js 24 以降。あとは zip を展開して 2 コマンドで動きます。
Inkubus は Ollama に接続して文章を生成します。Ollama が起動していないと作品を作れません。Inkubus を起動する前に、必ず Ollama を立ち上げてください。
01 必要なもの
- Ollama が起動していること(最重要。Ollama とは)
- ローカルで動かす場合: Ollama 公式サイト からインストール後、Ollama を起動(Windows / Mac は GUI アプリ、Linux は
ollama serve)。使いたいモデルをollama pull <モデル名>で取得。 - リモート(RunPod など)の場合は リモート Ollama を参照。
- ローカルで動かす場合: Ollama 公式サイト からインストール後、Ollama を起動(Windows / Mac は GUI アプリ、Linux は
- Node.js 24 以降(Windows / macOS / Linux いずれも)
- npm(Node.js に同梱)
- Google Chrome(推奨ブラウザ)
02 Ollama とは
Ollama は、AI のモデルを自分の PC で動かすための無料ソフトです。Inkubus は文章を自分では書きません。「こういう章を書いて」という指示を Ollama に投げて、返ってきた文章を並べて 1 冊にするのが Inkubus の仕事です。
つまり役割はこう分かれています。
| 担当 | |
|---|---|
| Ollama + モデル | 文章そのものを書く。作品の日本語の質はここでほぼ決まります |
| Inkubus | 何をどの順で書かせるか、途中で止まったらどうするか、書けたものをどう読ませ・どう本にするか |
だから Ollama が起動していないと Inkubus は 1 文字も作れません。逆に、モデルを大きいものに替えれば Inkubus 側の設定を変えなくても文章の質は上がります(そのぶん遅くなります)。
やることは 3 つだけ
- Ollama をインストールする — ollama.com から。Windows / Mac は普通のアプリ、Linux は
ollama serve。 - モデルを 1 つ取ってくる —
ollama pull gemma4:e4b-it-qatのように、ターミナルで 1 行。数 GB のダウンロードなので初回は時間がかかります。 - 起動したままにしておく — Inkubus はここに接続します。
モデルの名前の読み方
モデル名は gemma4:12b-it-qat のように「名前 : タグ」の形です。タグは同じモデルの大きさ違い・作り違いを表します。
| 部分 | 意味 |
|---|---|
gemma4 | モデルの系統(Google の Gemma 4)。Inkubus が検証しているのはこの系統です |
12b | 大きさ(パラメータ数、b = 10 億)。大きいほど賢く、遅く、メモリを食います。e4b はいちばん小さい省メモリ版 |
it | 指示に従うように調整済み(instruction-tuned)。これが無い版は「続きを書く」だけで、指示を聞きません |
qat | 小さく圧縮することを前提に訓練し直した版。同じ容量なら品質が落ちにくいので、Inkubus ではこれを推奨します |
必ず -it-qat が付いたタグを使ってください。タグを省いた gemma4 のような指定だと、旧ビルドが降ってきて日本語が <0xE3> のような文字列に化けることがあります(Inkubus 側で自動修復しますが、そもそも起こさないほうが確実です)。
モデルはどこで探すか
- モデル一覧(全体): ollama.com/search — Ollama で動くモデルを探す場所です。
- Gemma 4 のタグ一覧: ollama.com/library/gemma4/tags — 大きさごとのファイルサイズがここに出ています。下の「どのモデルを選ぶか」で使う数字はこれです。
03 推奨モデル
Inkubus の本文生成は Gemma 4 シリーズの -it-qat ビルドで検証しています。まずは いちばん軽い gemma4:e4b-it-qat で 1 本通してみてください。動くことと速さの感覚が分かったら、お使いの PC のメモリに合わせて上の段へ移っていきます(→ どのモデルを選ぶか)。
| モデル | サイズ | 生成速度の目安 RTX 5070 Ti / 16GB | 位置づけ |
|---|---|---|---|
gemma4:e4b-it-qat | 約 6 GB | 約 170 字/秒 | まず最初の 1 本に。いちばん軽く、たいていの PC で動きます。品質は下の段に譲るので、下書き・量産・動作確認向き |
gemma4:12b-it-qat | 約 7 GB | 約 76 字/秒 | ふだん使いの基準。VRAM 16GB に余裕で収まって速く、品質も実用的です |
gemma4:26b-a4b-it-qat | 約 16 GB | 約 19 字/秒 | 速さと品質のバランス型。必要なところだけを動かす仕組み(MoE)なので、サイズのわりに速く動きます |
gemma4:31b-it-qat | 約 19 GB | 約 4 字/秒 | 品質重視。いちばん良い文章になりますが、VRAM 16GB では CPU 併用になり大きく遅くなります |
サイズは Ollama のタグ一覧 に出ているダウンロード容量です(実際に必要なメモリはこれより少し多くなります → 次の節)。速度は開発機(GeForce RTX 5070 Ti・VRAM 16GB)で本編 1 章(約 2,500 字)を書いたときの実測の目安で、e4b の数字は -it-qat が付かないビルドでの計測です。お使いの GPU の VRAM で大きく変わります。詳しくは 生成速度の目安 を参照してください。
# まずはこれ 1 つで動きます
ollama pull gemma4:e4b-it-qat
# 慣れてきたら、PC のメモリに合わせて足していく
ollama pull gemma4:12b-it-qat
ollama pull gemma4:26b-a4b-it-qat
ollama pull gemma4:31b-it-qat
Inkubus 自体は任意の Ollama 対応モデルで動きます。モデルは新規実行画面のモデル選択で、取得済みのものから選べます。他のモデルを使う場合の目安は「日本語の長文に耐える大きさ」と「コンテキスト 64K 以上」です。
04 どのモデルを選ぶか — メモリの目安
モデル選びは、好みの前に「その大きさが自分の PC に載るか」で決まります。判定は次の 3 段だけです。
| 状態 | どうなるか | どうするか |
|---|---|---|
| ① GPU の VRAM に 全部収まる |
速い。これが本来の姿です | そのまま使う。もう一段大きいモデルも試す価値あり |
| ② VRAM には収まらないが VRAM + PC のメモリなら収まる |
遅いけれど動く。はみ出した分を CPU が肩代わりするので、桁で遅くなることがあります | 一晩まわす前提なら実用になります。速さが要るなら リモート Ollama |
| ③ 合計にも収まらない | 動きません。読み込みに失敗するか、実用にならない遅さになります | 一段小さいモデルにするか、リモート Ollama(RunPod など)で借りる |
VRAM = グラフィックボードのメモリ、PC のメモリ = いわゆるメインメモリ(RAM)です。GPU を積んでいない PC(Mac の多くを含む)では、①は無く②か③になります。
必要なメモリは「モデルのサイズ+α」
上の表のサイズはファイルの容量で、実際に載せるときはこれに「読ませた文章を覚えておく領域」が上乗せされます。この領域はコンテキストサイズ(新規実行画面で指定)を大きくするほど増えます。
実測の一例: gemma4:12b-it-qat はファイル約 7.2GB に対し、コンテキスト 8K で VRAM 約 8.0GB を使っていました。長編を書くために 64K・128K と広げると、この差はもっと開きます。ぎりぎり収まるモデルを選ぶより、一段小さいモデルで文脈を広く取るほうが速いことが多いです。
収まっているかは Inkubus が教えてくれる
あふれて CPU 併用になっている間、Inkubus は画面の上に警告を出します。
VRAM 超過: gemma4:31b-it-qat が GPU 62% / CPU 38% で動作中のため低速です。コンテキストを下げるか VRAM を増やすと速くなります。
この帯が出なければ①(全部 VRAM に載っている)、出ていれば②です。推測ではなく Ollama が報告している実測値なので、これが選び方のいちばん確実な物差しになります。まず e4b で 1 本まわし、次に一段大きいモデルで帯が出るかどうかを見る、という順で自分の上限が分かります。
③ に当たったときと、② を速くしたいときだけ、外部の GPU を借りる選択肢があります。RunPod などで Ollama を動かし、Inkubus の設定画面から接続先を切り替えるだけです(作品は手元に保存されます)。手順は リモート Ollama へ。
05 zip の展開
配布 zip は、展開すると inkubus/ フォルダができる構造です(アップデート時の上書きを楽にするための固定名)。
Windows(GUI で展開)
zip を右クリック → 「すべて展開」。ダイアログの展開先パスの末尾にある \inkubus-x.y.z を 消してから OK してください(消さないと二重にネストします)。例: 展開先を C:\Users\<あなた>\code にすると ...\code\inkubus\ ができます。
macOS / Linux(ターミナル)
# 任意の親ディレクトリで展開
cd ~/code
unzip ~/Downloads/inkubus-x.y.z.zip
# → ~/code/inkubus/ ができる
06 インストール
展開した inkubus/ に移動して:
cd inkubus
npm ci
server/ と web/ 両方の依存関係が、配布時にロックされたバージョンでインストールされます。初回は数分かかることがあります。
07 起動
お使いのバージョンで起動コマンドが違います。下の npm start は v3.0.0 以降で使えます。v2.7 など、それより前のバージョンをお使いの方は npm run dev で起動してください(下の説明)。ブラウザで開く URL はどちらも同じです。
npm start
ブラウザで http://localhost:5173 を開いてください。夜間バッチ中心の使い方なので、起動したらそのまま置いておく想定です。
起動したターミナルには使い方ページへのリンクが出ます。http://localhost:5173/docs/ が Inkubus に同梱されている使い方(インターネット接続なしで読めます)、https://inkubus.pages.dev/ がいつでも最新の公開版です。ポートを変えて起動した場合は、その番号でリンクが表示されます。
もうひとつの起動方法 —— npm run dev
従来からある起動方法で、いまも使えます(v2.7 など古いバージョンではこちらだけ)。開く URL は同じ http://localhost:5173 です。
npm start(おすすめ) | npm run dev | |
|---|---|---|
| 開く URL | http://localhost:5173(同じ) | |
| ポート | 1 つ(5173) | 2 つ(5173 と 3000) |
| 向き | ふつうに使う | ソースを書き換えて試す |
| 特徴 | 軽い・表示が速い | ファイルを保存すると画面にすぐ反映される(そのぶんサーバも再起動するので、生成の途中で保存すると生成が止まります) |
どちらを使えばいい? ふだん使うなら npm start(v3.0.0 以降)。ソースを書き換えて試したい方と、v2.9.2 以前をお使いの方は npm run dev です。
2 つを同時に起動しないでください。どちらも 5173 を使うため、開くたびに違う画面が出るなど、原因の分かりにくい状態になります。切り替えるときは、先に動いているほうを Ctrl+C で止めてから。
08 データの保存場所
- データベース(SQLite):
server/data/app.sqlite。生成された本文もメタデータもここに入ります。 - キャストの画像:
server/data/cast/{characterId}/(原本 + サムネイル) - 以前の作品の本文:
server/output/{runId}/{workId}/*.md(v2.9 より前のバージョンで作った作品)
いずれも初回起動時に自動作成されます。バックアップは npm run backup の 1 コマンドで、server/data/(キャスト画像を含む)と server/output/ をまとめて日時入りの zip に退避できます(詳しくは バックアップ)。手動で取る場合は、この 2 つのフォルダをまるごとコピーしてください。
09 LAN / スマホからのアクセス
Inkubus は既定で 0.0.0.0(同一 LAN のどこからでもアクセス可)に bind します(npm start / npm run dev のどちらも)。同じ Wi-Fi のスマホ・タブレットから、PC の IP にブラウザで接続できます。
- PC 側で Inkubus を起動。
- PC の LAN IP を調べる(Windows:
ipconfigの「IPv4 アドレス」/ macOS: Wi-Fi の詳細 / Linux:ip addr)。 - スマホのブラウザで
http://<PC の IP>:5173を開く(例:http://192.168.1.23:5173)。
セキュリティ注意。LAN 公開状態では同じ Wi-Fi 内の誰でも Inkubus にアクセスでき、Inkubus は認証を持ちません(閲覧・生成開始・削除・設定変更が誰でも可能)。信頼できるネットワークの下でのみ有効にしてください。公衆 Wi-Fi では特に注意。Windows のファイアウォール許可はプライベートネットワークのみに。
LAN 公開を無効にする(localhost-only)
# macOS / Linux
HOST=127.0.0.1 npm start
# Windows(PowerShell)
$env:HOST="127.0.0.1"; npm start
npm run dev で起動する場合も同じように HOST を付けられます。
外出先からアクセスしたい場合
直接インターネット公開はしないでください(認証がないため世界中からアクセス可能になります)。VPN 経由を推奨します — Tailscale / WireGuard(個人利用は実質無料)、ドメインがあれば Cloudflare Tunnel。リモート Ollama も参照。
10 ポートの競合
5173(npm run dev の場合は 3000 も)を別アプリが使っていると起動できません。その場合は EADDRINUSE というエラーで止まり、変更のしかたが画面に出ます。
# npm start の場合: 開く URL も同じ番号になる
PORT=3100 npm start
# npm run dev の場合: server と、web のプロキシ先を同じ番号に揃える
PORT=3100 API_PORT=3100 npm run dev
PORT…npm startではアプリを開くポート(既定5173)。npm run devでは server のポート(既定3000)。API_PORT…npm run devのときだけ必要。web(Vite)が/api/*をプロキシする先で、PORTと同じ番号に揃える。npm run devの web は5173が使用中なら自動で次の空きポートに fallback します。
詳細は FAQ も参照。
11 アンインストール
展開したフォルダを削除するだけです。レジストリや %APPDATA% には何も書きません。