よくある質問
トラブルシューティングとよくある質問をまとめました。質問をクリックすると回答が開きます。
問い合わせ
購入後の問い合わせはどこへ?
購入した note 販売記事のコメント欄、または note のメッセージ機能までお願いします(個人情報は書かないでください)。返信はベストエフォートで、買い切りソフトウェアという性質上、即時対応は保証していません。
起動・接続
npm start と npm run dev はどう違う?
どちらでも Inkubus は動き、開く URL は同じ http://localhost:5173 です。ふだん使うなら npm start(v3.0.0 以降)をおすすめします。ポートを 1 つしか使わず、表示も速くなります。
npm run dev は開発用で、ポートを 2 つ(5173 と 3000)使います。ソースを書き換えるとすぐ画面に反映される代わりに、生成の途中でファイルを保存すると生成が止まります。ソースを触らないなら npm start のほうが安全です。
2 つを同時に起動しないでください(どちらも 5173 を使うため、開くたびに違う画面が出るなど分かりにくい状態になります)。詳しくは セットアップ。
ポート 3000 / 5173 が使われていて起動できない
起動時に EADDRINUSE が出る場合、同じポートを使う別プロセスがあります。別ポートで起動するか、元のプロセスを止めてください。
# npm start の場合
PORT=3100 npm start
# npm run dev の場合(PORT と API_PORT を同じ番号に)
PORT=3100 API_PORT=3100 npm run dev
多くは前回の Inkubus 自身が残っているのが原因です(Windows: netstat -ano | findstr :5173 → taskkill / macOS・Linux: lsof -ti:5173 | xargs kill)。npm start と npm run dev を同時に起動しないようにしてください(どちらも 5173 を使います)。
モデル一覧が空 / 「Ollama に接続できません」
① Ollama が起動しているか(ローカルは ollama list、リモートは URL にブラウザでアクセスして「Ollama is running」)。② 設定画面の「接続テスト」で到達確認。③ OLLAMA_BASE 環境変数が変な値になっていないか。
どのモデルを使えばいい? 自分の PC でどこまで大きいモデルが動く?
まず gemma4:e4b-it-qat(約 6GB)で 1 本通してください。いちばん軽く、たいていの PC で動きます。動くことと速さの感覚がつかめたら、12b → 26b-a4b → 31b と上げていきます。
上げられる限界はメモリで決まります。判定は 3 段だけです。
- GPU の VRAM に全部収まる → 速い。もう一段上も試せます。
- VRAM には収まらないが、VRAM + PC のメモリなら収まる → 遅いけれど動きます。一晩まわす使い方なら実用になります。
- 合計にも収まらない → 動きません。一段小さいモデルにするか、リモート Ollama(RunPod など)を使ってください。
自分がどれに当たるかは推測しなくて大丈夫です。あふれている間、Inkubus は画面上部に「VRAM 超過: … が GPU ○% / CPU ○% で動作中のため低速です」と出します(Ollama の実測値)。この帯が出なければ全部 VRAM に載っています。詳しくは どのモデルを選ぶか へ。
生成
think の「設定なし」と「OFF」は何が違う?
「設定なし」は、Ollama に何も伝えない状態です。Gemma 4 のような考えるモデルは、この状態だと考えてから書きます。「考えない」という意味ではありません。これまでに作った作品はすべてこの状態です。
「OFF」を選ぶと、考えごとをやめて本文から書き始めます。考えごとのぶんの生成が無くなるので速くなります。文章がどう変わるかはモデルと作品によるので、同じ制約で何本か書いて見比べてみてください。
「ON」は考えることを明示的に頼む指定です。設定なしとほぼ同じ動きになりますが、記録の上では区別されます。考えることに対応していないモデルでは使えず、生成を始める前に画面でお知らせします。
どの設定で書いたかは小説ビューの実行情報に残り、ジョブ画面の履歴にも印が付きます。速さを見比べるときは、ジョブ画面のベンチマークで単位を「字/秒」にしてください(考えごとの分をトークン数に数えるかどうかがモデルによって違うため、tok/s は同じ土俵になりません)。
キャストの「名前の候補」が出ずに失敗する
考えるモデルは、本文を書き始める前に長い「思考」を書き出すことがあります。その思考もコンテキスト(モデルが一度に読み書きできる長さ)を使うので、思考だけで使い切ってしまうと、肝心の名前の候補が返ってきません。
キャスト詳細の「AI が考えます」の枠から コンテキストを大きくするか、think を OFF にして試してください。どちらもその場で変えられます。選んだ組み合わせは次からの既定になります。
失敗したときのメッセージは 3 通りに分かれていて、「考えるだけで終わりました」と出ていればこのケースです。画像の解析やプロフィールの生成でも同じ設定が使えます。詳しくは キャスト — AI の設定。
生成が途中で止まる・文字化けする
- コンテキストが小さい: 64K(65536)以上を推奨。
- temperature が高すぎる: 1.5 以上だと日本語が崩れやすい。推奨 0.9〜1.1。
- モデルが小さい: 7B クラスは長文で破綻しがち。20B 以上推奨。
<0x…> のような文字が混じる場合: 新しい Ollama(0.30 系)と一部のモデル(とくに Gemma 系)で、全角スペースや珍しい漢字が <0xE3>… のような表記になることがあります。データの破損ではなく、Ollama 側で文字をうまく組み立てられなかったときの表記です。Inkubus が生成のたびに自動で元の文字へ戻します(小説・ひらめき・キャストの AI のすべて)。過去に作った小説に残っている場合は、その作品を開いた画面の「文字化けを修正」ボタンでまとめて直せます。根本的に減らしたいときは、Ollama を安定して動く版で使うのが確実です。
制約欄にはどれくらいの長さを入れられますか?(お手本の本文を貼りたい)
文字数の上限は 100 万字です(文庫本 3〜4 冊ぶん)。お手本にしたい小説の本文をまるごと貼って「この文体で書いて」と頼む使い方もできます。
ただし実際に入る量を決めているのは文字数ではなく「コンテキストサイズ」です。制約は AI がその作品を書いているあいだずっと覚えておく内容なので、本編の分量と足してコンテキストサイズに収まる必要があります。新規実行画面は収まりそうにないと必要な大きさを添えて警告を出すので、それを見ながら調整してください。詳しくは 制約の書き方。
新規実行画面に上限の数字は書いてありません。上限に届いたときだけ、入力欄の下の文字数が赤くなり「これ以上は入りません」と出ます。この表示が出ていなければ、貼り付けた内容はすべて入っています。
作品数 100 が現実的な時間で終わらない
まず作品数 1・章数 4 で 1 本の所要時間を計測してください。総所要 ≒ 1 本の時間 × 100 + スリープ × 99。GPU 冷却スリープは「作品間スリープ (ms)」で調整可能(既定 60 秒)。途中で止めたくなったら「バッチを停止」でソフト/強制が選べます。
モデルを切り替えると古いモデルはメモリに残る? VRAM が溢れない?
基本的に溢れません。Inkubus は生成のたびにモデルを読み込み直さずに済むよう、Ollama に「モデルをしばらくメモリに保持する」よう指示しています(しばらく使わなくても自動では降ろさない、という設定です)。これはメモリを固定的に占有し続ける設定ではありません。
別のモデルに切り替えたときの Ollama の動きは次のとおりです。
- 空き VRAM に収まるなら、前のモデルも載ったまま新しいモデルが追加で読み込まれます(Ollama は空きがある限り複数のモデルを同時に保持します)。
- 空きが足りないときは、Ollama が使われていない(生成していない)モデルを自動で降ろして、新しいモデルのための場所を空けてから読み込みます。
そのため「古いモデルが残り続けて VRAM が溢れる」ことは基本的に起きません。ただし新しいモデルは VRAM に丸ごと収まる必要があり、収まらないと一部が CPU 側に分割されて大幅に遅くなります(生成速度の目安を参照)。今すぐメモリを空けたい場合は、Ollama 側で ollama stop <モデル名> を実行すれば手動で降ろせます。
「実行中」のまま戻らない(キャストの AI / 小説生成 / ひらめき)
Ollama がフリーズすると「実行中」フラグが立ったままになることがあります。設定画面の「LLM 排他フラグ」から該当処理を強制クリアできます(誤クリアは二重発火の可能性、DB 整合性は保たれます)。詳細は ジョブの排他制御。
生成された本文に問題があると感じる
Inkubus はローカル LLM が書いた文章をそのまま表示・保存します。品質・適法性・倫理性は LLM の性能に依存し、保証はされません。利用前に必ず内容を確認してください。
作品の管理
タイトルだけ作り直せますか?
できます。小説ビューの モード を 推敲 にすると、本文を最後まで読み直した AI がタイトルとサブタイトルの案を出します。タイトルは物語を書き始める前に決まるので、書き上がってから付け直すほうが作品に合うことが多いです。
案は好きなだけ作り直せますし、タイトルだけ・サブタイトルだけの採用もできます。採用しても元のタイトルは残るので、いつでも戻せます。詳しくは AI推敲。
本にする前に中身を確かめられますか?
できます。製本画面の 試し読みする を押すと、本のかたちで最初から最後まで読める画面が開きます。書き出す EPUB とまったく同じ変換を通した紙面なので、ここで見えたものがそのまま本の中身です(表紙から始まります)。
めくり方は紙面の左半分をタップで次のページ・右半分で前のページ・中央でメニューの出し入れ。左右のスワイプ、キーボードの ← → でも進みます。横に長い画面では見開き 2 ページになります。詳しくは 製本ガイドの「試し読み」。
作った本を Kindle で売れますか?
売れます。日本語の小説を Kindle で出すには EPUB を自分で用意するしかなく(Amazon の原稿作成ソフトは日本語では文字サイズを変えられる形式に対応していません)、製本画面で書き出した EPUB がそのまま使えます。表紙を作るツールも日本語には対応していないので、Inkubus の表紙がそのまま「独自デザインの表紙」になります。
商品ページに出す表紙は本の中の表紙とは別に上げるファイルです。製本画面の 出版の準備 から書き出せます。出すまでの手順・あとから変えられない項目・AI 生成の申告・成人向けの扱いは Kindle に出す(KDP) にまとめました。
生成された作品はどこにありますか
本文もメタも server/data/app.sqlite(データベース)です。v2.9 より前のバージョンで作った作品の本文は server/output/{runId}/{workId}/*.md に残っていて、そのまま読めます(設定画面の「データ管理」タブから任意でデータベースへ取り込めます)。UI からはどちらも .md / .txt でダウンロードできます。
作品を消したのに output/ にファイルが残っている
「削除」はソフト削除(データベース上で隠すだけ)です。以前のバージョンで作った作品のファイル実体は残ります。完全に消すには手動で server/output/{runId}/ を削除してください。
使っているロールを削除したらどうなりますか
過去の作品・バッチは壊れません(ロール名は文字列として保存済み)。ただしそのロールで新規バッチを起動しようとするとエラーになります。
タブを閉じたら生成は止まりますか
止まりません。バッチはサーバプロセスで走り、ブラウザは表示だけ。閉じてもヘッダの「実行中」バッジから戻れます。サーバプロセスが落ちた場合は、途中のバッチが interrupted 状態で保存されます。
途中で止めたバッチは再開できますか
できます。停止したバッチや、サーバが落ちて中断になったバッチは、そのバッチの小説ビューにある「続きから再開」から続きを生成できます。完成済みの作品はスキップし、途中まで生成された作品は未完了の章から、まだ手つかずの作品は最初から生成します。生成済みの章やあらすじはそのまま残ります。
キューに積んだのに朝になったら走っていない
キューはサーバ再起動で自動的に停止状態にリセットされます(意図せぬ自動起動を避けるため)。朝ジョブ画面を開いて「稼働中」に戻してください(キュー内容は消えていません)。また連続 2 回失敗でも自動停止します。
ネットワーク
スマホ・タブレットからアクセスしたい
同じ Wi-Fi の PC で Inkubus を起動すれば、PC で開いている URL の localhost を PC の IP に置き替えるだけでアクセスできます(ポート番号はそのまま。詳細は セットアップ)。LAN 公開に不安があれば HOST=127.0.0.1 を付けて起動すると localhost-only に戻せます。
同じ Wi-Fi の家族・他人に見られたくない
Inkubus に認証はありません(LAN 内の全員にアクセスされる前提)。信頼できないネットワークでは LAN 公開をやめる(HOST=127.0.0.1)か、ファイアウォールで Inkubus が使っているポート(起動時にターミナルに表示されます)への外部アクセスを遮断してください。外出先からは VPN 経由を。
キャストの AI が 5 分くらいで必ず失敗する
v3.0.0 で解消しました。v3.0.0 より前は、Ollama への待ち時間に 5 分という見えない上限が掛かっていました。自分の PC で動かしていても、設定をいくら長くしても、5 分を超えると失敗します。大きいモデルや長い作品では簡単に超えてしまう長さでした。
v3.0.0 からは、1 回のやりとりで結果が返る処理(キャストの AI 1 画像を読む・AI 2 名前を考える・AI 3 プロフィールを書く)は時間で打ち切りません。途中から再開できない処理なので、時間切れにすると待った分がまるごと無駄になるためです。時間で打ち切るのはリモート接続で小説を生成しているときだけで、こちらは打ち切っても同じ章を自動で再試行できます。組み合わせの一覧は リモート Ollama の「打ち切りまでの時間」 にまとめました。
アップデート
アップデート方法は?
アップデート手順を参照してください。サーバ停止 → 上書き展開 → npm ci → 起動の流れで、作品データ(server/data/ と server/output/)は消えません。