個人的な日本語ローカルLLM関連のメモ用Wikiです。一般の方は編集できません。

×
TavoはスマホでローカルLLMを含む、任意のLLMとAPI接続してRPチャットができるLLMのフロントエンドアプリです。

簡単に言えばスマホで動くSillyTavernみたいなものです。
LoreBooks機能、OpenAI互換TTS、画像生成との連携などに対応していますし、SillyTavernのキャラクターカードも読み込めます。

TavoはLLMのフロントエンドアプリなのでアプリ単体ではAIとチャットできません。
各種クラウドなLLMやPCなどで実行しているローカルLLM(OpenAI互換API)などに接続する必要があります。

※大手のLLMプロバイダーと直接契約、利用すると最悪の場合アカウントがBANされるのでSonnet、Opus、ChatGPT、Geminiなどの大手LLMを使う場合でもOPやNanoGPTなどのLLMルーター事業者と契約して利用するのがオススメです。
詳しくは【NanoGPT】月12ドルでオープンウェイトモデルが実質使い放題のLLMサービスページをご覧下さい。

公式サイト:https://www.tavoai.dev/app/index.html#/

アプリ配布先
App Store
Google Play

編集予定:
  • ローカルのOpenAI互換TTSとの接続例など
  • ローカルの画像生成AIとの連携例など

編集履歴:
260626:「チャットする」の内容追加, 「その他、関連するWiki内のページなど」項目追加



・SillyTavernとの比較

・実行環境など

SillyTavernもスマホにインストールできなくはないのですが、結構面倒です。(※参考までにAndroidへのインストール方法:https://docs.sillytavern.app/installation/android-...
このため、SillyTavernは主にPCにインストールして使うのが主流かと思われます。
PCなどでSillyTavernを実行していれば、ローカルネットワーク内であれば(またはWireGuardなどの自宅VPNを使えば外からも)スマホからアクセスして使用できますが、その間は常にPCなどSillyTavernをインストールしたマシンを起動させていなければいけません。

TavoならiOSまたはAndroidのスマホ(とAPI接続するLLM)で完結するのでスマホから利用するのがメインのユーザーならこちらの方が良いかもしれません。

・拡張機能など

現時点(26/06/26)ではTavoはプラグインなどの外部拡張機能には対応していません。
例えば、SillyTavernのVRM拡張機能(VRM形式の3Dキャラクターモデルを表示させる拡張機能)などに相当する機能はありません。

そのため、多機能性や拡張性ではSillyTavernに対してTavoは劣ります。

・UIなど、操作性

SillyTavernのUIは(機械翻訳レベルですが)日本語に対応しています。
Tavoは現時点(26/06/26)では英語、スペイン語、中国語のみです。

ただ、SillyTavernの慣れないと何処に何があるかわからない設定画面に比べるとTavoはシンプルなUIで操作性に勝ります。

・プライバシーや規約、開発元など

SillyTavernがオープンソースソフトウェアでデータ収集などを行わない一方、Tavoは香港の中国企業が開発したクローズドなソフトウェアです。
Tavoはチャット内容などを収集したりしないと規約で明記していますが、クローズドなソフトウェアなためそれを検証する事は困難です。
また、SillyTavern、Tavo共にクラウドなLLMサービスに接続して使用する際はLLMを運営している事業者にチャットの内容などが収集される可能性はあります。

アプリ初回起動時に表示されるTavoの規約

・クイックスタート

・LLMへAPI接続


アプリインストール後、規約に同意するか聞かれるので同意します。


まずはLLMへAPI接続します。
今回は例として、GeminiやDeepSeekなどにアクセスできるLLMルーターサービスのNanoGPTにAPI接続してみます。
「API connection」をタップして「Create」から新しいAPI設定を作成します。


名前をわかりやすいものに、「Model Platform」に利用しているサービスの物か、今回のNanoGPTやローカルLLMの場合は「Custom (OpenAI-compatible)」のOpenAI互換APIを選びます。
「API base URL」にNanoGPTを使用している際は下記の通りに、ローカルLLMを使用している際はローカルLLMを実行しているPCのアドレスやportなどを入力します。
# Text generation web UIの場合の例
http://{PCのアドレス}:5000

# NanoGPT 通常
https://nano-gpt.com/api/v1

# NanoGPT サブスク対象のモデルのみ
https://nano-gpt.com/api/subscription/v1
「API Key」はローカルLLMの場合は空欄で大丈夫ですが、NanoGPTの場合は【NanoGPT】月12ドルでオープンウェイトモデルが実質使い放題のLLMサービスを参考に発行したAPIキーを入力します。

「Model」から利用する言語モデルを選びます。ローカルLLMの際はロードした言語モデル名が表示されるはずです。
今回は「GLM-5.2」を選びました。

あとは「Save」で入力したAPI設定を保存します。

・キャラクターの作成/インポート


画面を戻り、「Characters」をタップします。
最初はなんのキャラクターも居ないので右上の「Create」からキャラクターの作成/インポートを行います。

今回は例として、筆者の作ったキャラクターカードを読み込ませます。
このWikiの掲示板のスレッド、SillyTavernのRP用キャラクターカードなどの配布スレからダウンロードするか、下記のURLを「Import character from URL」の入力欄に貼り付けてインポートします。
https://image02.seesaawiki.jp/l/o/local-llm-memo/fd69f1c29b45f525bc1e.png
・New character (新しいキャラクターの作成)

ゼロから新しいキャラクターを作成します。
キャラクターの記述方法などについては【ローカルLLM】SillyTavern向けプロンプト記述方法などページをご覧下さい。
  • Name (Name your character)
(名前:キャラクターの名前を入力してください)
  • Description (Basic settings such as name, gender, age, occupation, hobbies, etc.)
(説明:名前、性別、年齢、職業、趣味などの基本設定)
  • Greetings (The first message the character sends to you (greeting). Use <START> to separate multiple alternative greetings)
(挨拶:キャラクターがあなたに送る最初のメッセージ(挨拶)です。<START> を使用して、複数の異なる挨拶パターンを区切ってください)
  • Advanced definitions (詳細設定)
・Import character from file (ファイルからキャラクターをインポート)

SillyTavern互換のJSONまたはPNGファイルをサポートしています。
・Import character from URL (URLからキャラクターをインポート)

主要なコミュニティのURLを使用してキャラクターをインポートします。

・チャットする


「Start chatting」からチャットを開始します。
画面左中央の横三本線のアイコンをタップすると全画面に、もう一度タップするとチャットのセッションタブが表示されます。


画面左下の「🔃」アイコンはLLMの応答を再生成します。


画面左下から2番目の「⏩️」アイコンはLLMにチャットメッセージの続きを生成するものです。
※通常のチャットだとユーザーの入力 → LLMの応答 → ユーザーの入力...と続きますが、LLMの応答 → LLMの応答...となります。


画面左下から3番目のアイコンは、ユーザーの入力をLLMが代わりに考えてくれます。(Impersonate,なりきり/代筆, AIにユーザー側の返答を書かせる機能)


画面下部のチャット入力欄の左、「+」をタップすると、それぞれ「Photos」(端末内の画像を選んで送信)、「Camera」(カメラを起動して撮った写真を送信)、「Imagen」(画像生成)、「Impersonate」(なりきり/代筆, AIにユーザー側の返答を書かせる機能)です。


チャット入力欄をタップして入力画面になると右下に「""」と「**」が表示されますが、これらは主に英語圏のキャラクターカードでよく使われる引用符(日本語で言うところの「」(キャラクターやユーザーの発言に用いられる))と、アスタリスクで囲んだ地の文などを表現する ** です。

こうしてキャラクターの発言と地の文を区別することで地の文を斜体にしたり、キャラクターの発言テキストを色付けしたりできます。
個人的には""はともかく**は多用するので助かります。

・設定など


画像1枚目の通りに操作して設定画面に入ります。

・API connections (API接続)


API接続の管理画面です。
新規作成のほか、既存の設定のコピー、編集、削除ができます。

・Characters (キャラクター)


キャラクターの管理画面です。
キャラクターの編集などが行えます。

・Personas (ペルソナ, ユーザー側の設定)


チャット時のユーザー側の設定(名前など)を編集できます。

・Theme (テーマ)


アプリのUIのテーマを変更できます。

・Voice & image (音声と画像)


TTS(Text-to-Speech, 音声読み上げ機能)の設定や、画像生成AIとの連携の設定画面です。
・Voice API (TTS APIの設定)

Voice API (TTSのAPI)設定です。
GPT (OpenAI)やGoogle Gemini TTSのほか、OpenAI互換TTS(「Custom (OpenAI-compatible)」)にも対応しています。
ローカル環境でTTSをする場合はVOICEVOXなどをOpenAI互換TTS APIにしてAIに喋らせるページなどもご覧下さい。
・Character voices

TTS APIの設定がされている場合、この項目でキャラクターごとにVoiceを割り当てする事ができます。
・Persona voices

こちらはペルソナ(ユーザー側のキャラ設定)に対して割り当てるVoiceを設定できます。
・Voice settings

TTSの詳細な設定です。
  • 「Auto-play character voices」(キャラクターボイスを自動再生)
  • 「Auto-play persona voices」(ペルソナボイスを自動再生)
  • 「Background playback」(バックグラウンド再生)

  • Playback rules (再生ルール)
  • 「Do not play anything (何も再生しない)
  • 「Do not play (narration) ((ナレーション)を再生しない」)
  • 「Play "quotes"」(「引用符」内を再生する)
  • 「Do not play code blocks」(コードブロックを再生しない)
  • 「Do not play <tags> 」(<タグ>を再生しない)
・Image generation API (画像生成API)

画像生成AIとの連携設定です。
NovelAIや、OpenAI互換APIと接続できます。
・mage generation settings (画像生成設定)

画像生成AIとの連携時の詳細設定です。
  • 「Image injection prompt 」(画像インジェクションプロンプト)
生成プロンプトを画像キャプションに挿入し、チャット履歴から参照できるようにするためのテンプレートです。今回の生成プロンプトを参照するには {{prompt}} マクロを使用してください。
  • 「Prompt enhancement」 (プロンプト拡張)
  • 「Smart expand」(スマート拡張)
LMを呼び出してプロンプトを拡張し、サイズやネガティブタグを抽出します。
  • 「Template」(テンプレート)
プリセットテキストでプロンプトを囲みます。LLMは呼び出しません。
  • 「Disabled」(無効)
処理を行わず、そのまま送信します。
  • 「Smart expand API」(スマート拡張API)
設定した場合、チャットAPIの代わりにこの(LLM)APIがプロンプトの拡張処理を行います。
  • 「Smart expand instruction」(スマート拡張命令)
「Prompt enhancement」 (プロンプト拡張)が「Smart expand」(スマート拡張)の際に使用されるLLMへのプロンプトです。
以下、デフォルトのプロンプト
Target image model: {{platform}} / {{model}}

Expand the user's input into a richer image-generation prompt, and extract any size / ratio / negative hints they mentioned.

Rules:
- Tag-based models (NovelAI, SD family): comma-separated Danbooru-style tags
- Natural-language models (Gemini, Imagen, Flux, gpt-image): a vivid English description in 1-2 sentences
- Preserve the user's core subject; keep ONE coherent scene; write the prompt in English

Return ONLY a JSON object (no markdown fences) with these fields (null if not applicable):
- "prompt": the expanded prompt
- "negativePrompt": exclusion tags &#8212; only for tag-based models
- "aspectRatio": "16:9" etc. &#8212; only if user mentioned
- "size": "1024x1024" etc. &#8212; only if explicitly mentioned

User input: {{prompt}}

# Google翻訳
対象画像生成モデル: {{platform}} / {{model}}

ユーザーの入力をより詳細な画像生成用プロンプトに拡張し、サイズ、アスペクト比、ネガティブプロンプトに関する指定があれば抽出してください。

ルール:
- タグベースのモデル (NovelAI, SD系): カンマ区切りのDanbooru形式タグ
- 自然言語モデル (Gemini, Imagen, Flux, gpt-image): 1〜2文の鮮明な英語の描写
- ユーザーの主題を維持し、一貫性のある単一のシーンとして構成すること。プロンプトは英語で記述すること。

以下のフィールドを含むJSONオブジェクトのみを返してください(Markdownのコードブロック記号は不要。該当しない場合はnull):
- "prompt": 拡張されたプロンプト
- "negativePrompt": 除外指定タグ(タグベースのモデルのみ)
- "aspectRatio": "16:9" など(ユーザーの指定がある場合のみ)
- "size": "1024x1024" など(明示的な指定がある場合のみ)

ユーザー入力: {{prompt}}

・Model settings (モデル設定)


  • 「Memory」 (メモリ)
キャラクターの短期記憶として、デフォルトでは直近の20メッセージのみをモデルに送信します。
  • 「Max response tokens」(最大応答トークン)
モデルの応答における最大トークン数。少なすぎると、応答が途中で切れる可能性があります。
  • 「Temperature」 (温度)
  • 「Top-P」
  • 「Top-K」
言語モデルの生成パラメータです。言語モデルや用途によって推奨値は異なります。
  • 「Streaming 」(ストリーミング)
チェックボックスがONだと、応答が生成されるたびに少しずつ表示します。

・Presets (プリセット)


LLMへプロンプトやLoreBookなどをどう渡すか、などのプリセットです。
ここの「Main Prompt」などに脱獄文などを記述すると...?

・Lorebooks (ロアブック)


ロアブックのインポートや作成が行えます。
ロアブックについてはSillyTavernの使い方など/World Info / LoreBookをご覧下さい。

・Regex (正規表現)


正規表現(Regex)は、メッセージの表示時または送信時に内容を変更します。情報の修正、指示の追記、フォーマットの削除などに頻繁に使用されます。

・Long-term memory (長期記憶)


長期記憶と言って、長くなったチャットの履歴を「要約」する事で最初の方の出来事などを「忘れない」ようにする設定です。
  • 「Dedicated API」(専用API)
設定した場合、チャットAPIの代わりにこのAPIを使用して記憶の要約を行います。
  • 「Auto summarize」(自動要約)
デフォルトで10メッセージごとに記憶を要約します(0に設定すると無効になります)
  • 「Memory limit」(メモリ制限)
保存するメモリ行数の最大値です。
  • 「Summary prompt」(要約プロンプト)
記憶を要約するためのプロンプトです。
以下、デフォルトのプロンプト
Summarize the most important facts and events in the story so far.
If a summary already exists in your memory, use that as a base and expand with new facts.
Limit the summary to {{words}} words or less.
Your response should include nothing but the summary.

# Google翻訳
これまでの物語の中で最も重要な事実と出来事を要約してください。

既に記憶に要約がある場合は、それを基に新しい事実を加えて加筆してください。

要約は{{words}}語以内に収めてください。

回答には要約のみを含めてください。
  • 「Injection position」(注入位置)
要約をどの位置に挿入してLLMに渡すか、の設定です。
  • 「[Memories: {{memories}}]」(記憶: {{memories}})
要約を挿入する際のプロンプトです。

・Settings (設定)


アプリなどの設定です。
  • 「Appearance (System)」 (外観(システム設定))
ダークモードなどに変更できます。
  • 「Advanced rendering (BETA)」(高度なレンダリング(ベータ版))

  • 「Storage」 (ストレージ)
端末内でどれくらい容量を消費しているかです。
  • 「Backup and restore」 (バックアップと復元)

チャットなどのバックアップ設定です。
・「Chat settings」 (チャット設定)

  • 「Group chat」(グループチャット)
グループチャット機能の設定です。
  • 「Translation」(翻訳)
例えば英語のチャット内容を翻訳する、などの設定です。
  • 「Image captioning」(画像キャプション)

画像キャプションの設定です。
画像認識対応のLLMに画像を送信してキャラクターに反応してもらえます。
メインのAPIのほか、画像キャプションだけ違うAPIにしたりできます。
  • [Keyboard shortcuts」(キーボードショートカット)
  • 「Send on enter」(Enterで送信)
モバイルとデスクトップの両方で、Enterキーを押してメッセージを送信します。
  • 「Hide model reasoning」(モデルの思考プロセスを隠す)
(思考モデルの場合)チャットバブル内のモデルの思考プロセスを非表示にします。生成時間や結果には影響しません。
  • 「Immersive chat」(イマーシブ(没入型)チャット)
チャット中に上部のステータスバーを非表示にします。上部エリアをタップすると復元されます。
  • 「Disable gaussian blur」(ガウスぼかしを無効にする)
一部のデバイスでの発熱問題を軽減するため、アプリ全体のガウスぼかしを無効にします。
  • 「Hide system navigation bar」(システムナビゲーションバーを隠す)
より没入感のある体験のために、下部のシステムナビゲーションバーを非表示にします。
  • 「Variable manager」(変数マネージャー)
チャット内の変数を表示、編集、削除します。
  • 「JavaScript console」(JavaScriptコンソール)
JavaScriptコンソールを有効にして、実行ログやエラーを確認します。
  • 「Context logging」(コンテキストログ)
モデルに送信されたコンテキストを記録します。チャットサイドバーの下部で確認できます。
  • 「Enable EJS templates」(EJSテンプレートを有効にする)
すべてのテンプレート(プリセット、ロアブック、正規表現など)で <% %> 形式のEJS構文の使用を許可します。
  • 「Reverse lorebook evaluation」(ロアブックの評価を反転させる)
SillyTavern形式のロアブック向けに、マクロをボトムアップで評価します。レンダリング順序は変更されません。
  • 「Apply regex to hidden messages」(非表示メッセージに正規表現を適用する)
SillyTavernと同様に、すべての深度制限を無視して非表示メッセージに正規表現を適用します。

・その他、関連するWiki内のページなど

キャラクターの記述方法などを記載しています。
機能的にはTavoとほとんど同じ、PC向けLLMのRPフロントエンドのSillyTavernの解説ページです。
Wiki内掲示板のキャラクターカード配布スレッドです。

管理人/副管理人のみ編集できます

広告募集中