5月12日12:00(GMT+2)より、サブスク(Pro)代が月8ドルから月12ドルになります。(4ドルの値上げ)


今回はGoogleアカウントでログインします。

アカウント連携、ログイン後にサイト左の「Subscription」からサブスクへ加入します。

「JCB」、「VISA」、「Mastercard」などのクレカが使えます。

サブスク加入後、アカウント設定からいろいろ変更して行きます。
Web上だけの設定かもしれませんが、「Conversation」の「Mature content」を有効にしておきます。

「Subscription」セクションの「Also show paid models」(有料モデルも表示)と、「Enable paid models on API」(APIで有料モデルを有効にする)をOFFにします。※サブスクの範囲で使用する場合のみ

https://nano-gpt.com/api
上記のURLにアクセスしてAPIキーを作成します。

「API」を「チャット完了」に、「チャット補完ソース」を「NanoGPT」、「NanoGPT API Key」に先ほど作成したAPIキーを貼り付けて完了です。
SillyTavern自体の使い方などはSillyTavernの使い方などページをご覧ください。


Common Settings(AI応答の構成) / チャット完了のプリセットから、サンプリング設定や「クイックプロンプトの編集」の「メイン」に脱獄文などを記述出来ます。
推奨サンプリング設定はtemperature=1.0, top_p=1.0,DeepSeek API Docsによれば、一般的な会話でtemperature=1.3、クリエイティブな用途では1.5が推奨されているらしいが思考版ではtemperatureのパラ設定自体が意味ないという話も,DeepSeekシリーズの特徴として思考モードでロールプレイチャットをすると思考内でキャラになりきって思考するのが面白い,中華モデルにありがちな変な日本語感も無いしNSFWなシーンでも直結気味にならない,ただ短文癖がちょっと気になるか(redditあたりでのプリセット配布待ちかな),軽く試した範囲ではDeepSeek-V4-"Flash"が優秀なのかそんなに差を感じない?→"Flash"は思考させてもちょっとおバカな感じ,
NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりDeepSeek-V4-Proだけ使うなら週あたり3000万トークンまで)
NanoGPTはOpenRouterのようなLLMルーターサービスです。
DeepSeekやGLM4.7といった各種オープンウェイトモデルのほか、Sonnet、Opus、ChatGPT、Geminiなどのクローズドモデルも提供されています。
公式WebサイトからSillyTavernのキャラクターカードを読み込ませてチャットする事もできるほか、OpenAI互換APIも提供されているのでOpenWebUIやSillyTavernと接続して利用する事もできます。
上記のURLから登録するとクローズドモデルを利用するために課金する際、料金が5%OFFされます。
※サブスク代は割引対象外なのでご注意ください。
DeepSeekやGLM4.7といった各種オープンウェイトモデルのほか、Sonnet、Opus、ChatGPT、Geminiなどのクローズドモデルも提供されています。
公式WebサイトからSillyTavernのキャラクターカードを読み込ませてチャットする事もできるほか、OpenAI互換APIも提供されているのでOpenWebUIやSillyTavernと接続して利用する事もできます。
- 割引コード
上記のURLから登録するとクローズドモデルを利用するために課金する際、料金が5%OFFされます。
※サブスク代は割引対象外なのでご注意ください。
- NanoGPTとは
- 料金体系
- 登録、支払い方法やアカウント設定など
- SillyTavernとの接続方法
- OpenWebUIとの接続方法
- 割引コード
- NanoGPT ドキュメント
- NanoGPTのサブスクで利用できるモデルの中で実際にSillyTavernで動かしてみてオススメのモデル
- zai-org/GLM-5 (MoE / 744BA40B, 通常版とthinking版) ★★★☆☆
- zai-org/GLM-5.1 (MoE / 744BA40B, 通常版とthinking版) ← オススメ ★★★★☆ ※入力トークンが2倍なのに注意!
- New zai-org/GLM-5.2 (MoE / 744BA40B, 通常版とthinking版) ← オススメ ★★★★☆ ※入力トークンが2倍なのに注意!
- qwen/Qwen3.5-397B-A17B (MoE / 397BA17B, 通常版とthinking版) ★★☆☆☆
- mistralai/Mistral-Large-3-675B-Instruct-2512 (MoE / 675BA41B) ★★★☆☆
- moonshotai/Kimi-K2.5 (MoE / 1TA32B, 通常版とthinking版) ← オススメ ★★★★☆
- moonshotai/Kimi-K2.6 (MoE / 1TA32B, 通常版とthinking版) ← オススメ ★★★★☆
※入力トークンが2倍なのに注意! - New moonshotai/Kimi-K2.7 Code (MoE / 1TA32B thinking) ← オススメ ★★★★☆ ※入力トークンが2倍なのに注意!
- deepseek-ai/DeepSeek-V4-Pro (MoE / 1.6TA49B, 通常版とthinking版) ★★★★☆ ※入力トークンが2倍なのに注意!
- nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B (MoE / 550BA55B, 通常版とthinking版) ★★★☆☆
従量課金制を基本としつつ、月8ドル 月12ドルのサブスク(Pro)に加入することでオープンウェイトモデルが従量課金の対象から外れ、オープンウェイトモデルに限り一日あたり2,000リクエスト(1分あたり60リクエスト)まで追加料金無しで利用できます。
サブスクに加入してオープンウェイトモデルを利用する場合はトークンの量に関係なくリクエスト単位なので、一度に大量のトークンを入力しても1リクエストとして扱われます。 一週間あたり最大6000万の入力トークン制限がかかるようになりました。
※GLM-5.1、Kimi-K2.6、DeepSeek-V4-Proは推論コストが高いため、入力トークンが2倍として計算、消費されます。つまりGLM-5.1、Kimi-K2.6、DeepSeek-V4-Proだけ使うなら週あたり3000万トークンまでとなります。
5月12日12:00(GMT+2)より、サブスク(Pro)代が月8ドルから月12ドルになります。(4ドルの値上げ)
サブスク対象のオープンウェイトモデルに関しては下記のURLのモデル一覧で「Subscription」が「yes」になっているモデルが対象です。
https://nano-gpt.com/pricing
そのほかサブスクに加入している場合、特典としてSonnet、Opus、ChatGPT、Geminiなどのクローズドモデルを利用する場合に料金が5%OFFされます。
サブスクに加入してオープンウェイトモデルを利用する場合は
※GLM-5.1、
5月12日12:00(GMT+2)より、サブスク(Pro)代が月8ドルから月12ドルになります。(4ドルの値上げ)
サブスク対象のオープンウェイトモデルに関しては下記のURLのモデル一覧で「Subscription」が「yes」になっているモデルが対象です。
https://nano-gpt.com/pricing
そのほかサブスクに加入している場合、特典としてSonnet、Opus、ChatGPT、Geminiなどのクローズドモデルを利用する場合に料金が5%OFFされます。


今回はGoogleアカウントでログインします。

アカウント連携、ログイン後にサイト左の「Subscription」からサブスクへ加入します。

「JCB」、「VISA」、「Mastercard」などのクレカが使えます。

サブスク加入後、アカウント設定からいろいろ変更して行きます。
Web上だけの設定かもしれませんが、「Conversation」の「Mature content」を有効にしておきます。

「Subscription」セクションの「Also show paid models」(有料モデルも表示)と、「Enable paid models on API」(APIで有料モデルを有効にする)をOFFにします。※サブスクの範囲で使用する場合のみ

https://nano-gpt.com/api
上記のURLにアクセスしてAPIキーを作成します。

「API」を「チャット完了」に、「チャット補完ソース」を「NanoGPT」、「NanoGPT API Key」に先ほど作成したAPIキーを貼り付けて完了です。
SillyTavern自体の使い方などはSillyTavernの使い方などページをご覧ください。


Common Settings(AI応答の構成) / チャット完了のプリセットから、サンプリング設定や「クイックプロンプトの編集」の「メイン」に脱獄文などを記述出来ます。
脱獄文の例 (※文章生成AIでオナニー プロンプトまとめwikiや、AIツールでオナニーまとめwikiの脱獄プロンプトをお借りして一部改変しています。
https://nano-gpt.com/api
上記のURLにアクセスしてAPIキーを作成します。


[Ctrl] + [.]で設定画面から「管理者設定」を開き、「接続」セクションから「OpenAI API接続の管理」のプラスボタンをクリックして、APIベースURLを下記の通りに入力します。
OpenWebUI自体の使い方などはOllama & Open WebUIの使い方などページをご覧ください。
上記のURLにアクセスしてAPIキーを作成します。


[Ctrl] + [.]で設定画面から「管理者設定」を開き、「接続」セクションから「OpenAI API接続の管理」のプラスボタンをクリックして、APIベースURLを下記の通りに入力します。
# 通常 https://nano-gpt.com/api/v1 # サブスク対象のモデルのみ https://nano-gpt.com/api/subscription/v1あとはAPIキーを貼り付けて保存すれば完了です。
OpenWebUI自体の使い方などはOllama & Open WebUIの使い方などページをご覧ください。
https://nano-gpt.com/invite/6bXtnAME
上記のURLから登録するとクローズドモデルを利用するために課金する際、料金が5%OFFされます。
※サブスク代は割引対象外なのでご注意ください。
上記のURLから登録するとクローズドモデルを利用するために課金する際、料金が5%OFFされます。
※サブスク代は割引対象外なのでご注意ください。
GLM-4.7よりロールプレイ性能上がっている,Kimi-K2.5より出力が早いものの、総合的にKimi-K2.5に少し劣る感じ(地の文が弱い)ただ、Kimi-K2.5がすぐにNSFWなシーン、描写に持っていこうとするのに対してGLM-5はそうでないのでそういう意味では優れいている(RPだけするならKimi-K2.5より良いかも),プロンプトで改善するかも?,Context長200K、デフォルトの推奨サンプリング設定はtemperature=1.0, top_p=.95,だがtemperatureは0.75前後程度まで下げても良いかと,RPチャット向き
GLM系らしく、Kimi-K2.*系みたいにすぐにNSFWなシーン、描写に持っていこうとせずロールプレイとして良い感じ,思考版もKimi-K2.6みたいに長々と思考しないのでチャット向きかと,推奨サンプリング設定はtemperature=1.0, top_p=.95,だがtemperatureは0.75前後程度まで下げても良いかと,NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりGLM-5.1だけ使うなら週あたり3000万トークンまで)
推奨サンプリング設定のtemperature=1.0, top_p=.95で試してみたがたまに漢字が中国語混じりになるためtemperature=0.80ぐらいに下げてシスプロに「日本語で〜」と追加したら改善した,GLM系らしくすぐにNSFWなシーン、描写に持っていこうとせず思考も長々としないというロールプレイチャットとして良い感じなGLM系の特徴も受け継いでいる,ただ、状況理解力が若干、Kimi-K2.*やDeepSeekに劣るか,
※NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりGLM-5.2だけ使うなら週あたり3000万トークンまで)
※NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりGLM-5.2だけ使うなら週あたり3000万トークンまで)
通常版と思考版が提供されている,他のモデルと比べると地の文が強く、RPチャットより小説向きかも?,ただ、直結気味(プロンプトで改善するかも? →改善した),推奨サンプリング設定などはこちらを参考に → 思考版の方だが temperature=0.7 top_p=0.95 tok_k=20 min_p=0 repeat penalty=1.0 ぐらいで良いかも,GLM-5より好みかな,LLMプロバイダの問題か、思考版を使ってるのに正常に思考しない事が何回かあったのと、正常に思考しても思考が長いので注意
Context長は256K、推奨サンプリング設定は通常版でtemperature=0.6, top_p=0.95, thinking版でtemperature=1.0, top_p=.95,軽く試した範囲では通常版はあっさり目の出力だがthinking版は良い感じ,出たばかりだからか、重い(出力まで時間がかかる),時折、英単語が少し混じることもある,ストーリーをすぐに進めようとする癖がある感じも,thinking版のtemperatureは0.75程度でも良いかも?
推奨サンプリング設定は通常版でtemperature=0.6, top_p=0.95, thinking版でtemperature=1.0, top_p=1.0,だがthinking版ではtemperature=0.7, top_p=0.95ぐらいにした方が良い(?),思考版は長々と思考する癖がある,システムプロンプトを工夫しないとすぐにNSFWな描写に行きがちだが濡れ場の描写ではGLM系に勝る感じ,個人的にはGLM 5.1より好み,NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりKimi-K2.6だけ使うなら週あたり3000万トークンまで) ※2026/05/09時点でKimi-K2.6は入力トークン2倍が撤廃されました。
サンプリング設定はthinking版でtemperature=1.0, top_p=1.0,K2.6の長々と思考するのを抑制したらしい,軽い脱獄文でNSFWなRPいける,K2.6より良いかも?,NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりKimi-K2.7だけ使うなら週あたり3000万トークンまで)
NanoGPTのサブスク対象モデルだが推論コストが高価なため入力トークンが2倍として設定、消費される(入力トークンが5000トークンでも10000入力トークンとして計算されて週あたりの6000万トークン制限に計上される,つまりDeepSeek-V4-Proだけ使うなら週あたり3000万トークンまで)
推奨サンプリング設定はtemperature=1.0, top_p=0.95,自然な日本語で良い感じ,軽い脱獄文でNSFWなRPいけた(獣○はダメだった😢),思考版も長々と思考せずにすぐ本文を出してくれる,体感、RPチャットだけなら「Mistral-Large-3-675B-Instruct-2512」よりは上で理解力で「DeepSeek-V4-Pro」や「Kimi-K2.5」、「Kimi-K2.6」に劣る感じ,ちなみに「弓なりに〜」や「ひぎぃ〜」などの単語が出るのでシステムプロンプトでNGワードの設定をした方が良いかも,

