LLMプロバイダー
AI NowとエージェントワークフローでサポートされるリモートLLMプロバイダー、モデルのガイダンス、既知の注意点
セットアップは3つの層で選択します。
- プランまたはサブスクリプション: すでに支払っているアカウントまたはバンドル
- プロバイダーまたはエンドポイント: リクエストの実際の送信先
- モデル: 日常的に使用する、ツール対応の具体的なデフォルト
その後、設定(またはnmem CLI/TUI)で一度構成します。
モデル呼び出しを自分のマシンに留めたいですか?
LM StudioとOllamaのセットアップ、目的別ルーティング、検証、プライバシー境界については、Use Nowledge Mem with fully local modelsに従ってください。
Nowledge Memは、現在最もスムーズな日常体験のためにサブスクリプションベースのデフォルトを推奨しています。
- OpenAI ChatGPT/Codexサブスクリプション
- Kimi Codeサブスクリプション
- SuperGrokサブスクリプション
コストを意識したデフォルトの推奨
日常的なAI Nowの使用では、デフォルトでSOTAよりも高速なツール対応モデルを優先してください。
ChatGPT/Codexの場合、設定で現在のモデルリストを取得し、サポートされているCodexまたはベースGPT-5モデルを選択してください。
Kimi Coding Planのモデルも日常のデフォルトとして適しています。
現在のセットアップでトークンを消費しすぎている場合(たとえば常にgpt-5.3-codexを実行している場合)、まずより軽量なツール対応のデフォルトに切り替えてください。
会話のスクリーニング、メモリチェック、Deep Searchを処理するオプションの意思決定モデルについては、Fast decisionsを参照してください。 これはチャットモデルとは別に構成されます。
何を選ぶか
ChatGPT/Codexサブスクリプション
強力なツール使用サポートを備えた、コーディング中心のAI Nowワークフローに最適なデフォルトです。
Kimi Codeサブスクリプション
AI Nowでのコーディングワークフローとツール呼び出しに最適です。
SuperGrokサブスクリプション
APIキーを貼り付けることなく、xAIサインインを通じてGrokサブスクリプションを使用できます。
プロバイダーガイド
- AI Nowとエージェントでの安定したツール呼び出し
- 強力なエコシステム互換性
- ChatGPTサブスクリプションの場合、CodexモデルまたはベースGPT-5リリースを選択してください。ここでは
gpt-5-chat-latestのようなチャットエイリアスは避けてください。
- コーディング中心のAI Nowセッションに最適
- 日常使用での信頼性の高いツールワークフロー
- 強力な計画立案とツール使用の品質
- 長いマルチステップセッションに適しています
- AI Nowとエージェントには
deepseek-v4-flashから始めてください - 速度よりも品質が重要な場合は
deepseek-v4-proを使用してください
- 柔軟なマルチモデルルーティング
- AI Now / エージェントワークフローにはツール対応モデルを選択してください
- AI Nowとエージェントフローでサポートされています
- Google AI Studioの認証情報とスムーズに連携します
- AI Nowでのツールワークフローでサポートされています
- xAI APIキーをお持ちの場合はこのパスを使用してください
- Grokサブスクリプションでサインインしたい場合は、代わりにSuperGrokを使用してください
- 設定からxAIでサインインします。APIキーの貼り付けは不要です
- ローカルOAuthトークンが保存されると、AI Nowとエージェントワークフローで動作します
- APIキーによる課金を希望する場合は、引き続きxAIプロバイダーを使用してください
- AI Nowと拡張ワークフローでサポートされています
- 現在のMiniMaxチャットモデルで動作します
- AI Nowとエージェントでサポートされています
- 既存の利用に適した地域/プロバイダーのフィット感
- モデルランタイムにクラウド依存がありません
- AI Nowエージェントにはツール対応モデルを使用してください
- デフォルトのローカルURL:
http://127.0.0.1:1234/v1 - 認証を有効にしない限り、APIキーはオプションです
- リモートモードでは、LM StudioはNowledge Memサーバーマシン上で実行する必要があります
- 汎用カスタムエンドポイントではなく、Lemonadeプロバイダーを使用してください
- デフォルトのローカルURL:
http://127.0.0.1:13305/v1 - カスタムMCPサーバーとして追加すると、AI NowはLemonadeのHTTP MCPエンドポイントも使用できます
- AI Nowでサポートされています
- チームがすでにCopilotを使用している場合、導入の負担が少なくなります
- OpenAI互換のチャット補完が必要です
- ツールサポートはゲートウェイ/モデルによって異なります
DeepSeekモデルのヒント
AI Nowとエージェントタスクで最速のDeepSeekセットアップにはdeepseek-v4-flashを使用してください。より強力なV4モデルが必要な場合はdeepseek-v4-proを選択してください。deepseek-chatはまだ動作しますが、deepseek-reasonerはツール呼び出しをサポートしていないため、エージェントワークフローには提供されていません。
コンテキストウィンドウ
すべてのモデルには、1回のリクエストで処理できるトークンの最大数があります。
Nowledge Memはモデル名からこの制限を自動検出します。
たとえば、gpt-4oはデフォルトで128kトークン、gemini-2.0-flashは1Mです。
コンテキストウィンドウは設定 → プロバイダー → 詳細(またはnmem config provider set --context-window <tokens>経由)で上書きできます。
調整すべきタイミング:
- 小規模またはファインチューニングされたモデル(8k~32kコンテキスト): 実際の制限を設定して、AI Nowがオーバーフローする前に会話を圧縮できるようにします。
- 拡張コンテキストモデル(500k~1M以上): ウィンドウを増やして、AI Nowが早期に圧縮せずに全容量を使用できるようにします。
- カスタムまたはセルフホストモデル: モデル名が既知のパターンに一致しない場合、デフォルトは128kです。 正確な圧縮動作を得るには実際の値を設定してください。
圧縮中に何が起こるか
会話がコンテキスト制限に近づくと、AI Nowは自動的に古いメッセージを要約し、最新のやり取りを保持します。 これにより、重要なコンテキストを失うことなく長いセッションを続行できます。 適切なコンテキストウィンドウを設定することで、圧縮が早すぎず遅すぎず、適切なタイミングで実行されます。
カスタムプロバイダーのガイダンス
DeepSeek V4用にカスタムOpenAI互換エンドポイント(openai_compatible)を構成する場合は、deepseek-v4-flash、deepseek-v4-pro、またはゲートウェイが公開する正確なDeepSeek V4モデルIDを使用してください。
DeepSeek V4はプロバイダー固有の思考モードを使用します。
Memはツールループのエージェント呼び出し中にそのモードを無効にして、ツール履歴が厳格なDeepSeek検証と互換性を保つようにします。
OpenRouter経由でDeepSeek V4を実行する場合は、引き続きOpenRouterプロバイダーを使用してください。
MemはOpenRouterでホストされるモデルを、DeepSeekネイティブのthinkingフィールドを追加するのではなく、OpenRouter独自のリクエスト契約のままにします。
カスタムエンドポイントは、従来のChat Completions形式に加えて、新しいResponses API(/v1/responses)もサポートしています。
プロバイダーを追加または編集するときにAPI形式を選択してください。
Linuxヘッドレスデプロイメントのセットアップについては、Linux Server Deploymentを参照してください。
