チャットタブ
チャットを行う

チャットタブを開くと、このような画面が表示されます。チャットを行うには、まずはチャットに使用したいモデルを選択する必要があります。

モデルを選択するには、右上のモデル切り替えボタンをクリックまたはタップすると、選択状態になっているOllamaサーバー上にあるモデルが一覧で表示されるので、使用したいモデルを選択します(サーバーの選択状態を切り替えるには、サーバータブのドキュメントをご覧ください)。

モデルが選択されるとメッセージが入力できるようになりますので、AIモデルに送信したいテキストを入力し、送信ボタンをクリックまたはタップします。
macOSでメッセージを改行したい場合は、⇧ (Shift) + ↩︎ (Return)キーを同時に押します。
また、メッセージ入力欄の添付ボタンをクリックまたはタップするか、ファイルをドラッグ&ドロップすることで、以下のファイルをメッセージに添付して送信することができます。
- 画像ファイル
- 画像認識に対応したモデルで画像を認識させることができます。
- テキストファイル
.txt や .md などのテキストファイルを、チャット対応の全モデルに添付できます。
- PDFファイル
- PDFファイルをチャット対応の全モデルに添付できます。さらに、画像認識に対応したモデルでは各ページが画像としても送信され、テキストだけでなく図表やレイアウトも認識させることができます。

メッセージを送信すると、Ollamaサーバー上にチャット要求が送信され、必要に応じてモデルの読み込み作業が始まります。
モデルの種類や、Ollamaサーバー上のモデルが保存されているストレージの種類によっては読み込みに時間がかかる場合があります。
豆知識
デフォルトでAPIタイムアウトは5分に設定されているため、モデルの読み込みに時間がかかる場合はタイムアウトエラーが発生する場合があります。
モデルの読み込みに時間がかかることがわかっている場合は、設定からAPIタイムアウトまでの時間を長くするか、無制限に設定することをおすすめします。
APIタイムアウトまでの時間を設定する方法については、設定のドキュメントをご覧ください。

しばらくすると、AIから回答が返ってきます。
応答が最後まで終了すると、メッセージに対して操作を行うことができます。可能な操作は以下の通りです。
- 自分のメッセージ
- コピー
- メッセージをMarkdown形式のテキストとしてコピーすることができます。
- 編集
- 送信したメッセージを編集して送信し直すことができます。最後に送信したメッセージのみ編集可能です。
- AIからのメッセージ
- 前のリビジョンに切り替える
- やり直す前のリビジョンに切り替えることができます。リビジョンが2つ以上ある場合に表示されます。
- 次のリビジョンに切り替える
- 前のリビジョンから次のリビジョンに切り替えることができます。リビジョンが2つ以上ある場合に表示されます。
- やり直す
- AIからの回答をやり直すことができます。最後のメッセージのみやり直し可能です。
- コピー
- メッセージをMarkdown形式のテキストとしてコピーすることができます。
- 共有
新規チャットを始める
チャットの履歴を消去して新規チャットを始めるには、右上にある新規チャットボタンをクリックするか、⌥ (Option) + ⌘ (Command) + Nキーを同時に押します。
チャットの設定を変更する

インスペクタを開くことで、チャットの設定をカスタマイズすることができます。
インスペクタを開くには、右上のサイドバー切り替えボタンをクリックまたはタップします。
インスペクタからは、次の設定をカスタマイズすることができます。
- チャット設定
- ストリームレスポンス
- AIからのメッセージを連続的に受信するかどうかを切り替えます。オフにする場合、最終回答が返ってくるまで応答が来なくなるため、APIタイムアウトを無制限にすることをおすすめします。APIタイムアウトまでの時間を設定する方法については、設定のドキュメントをご覧ください。
- キープアライブ
- モデルをサーバーのメモリ上に保持する時間を選択します。
- 思考
- 思考に対応したモデルを使う場合に、思考レベル(「デフォルト」、「オフ」、「低」、「中」、「高」、「最高」)を指定します。「モデルの機能」で「思考」に対応したモデルのみ設定可能です。モデルの機能を確認するには、モデルタブのドキュメントをご覧ください。
- システムプロンプト
- AIモデルに対してシステムプロンプトを設定することができます。
- カスタム設定
- カスタム設定を有効にする
- 以下の設定を使うためにカスタム設定を有効化するかどうかを切り替えます。
- シード値
- 再現性のある生成を行うためにシード値を指定することができます。
- 温度
- モデルの温度を指定します。
0.0〜2.0の間で設定することができ、温度を下げるとより正確に、温度を上げるとより創造的になります(すべてのモデルがこの設定に従うとは限りませんし、設定によって正しく出力されなくなる場合もあります)。
- コンテキストウィンドウ
- モデルが一度に読み込めるトークン数を指定します。
512〜モデルのコンテキスト長の間で設定することができます。モデルのコンテキスト長を確認するには、モデルタブのドキュメントをご覧ください。
- 繰り返し参照範囲
- モデルの繰り返し出力を防止するために遡るトークン数を指定します。
- 繰り返しペナルティ
- Top-k
- 無意味な文章を生成する確率を低減します。100のような大きな値では多様な回答が得られ、10のような低い値では安定的な回答を得ることができます。
- Top-p
- Top-kと連動し、0.95のような高い値では多様な文章が生成され、0.5のように低い値では焦点を絞った安定的な文章が生成されます。
- Min-p
- Top-pの代替手段であり、品質と多様性のバランスを確保することを目的としています。最も可能性の高いトークンと比較して、相対的な確率が閾値(P)を下回るトークンを除外することで、低品質な回答を抑制します。
ここで設定した内容は、次回送信したメッセージ以降に反映されます。