DigitalBase Docs

AIエージェント

AI と対話する基本画面です。モデルの選択、生成パラメータの調整、ツール呼び出し、ナレッジ(RAG)の利用、API からの呼び出しまでを扱います。

モデルを選ぶ

画面上部の モデル選択 から利用する LLM を選びます。

  • Installed Models — すぐ使えるモデル。
  • Not Installed(推奨) — 未ダウンロードのモデル。選択するには Ollama 版で ollama pull <モデル名> が必要です(選択不可表示)。
  • ビジョン対応モデル(llava / gemma3 / qwen3-vl など)を選ぶと、画像をそのまま渡して解析できます(高精度画像処理)。添付の読み取り方式は画像・添付ファイルの扱い方を参照してください。

埋め込みモデルは対話用モデルとは別枠で、RAG や添付処理に使われます。

生成パラメータ

上部の Parameters(歯車) から調整します。変更は即時反映され、ポップオーバーを閉じる必要はありません。Reset で既定値に戻ります。

パラメータ範囲既定説明
Temperature0〜10.7出力のランダム性。0 に近いほど確定的、高いほど多様。
Top P0〜10.9核サンプリング。確率上位 P の語のみから選ぶ。
Top K1〜10040上位 K 個の候補のみを考慮。
Repeat Penalty1.0〜2.01.1繰り返しの抑制。1.0 でペナルティなし。
Max Tokens(出力)32〜3276881921 回の生成で出力する最大トークン数。
History Limit0〜2010文脈に含める過去メッセージ数(2 で 1 往復)。
ThinkingNone / Normal / ThinkingNormal思考過程の表示。下記参照。
補足

Temperature は実用域 0〜1 で調整してください。コンテキスト長(入力に使える最大量)は管理者がサーバ側(LLM_CONTEXT_LENGTH)で設定します。

思考(reasoning)の表示

Thinking 対応モデル(deepseek-r1 / qwq / gpt-oss など)では、回答前の思考過程を折りたたみ表示できます。Thinking を有効にすると、難しい質問でモデルがより深く推論します。思考の深さは内部で reasoning_effort として Ollama / vLLM / クラウドの各バックエンドに統一的に渡されます。思考に対応しないモデルでは無視されます。

ツール呼び出し

上部の Tools(レンチ) から、モデルが使えるツールを有効化します。対応モデルでのみ表示されます。

ツール内容
データセットパイプラインで作成したデータセットを参照
フォルダ(マイファイル / 共有)ファイルを参照。サブフォルダ単位で範囲を絞れる
接続フォルダSFTP / S3 / Google Drive などの接続や外部ディレクトリを参照
RAG(社内文書)ナレッジを検索。Bot 側でツール公開を有効にしたものが対象
ワークフロー登録済みワークフローを名前で実行。ワークフロー一覧で「Tools 公開」を有効にしたものが対象
高度データ分析pandas / numpy / scipy / scikit-learn による集計・分析(可視化はダッシュボード側)
API 接続登録済みの API コネクタを呼び出す
補足

ツールの利用可否はモデル(サーバ)側の対応に従います。RAG は Bot の編集画面、ワークフローはワークフロー一覧で「Tools 公開」を有効にしたものだけが候補になります。

組み込みツールの一覧

ツールを有効化すると、モデルは下記の組み込みツールを必要に応じて呼び出します(参照できる範囲は、上で選んだスコープに従います)。ツール実行の承認画面には、ここでのツール名がそのまま表示されます。

分類ツール内容
ファイルlist_files / read_file / write_file / edit_file / search_files / glob / describe_file一覧・読み取り(Office・PDF は自動抽出、画像はビジョン)・作成・編集・検索
データlist_datasets / describe_dataset / query_datasetデータセットの探索・スキーマ確認・読み取り専用 SQL(SELECT のみ)
ナレッジlist_rag_collections / vector_searchRAG ナレッジの一覧・意味検索
接続list_my_connections / list_api_connections / call_api_operatorSFTP / S3 / OAuth 接続や外部 API コネクタの一覧・呼び出し
ワークフローrun_workflow / get_workflow_runスコープ内のワークフローを名前で起動(「〇〇を実行して」)・実行状況と結果の確認。実行は承認モードの対象
実行execute_python / bashサンドボックスでの Python(pandas / numpy / scipy / sklearn)・シェル実行

これらの組み込みツールは、チャット・MCPパイプラインから共通で利用されます。

画像・添付ファイルの扱い方

文書・画像をどう読み取るかは、Vision設定 の「文書の読み取り方式」で選びます(チャット添付・RAG 取り込みで共通の設定です)。

方式処理適した用途
ファイル処理OCR とテキスト層の抽出のみ(AI の画像解析は使わない)テキスト中心の文書。最も高速
ベクトル処理AI(Vision モデル)がページを読み取ってテキスト化し、検索対象にするスキャン文書・大きな文書を検索可能にしたいとき
高精度画像処理ページ・画像をそのままチャットのモデルに渡す(最高精度)図面・スクリーンショットの精読。チャット専用
  • ファイル処理 / ベクトル処理では、添付はテキストに変換して回答に反映しつつ、その会話専用の一時的なナレッジとしても保存されます(その会話が続く間だけ検索対象になり、会話が終わると消えます)。
  • 高精度画像処理はビジョン対応のチャットモデルが必要です。大きな文書はモデルのコンテキスト上限を超えることがあり、その場合はエラーが表示されます(自動で他の方式には切り替わりません)。
  • RAG管理での取り込みは検索用の索引化が前提のため、ファイル処理 / ベクトル処理から選びます(高精度画像処理は選べません)。

ナレッジ(RAG)をチャットで使う

RAGナレッジ からナレッジ(Bot)を選ぶと、その文書を根拠に回答します(複数選択可)。回答には参照元が示されます。

RAG設定 で検索の挙動を、Vision設定 で文書・画像の読み取りを調整できます。

パラメータ範囲既定説明
Top K1〜105取得するチャンク数
Min Similarity0.1〜0.9採用する最小類似度のしきい値
Embedding Model埋め込みモデル一覧Bot 由来検索とベクトル化に使うモデル(取り込み時と同一が必要)
読み取り方式ファイル処理 / ベクトル処理 / 高精度画像処理文書・画像の読み取り方法(画像・添付ファイルの扱い方参照)
解析モデル (VLM)Vision 対応モデル一覧書き起こしに使う Vision 対応モデル(ファイル処理では未使用)
Vision プロンプト自由入力用途別の既定画像解析の指示文
タイル分割1〜41(分割なし)大判の図面などを格子分割して高精度に読み取る(下記参照)
補足

チャンクサイズ・重複は、文書を取り込むときに決まります。チャット側からは変更できません(既存ナレッジには影響しません)。

タイル分割(高精度モード)

大きな図面や文字の細かい資料は、画像全体を 1 枚で解析すると縮小されて小さな寸法・文字が潰れることがあります。タイル分割を 2〜4 に設定すると、全体画像に加えて画像を格子状(2×2〜4×4)に分割した高解像度タイルを同時にモデルへ渡し、全体の文脈を保ったまま細部を読み取ります。

  • 効く場面:A1/A0 級の図面・寸法や注記の多い技術資料・小さな文字の帳票
  • 適用範囲:チャットの画像添付、RAG 取り込み時の解析、パイプラインの画像処理(画像 AI 入力 / 画像説明)、AI エージェントのファイル読み取り
  • 画像が小さい場合(短辺 1000px 未満)は分割の効果がないため、自動的に分割なしで処理します
補足

分割数を上げるほどモデルに渡す画像枚数が増え、処理時間と GPU 負荷が増加します。通常の資料は 1(分割なし)のまま、細部の読み取りが必要な大判資料でのみ 2〜4 を使うことを推奨します。

API から使う

DigitalBase は OpenAI 互換の /v1/chat/completions を提供します。チャット画面と同じ機能(クラウド振り分け・画像・OCR・ツール・RAG・思考)を API から利用できます。

curl http://localhost:8000/v1/chat/completions \
  -H "Authorization: Bearer sk-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<モデル名 または asst_<アシスタントID>>",
    "messages": [
      {"role": "system", "content": "あなたは社内アシスタントです"},
      {"role": "user", "content": "こんにちは"}
    ],
    "temperature": 0.7,
    "stream": true
  }'
  • messagessystem ロールがシステムプロンプトになります。
  • modelアシスタント IDasst_...)を指定すると、そのアシスタントの設定(モデル・温度・ツール・RAG など)が全て適用され、呼び出し側は messages だけ送れば動きます。
  • RAG の参照元は応答の x_digitalbase.sources に含まれます。

認証には API キー(sk-)を使います。発行方法・IP 制限・利用上限はAPIアクセスキーを、エンドポイント詳細はOpenAI 互換 APIを参照してください。