コンテンツにスキップ

ゴールと非ゴール

indx が現時点で提供するもの、計画中のもの、意図的に行わないもの。

indx が約束するのは成果であり、技術ではありません。ルーティング手法、モデル、パーサーは変わり得ます。成果は変わりません。正式なリストはコアユーザー機能です。機能ごとの具体的なカタログは、例とソースリンク付きの機能一覧にあります。

これらの成果の背後にある狙いはこうです。企業内の非構造データが、文書タイプごとにパイプラインを人が組むことなく AI-ready になること。標準的なコンテンツは CPU 上で安価なまま処理されること。重いモデルは、そのコストに見合う場所でだけ動くこと。そして出力 — テキスト、メタデータ、チャンク、埋め込み — は利用者が管理するインデックスの中に、利用者のものとして残ることです。

現在のバックボーンで提供済み

Section titled “現在のバックボーンで提供済み”
  • 実行可能な計画。 コンテンツと業務制約を送信すると、完全で説明可能な計画が返ります。同じソース、制約、ポリシー、スナップショットからは常に同じ計画が再現されます。
  • 効率的な実行。 実行は宣言された品質・レイテンシ・費用・ハードウェア・データ所在の制約を守ります。実際の費用、レイテンシ、フォールバックが記録されます。満たせない制約は隠さず明示的に報告されます。
  • 汎用性を失わない特殊化。 認識された文書は専用パーサーを指名できます。汎用ラダーは常にフォールバックとして残ります。
  • 証明可能なルーティングの優位性。 計画と実際の結果を、固定データセットと重い処理のベースラインに対して比較できます。ベンチマークをご覧ください。

これらは目標要件です。バックボーンの計測済みベースラインが揃うまで待機します。作る順はロードマップにあります。

  • 計画中 CPU でのコーパス分類。 標準的な入力を GPU なしで分類・整理します。CPU のみの割合と総費用をコーパス規模で報告します。
  • 計画中 難しい企業データの読み取り。 手書き、図面、スプレッドシート、大容量ファイルそれぞれに読み取り経路を用意します。現時点では、手書きがベンチマーク唯一のルート誤りです。
  • 計画中 エージェント向けエクスポート。 処理済みコンテンツを利用者管理のインデックスへエクスポートします。埋め込み空間とクエリエンコーダーも特定されます。
  • 計画中 後回しにしたアーキテクチャ。 領域最適化、幅広いモダリティ対応、RAG エクスポート、永続化、ルーターとエグゼキューターの分離デプロイ。これらは最初の計測済みスライスの後に続きます。

これらは拒否であり、遅延ではありません。

  • indx はインデックスを所有しません。 ブロックとベクトルは、利用者が管理するインデックスのために生成されます。
  • 計画段階では重い処理を実行しません。 計画ができる前に OCR もモデルもレンダリングもネットワークも使いません。
  • 実行段階で無断の再計画をしません。 使えるのは計画が既に指定したルートとフォールバックだけです。計画後に変化したソースは 409 で拒否されます。
  • フックフレームワークは作りません。 拡張はキーによる発見と再現可能なスナップショットであり、順序付きプラグイン呼び出しではありません。

誤解しやすい点を 1 つ。手動レビュー(manual review)は言い訳ではなく機能です。ラダーが人で終わるからこそ、ページが黙って消えません。理由は FAQ で説明しています。