
product features
LLMトークン監視とリクエスト量トラッキング
リアルタイムダッシュボードでは、累積の総トークン消費量をPromptトークンとCompletionトークンの内訳で表示し、モデルとアプリケーションごとに平均入力/出力トークン数を分割して確認できます。予期しない請求が本番環境に現れる前に、開発段階で各LLM呼び出しのコストと複雑さを評価できます。使用量のしきい値を設定すれば、1件のリクエストが上限を超えた際に即座にアラートを発報します。

LLMコスト最適化と支出トレンド分析
LLM API呼び出し回数、1回あたりの平均コスト、累積支出を1つのチャートで確認できます。トレンドラインにより、プロダクトチームと財務チームはコストの推移を明確に把握でき、勘に頼らずデータに基づいた予算計画が可能になります。トラフィックの急増が予算超過につながる前に、任意のディメンションでコストやリクエスト量がしきい値に達した際に即座に通知を受け取れます。

LLMトレーシングと呼び出し履歴のプロンプト監視
Trace IDを使って、各推論リクエストの完全なメタデータ——開始・終了時刻、モデルバージョン、temperature、プロンプト長、出力サマリー——を照会できます。ワンクリックで失敗またはタイムアウトしたリクエストを絞り込み、入出力ログを使って問題を再現できます。履歴はCSVまたはJSON形式でエクスポートでき、チーム間での共有や後続の分析に活用できます。

LLMレイテンシとパフォーマンスのためのフレームグラフ根本原因分析
トレース詳細ビューでは、各サブSpanのレイテンシ分布が自動的にフレームグラフとして描画され、どの呼び出し段階に最も時間がかかっているかを一目で把握できます。P75、P90、P99の応答時間曲線により、単発の遅いリクエストと構造的なLLMパフォーマンスのボトルネックを区別できます。問題を特定したら、該当のコードや設定へ直接ジャンプし、プラットフォームを離れることなく診断・修正できます。


