JevをAIエージェントで使うには:判断、実行、検証を分ける
Jevはエージェントそのものではありません。状態を受け取り、あらかじめ定義した選択肢や尺度に対して判断を返すモデルです。このガイドでは、Jevをどこに置き、判断結果をどう検証してから行動につなげるかを、公開資料と事例に沿って説明します。
先に要点:Jevには小さな判断を任せる
ツールの選択、次に読む情報の優先順位、作業完了の確認など、答えの形を先に決められる場面が対象です。文章やコードの生成、ブラウザ操作、実行権限の付与は別のモデルやアプリケーション側が担当します。確信度が低い場合の保留先も、コードで用意しておきます。
Jevが返すものと、返さないもの
Choiceは候補から一つを選びます。たとえば、問い合わせをbilling、technical、reviewのどこへ送るかを選ぶ用途です。候補を定義するのは開発者です。
Scoreは定めた尺度上で評価します。Noulは真偽に関する確率を返します。どちらも入力と基準が曖昧なら、型が整っていても判断が正しいとは限りません。
Jevは現在、文字列やテキストを含むJSONを扱うモデルです。画像や音声、PDFの視覚的な読取り、自由文やコードの生成には使いません。
エージェントに組み込む四つの段階
1. 状態を用意する
ユーザーの目的、現在のページや作業結果、選択可能な行動を必要な範囲でまとめます。秘密情報や不要な履歴を判断入力へ無条件に入れないようにします。
2. 答えの範囲を決める
Choice、Score、Noulのうち、実際の分岐に必要な形を選びます。候補名と判断基準を明示し、例外や保留の選択肢も用意します。
3. 結果をアプリ側で評価する
返された値と確信度を記録し、固定ルール、権限、しきい値を確認します。不確かな判断は人や別の検証手順へ送ります。
4. 許可された処理だけ実行する
エージェントまたはツールが実行します。Jevの回答をそのままコマンド実行や外部送信の許可にしません。結果も保存して次の評価につなげます。
例:ブラウザエージェントの次の操作を選ぶ
ページ上の操作可能な要素が既に取得できているとします。Jevには画面全体を『見て何かする』よう頼まず、現在の目的と候補の操作を渡します。
- 状態:目的は注文状況の確認。ページには「注文履歴を開く」「住所を変更」「購入を確定」の操作がある。
- 質問:次に進むための操作を候補から一つ選ぶ。危険な操作を避けるため「保留して確認」も候補に入れる。
- 実行前:アプリ側がログイン状態と操作権限を確認する。購入確定や個人情報の変更は、判断結果にかかわらず追加確認を求める。
これは設計例であり、当サイトがこの手順を実運用で測定した結果ではありません。実装では候補の取得方法、失敗時の復帰、ログの保護も検討してください。
公開事例から見る実装の境界
次のページは元の資料へのリンクを持つ英語のケース紹介です。作者が述べた動作と、当サイトが独立に実測した結果を混同しないように読んでください。
jev-browser ↗
ページ上の候補操作から次の行動を選ぶブラウザ利用例。
RouteKit ↗
問い合わせの難度に応じてモデル経路を選ぶ例。
最初の小さな検証
- まずTypeSafeのPlaygroundで一つの判断を試し、同じ入力に対して候補と回答が意図どおりか確認します。
- 自分のアプリにつなぐ場合はAPIキーをサーバー側で管理し、公式Quick StartにあるAPIまたはSDKの形式を使います。
- 元の処理と比較できる同じタスク集合を用意し、判断の正しさ、保留率、処理時間、全体費用を記録します。モデルの応答速度だけでエージェント全体の改善を判断しません。
よくある質問
JevだけでAIエージェントを作れますか?
いいえ。Jevは限定された判断を返します。状態の収集、権限管理、ツール実行、失敗時の対応はホスト側の設計が必要です。
CodexやClaude Codeの代わりになりますか?
置き換えるものではありません。文章やコードを作る作業は生成モデルが担当し、Jevは定義済み候補から選ぶ判断に使えます。
確信度が高ければ自動実行しても安全ですか?
確信度は個々の判断の正解保証ではありません。権限、対象、金額などの固定ルールと、重要な操作の確認手順を別に設けてください。
出典と範囲
製品仕様はTypeSafeの公式資料を参照しています。リンク先のケースは各作者の公開資料に基づく紹介であり、性能値や運用成果を当サイトが再現したという意味ではありません。