JJEV 実践ガイド
ホーム/公開事例

CASE NOTES / 08

出典の確認できる事例

速度や成果は原作者または TypeSafe の報告です。当サイトは判断の位置と再現上の制約を説明します。

ブラウザー操作

browser-use/jev-ultrafast

構造化されたページ状態から操作と要素を選びます。文字入力には別の文章モデルを使います。性能値は原プロジェクトの条件に限られます。

出典を見る関連ガイド

ゲーム状態

fhshaik/typesafe-mario

エミュレーターの状態から許可された操作を選びます。特定のゲームの実験であり、画像認識の評価ではありません。

出典を見る関連ガイド

コードレビュー

devagrawal09/jev-review

コード変更に限定した質問を使います。最終的な判断は開発者が行います。

出典を見る関連ガイド

文脈圧縮

tamaratran/fast-jev-compaction

ツール出力の残すべき部分を評価します。情報の欠落は自分の仕事で検証する必要があります。

出典を見る関連ガイド

セキュリティ事象

TypeSafe workflow eval: Security incidents

公式評価では安全事象を複数の質問とコードの規則に分解します。参照ラベルはモデルの合意に基づきます。

出典を見る関連ガイド

顧客対応

TypeSafe workflow eval: Customer service

公式の顧客対応フローは会話とアカウント状態への判断を示します。すべてのサポート業務での結果ではありません。

出典を見る関連ガイド

請求書処理

TypeSafe workflow eval: Invoice processing

公式フローは文書の判断と明確な規則を組み合わせます。支払い権限は業務システムが管理します。

出典を見る関連ガイド

エージェント記録

TypeSafe workflow eval: Agent trace

公式評価は終了したエージェント処理を人が確認すべきか判断します。異なる記録形式では再評価が必要です。

出典を見る関連ガイド

当サイトでは Jev API の実測を行っていません。