05 データセット
学習者ガイド: 05 データセット
ワークショップ資料は公開されている langfuse/langfuse-workshop リポジトリで管理されています。実行可能なアプリケーション、チェックポイント ブランチ、ローカル セットアップはリポジトリを参照してください。
学習者ガイド: 05 データセット
インストラクター ノート
- データセットを製品スコープが記述されたものとしてフレーミングしてください: 期待されるユーザー入力、期待される動作、スライス用のメタデータ。
- コード パスは意図的にシンプルです: キュレートされた JSON を Langfuse にシードし、ホストされたデータセットを検査します。
expectedOutputが 2 つのフィールドを持つ理由を呼び出してください:idealAnswerは Correctness 判定に供給され、expectedKeywordsは次の章の確定的keyword_overlapチェックに供給されます。- このチャプターを監視にリンク戻す: 良好なデータセット項目はしばしば驚くべき本番トレースから来ています。
デモ リズム
data/seed-dataset.jsonを開き、input、expectedOutput、metadataを指摘します。npm run dataset:seedを実行します。- Langfuse でデータセット リストと項目テーブルを開きます。
注視する点
- 学習者が完全な回答マッチングを期待している場合。理想的な回答は文字列の等価性ターゲットではなく、評価器の参照資料です。
- 同じプロジェクトに対してシード スクリプトを繰り返し実行するとデータセット項目が重複している場合。