注目★★★★★Hugging Face Papers
TRL-Bench:表形式エンコーダを横断評価する標準ベンチマーク公開
30秒で把握
- 1TRL-Bench が表形式エンコーダの横断評価を標準化・20モデル16タスクで検証
- 250 OpenML テーブル・47,772件 DLTE レイク等のベンチマーク資産を公開
- 3性能はタスク特性依存で単一ランキングでは評価不能と判明
要約
TRL-Benchは、異なる学習パラダイムの表形式エンコーダを統一条件で比較できる多粒度ベンチマークとして公開された。各エンコーダは行・列・テーブルの3粒度で埋め込みを出力し、TRL-CTbench・TRL-Rbench・TRL-DLTEの3スイートで評価される。123検証済みターゲットを持つ50件のOpenMLテーブル、16件の行ペアリンク書き換え、1,379親テーブル由来の47,772テーブルDLTEレイクがベンチマーク資産として整備された。20モデル・16タスクの検証から、エンコーダ性能は単一リーダーボードでなくタスク特性ごとに異なることが判明した。テキスト信号の強いタスクでは汎用テキストエンコーダが優位に立つ一方、事前学習目標が合致する場合は表形式専用モデルが勝る。
あなたへの影響
表形式データを扱うMLパイプラインの評価設計を見直しているチームは、TRL-Benchの3スイートとベンチマーク資産を参考に、用途ごとに適切なエンコーダ選定の指針として活用できる。
推奨:現時点で即時対応は不要です。必要に応じて原文を確認してください。