EleutherAI、OLMo-3-7Bのハッキング耐性検証用モデル2種公開
EleutherAIが報酬ハッキングの動態研究用として公開した「OLMo-3-7B」ベースのモデル2種について、スペックや検証結果、動作環境を解説します。
EleutherAI、データ帰属の基準モデル「bergson-wikitext-gpt2-leaderboard」公開
EleutherAIによる学習データ帰属のベンチマーク基準モデル「EleutherAI/bergson-wikitext-gpt2-leaderboard」の概要やスペック、各種影響度評価手法のスコアを解説します。