OpenAI、言語モデル評価のためのベンチマークツール「simple-evals」

On: 2024/04/15

OpenAIは現地時間12日、言語モデル評価のためのベンチマークツール「simple-evals」をGitHub公式リポジトリに公開した。従来公開していたLLM評価ベンチマークツール「evals」の軽量版に位置する「simple-evals」は、最新モデル(gpt-4-turbo-2024-04-09以降)で公開している数値の透明性を保つためにオープンソースで公開しており、以下の各スコアを評価する。

OpenAI、言語モデル評価のためのベンチマークツール「simple-evals」

続きを読む ≫

関連ニュース

注目ニュース

新着ニュース

2024年4月
月	火	水	木	金	土	日
1	2	3	4	5	6	7
8	9	10	11	12	13	14
15	16	17	18	19	20	21
22	23	24	25	26	27	28
29	30