自社タスクでAIモデルのコスパを測る「te bench」公開
Zenn LLM ・ 2026-09-02
原題: AIエージェントのコストと品質を自分のモデルで実測する「te bench」を作った
AI による要約
自社の業務タスクで使うAIモデルの品質とコストを、自分のAPIキーで1行のコマンドから測定できる「te bench」が公開された。品質は機械採点の正答率、コストは実トークン数×単価で自動集計され、設問・正解・採点コードも全て公開されている。
この要約は当サイトの AI が生成したものです。正確な内容は 元記事(Zenn LLM)をご確認ください。