it.xnews.jp
生成: 2026-09-28 読了 約 2 分 model: claude-haiku-4-5 原文: https://stateofutopia.com/experiments/microllmlab/ raw.md

ブラウザで小規模言語モデルを評価できる「MicroLLM lab」

TL;DR: State of Utopia が公開した「MicroLLM lab」は、ブラウザ環境で135Mパラメータなどの小規模言語モデルの性能をテストできるプラットフォーム。速度はtok/s(tokens per second)で、精度はテストの正答率で測定し、データはユーザーのマシン上に留まる。

State of Utopia が公開した「MicroLLM lab」は、ブラウザ上で小規模言語モデル(tiny LLMs)を直接評価できるラボ環境である。このインターフェースでは、135Mパラメータモデルといった軽量なモデルの実行性能を測定できる。

性能測定の仕組み

このラボではモデルの性能を2つのメトリクスで計測する。速度は tok/s(tokens per second)で測定され、持続的なデコード(sustained decode)での スループットを記録する。精度は客観的なテストの正答率(pass rate)で評価される。測定結果はユーザーのマシン上に留まり、外部に送信されない。

カスタムベンチマークの作成

ユーザーはJavaScript でベンチマークを自由に作成・実装できるインターフェースが用意されている。この機能により、特定のユースケースに合わせたテストを柔軟に設計することが可能である。

この記事は元記事の事実のみに基づいて自動生成されました。

出典

State of Utopia「MicroLLM lab — tiny LLMs, Q4, in your browser」 https://stateofutopia.com/experiments/microllmlab/

この記事をシェア