まず分布を見る——Aは上位ではなく真ん中
格付けを「AAAが最高でCが最低」とだけ理解すると、まず間違えます。重要なのは定義ではなく分布のほうです。掲載239銘柄を7段階に並べると、次のようになります。
| 格付け | 銘柄数 | 構成比 | 6軸平均 |
|---|---|---|---|
| AAA | 21 | 8.8% | 89.9 |
| AA | 76 | 31.8% | 83.9 |
| A | 108 | 45.2% | 73.0 |
| BBB | 22 | 9.2% | 58.8 |
| BB | 11 | 4.6% | 51.5 |
| B | 1 | 0.4% | 41.8 |
| C | 0 | 0.0% | — |
A以上が205件(85.8%)。つまりAは「上位に入った」印ではなく、掲載銘柄の中央値です。BBB以下は34件(14.2%)しかなく、Cに至っては0件です。上位帯(AAA・AA)に限っても97件・40.6%あり、10銘柄中4件が該当する計算になります。
ですから「A格だから安心」という読み方は成立しません。格付けの1文字が使えるのは、BBB以下を候補から外すという足切りの用途だけです。候補が3つ4つに絞れたあとは、格付けを見ても差が出ません。そこから先は6軸の出番になります。
6軸のうち、格付けを動かしているのはどれか
6軸のスコアと確定格付けの関係を相関係数で出すと、軸ごとに効き方がはっきり違います。マイナスに大きいほど「その軸が高い銘柄ほど上位の格付けになっている」という意味です(格付けは上位を小さい数字として扱っているため符号が逆になります)。
| 軸 | 全銘柄の平均 | 格付けとの相関 |
|---|---|---|
| 開発活発度DEV | 75.7 | -0.771 |
| ドキュメントDOCS | 75.9 | -0.768 |
| エコシステムECOSYSTEM | 75.0 | -0.756 |
| 勢いMOMENTUM | 76.0 | -0.751 |
| 価格競争力PRICING | 81.3 | -0.668 |
| 日本語対応JP | 69.4 | -0.640 |
最も効いているのが開発活発度(-0.771)で、最も効いていないのが日本語対応(-0.640)です。価格競争力は平均81.3と6軸で最も高く、ほとんどの銘柄が高得点なので差がつきません。無料プランを持つ銘柄が多いためで、料金の安さで格付けが上がっているわけではない点は押さえておいてください。
日本語で使う人にとって重要なのは日本語対応です。平均69.4と6軸で最も低く、それでいて格付けへの効き方は最も弱い。UI・ドキュメント・サポートの3つすべてが日本語に対応していると掲載データが持っているのは239銘柄中24件(10.0%)だけです。上位帯97件のうち15件は日本語対応が70点未満のまま上位帯に入っています。
格付けは、日本語で使いやすいかをほとんど保証しません。英語のまま使える人は気にしなくてよく、社内で配る・非エンジニアに渡す前提なら、格付けより先に日本語対応の数字を見るほうが早い、というのがこの表の実務的な読み方です。
同じ格付けでも中身は逆になる
いちばん銘柄数が多いA格(108件)のなかで、日本語対応は30点から96点まで開いています。文章・翻訳のA格16件を例にとると、最も高い文賢が96点、最も低いGrammarlyが32点で、差は64点。それでいて6軸平均は69.3と70.3でほぼ並びます。同じ格付け・同じカテゴリでも、日本語で使えるかどうかは正反対ということです。
逆転は格の境界もまたぎます。AAAのうち6軸平均が最も低いOllamaは81.3、AAのうち最も高いFathomは93.0で、AAの62件がAAAの最下位を上回っています。矛盾ではありません。確定格付けは6軸平均の順位ではなく、3モデルの判定の中央値で決まるからです(規程は/methodologyに全文あります)。格付けと6軸は別の物差しで、片方をもう片方の要約として読むと必ずずれます。
判定が2段階以上割れた58件は審査割れ一覧に全件出しています。候補がここに入っていたら、確定格付けの1文字ではなく銘柄ページの判定根拠3社ぶんを読んでください。割れは「評価が定まっていない」という情報であって、製品が悪いという意味ではありません。
この格付けの限界——3つ書いておく
1つめ。実際にモデルへ採点させたのは3社のうち2社です。GPTとGeminiは全銘柄を実採点していますが、Claudeの判定は編集部が同じ6軸で設定したシード値で、Claude本体による全銘柄の実採点はまだ実施していません。これは/methodologyの運用状態の開示に書いてあるとおりです。3社の判定を並べて読むときは、この差を前提にしてください。
2つめ。採点日がそろっていません。掲載データ上、GPTの採点日は2026-07-24、Geminiは2026-09-01で1か月以上開いています。この間の値上げや機能追加は片方にしか反映されていない可能性があり、割れの一部はこの時間差に由来します。
3つめ。当サイトは独立した第三者の格付け機関ではありません。同一の資料・同一の6軸のもとで各AIモデルに採点させた結果であり、モデルの版や設定が変われば判定も変わります。指数についても公開情報に基づく推定シード値を含むβ運用です。最終的な編集責任は運営者(Creative Node)が負っています。
そのうえで、中立性について数字で1つ。現在アフィリエイトリンクを持つのは7銘柄で、そのうち上位帯(AAA・AA)は0件です。報酬が出る銘柄が1つも上位帯に入っていない、という状態がそのまま公開されています。報酬額で順位を入れ替えないことが、このサイトが格付けを名乗る唯一の根拠です。
最後に使い方をまとめると、順番はこうなります。格付けでBBB以下を外す、6軸で自分の条件に効く軸だけを見る(日本語で使うなら日本語対応、長く使うなら開発活発度)、審査割れなら3社の判定根拠を読む、無料枠があるものは自分の用途で試す。格付けの1文字で決めないことが、このページで伝えたい唯一の点です。