提供元組織・国: ABEJA(主導)/日本|モデルファミリー: ABEJA-Qwen2.5-Japanese
| 1. 一言でいうと | 国内企業が海外の公開モデルを土台に日本語で学習した Dense 版。 **同じ配布ページの中で、学習の呼び方が本文と定型欄で食い違っている。** [主張] 確認日: 2026-07-28根拠1根拠2根拠3 |
|---|---|
| 2. 何を判断するための情報か | 配布条件は標準的な許諾で、原文も確認できている。 規模は中程度で、扱えるテキストの長さも公開されている。 判断に必要な条件面の情報は揃っているので、あとは用途との適合を見ることになる。 [事実] 確認日: 2026-07-28根拠1根拠2根拠3 |
| 3. 向いている用途 | 未確認(当方がまだ確認できていません) |
| 4. 注意点 | 機械可読な定型欄の区分だけを見て学習の内容を判断しないほうがよい。 本文の説明とは異なる語が入っている。 次に、土台が標準的な許諾だからといって、派生も自動的に同じとは限らない。 この版については確認した結果として同じだった、というのが正確な言い方である。 また、名前に含まれる数字は名称であって、公開された仕様値ではない。 [仮説] 確認日: 2026-07-28根拠1根拠2根拠3 |
| 5. 提供方式 | ウェイト公開[事実]一次リンク |
| 6. 商用利用可否 | (a) 重み配布: 可[主張]一次リンク (b) API利用: 未確認(当方がまだ確認できていません) ※ (a)(b)は別項目です。商用利用可否を1つに合成した表示は行いません。 |
| 7. 最終確認日 | 2026-07-28 |
| 8. 一次ソースへの最短リンク | Hugging Face(国産org: pfnet/tokyotech-llm/llm-jp/Rakuten/sbintuitions等) / https://huggingface.co |
| 事業者 | 種別 | 入力単価 | 出力単価 | 表示形態 | 確認日 |
|---|---|---|---|---|---|
| 未確認(当方がまだ確認できていません) | |||||
登録済みの評価指標7件をすべて行として表示します(結果が確認できない指標も欠損理由を示します)。 数値が載る場合も原則非保持(R1準拠。リーダーボード表示スコアの実数値は転記しません)。 評価指標そのものの読み方はこちら →
| ベンチマーク | 実施主体 | 評価対象 | 表示 | 辞典リンク |
|---|---|---|---|---|
| AIME | - | - | 未確認(当方がまだ確認できていません) | 読み方を見る |
| GPQA Diamond | - | - | 未確認(当方がまだ確認できていません) | 読み方を見る |
| llm-jp-eval | ベンチマーク運営元(開発元とは別法人) | ● モデル単体 | 権利上の理由により当サイトでは保持しない Open Japanese LLM Leaderboard(llm-jp-eval系)に本モデルの評価結果ファイルが存在することを確認した(status=FINISHED)。運営主体はllm-jp(NIIを中核とするコンソーシアム)であり、ABEJA自身による自己評価ではない。数値そのもの(正答率等)は本サイトの方針により転載していない。条件の詳細はcond_abeja-qwen2.5-32b-japanese-v0.1_llmjp_eval参照。[事実](条件: 版=llm_jp_eval v1.4.1) 一次リンク 確認日: 2026-07-28 | 読み方を見る |
| LMArena Text | - | - | 未確認(当方がまだ確認できていません) | 読み方を見る |
| METR Time Horizon | - | - | 未確認(当方がまだ確認できていません) | 読み方を見る |
| Nejumiリーダーボード | - | - | 取得不能(アクセス制限により到達できていません) | 読み方を見る |
| SWE-bench Verified | - | - | 未確認(当方がまだ確認できていません) | 読み方を見る |
(a) 重み配布ライセンスと (b) API利用条件は別物です。合成した「商用利用可否」は作りません(R3)。
| 正式名 | Apache License, Version 2.0[主張] |
|---|---|
| 商用利用 | 無条件可[主張] |
| 条件要点 | 該当なし(この項目自体が存在しないため) |
| 原文リンク | 原文を確認する一次リンク |
| 原文確認状態 | 未精読 |
| 商用可否の法的評価状態 | 要再確認 |
| 確認日 | 未確認(当方がまだ確認できていません) |
| 事業者 | 商用利用可否 | 確認日 |
|---|---|---|
| 未確認(当方がまだ確認できていません) | ||
| 形式 | 量子化 | DLサイズ | 必要VRAM(最低) | 対応ランタイム | 配布先 | 公式/非公式 |
|---|---|---|---|---|---|---|
| 該当なし(APIのみの提供のためローカル実行用の配布物が存在しない) | ||||||
コンテキスト長: 32,768 トークン[主張]
入出力: テキストのみ
| モデル | 関係性 | 比較理由 | 導線 |
|---|---|---|---|
| 未確認(当方がまだ確認できていません) | |||
開発元は、海外の公開モデルを土台に日本語を中心とした継続事前学習を行ったと本文で 説明しており、後段の学習はまだ行っておらず、差分ベクトルを用いて指示への追従性を 上げていると述べている。国の事業の支援下での開発であることも公表している。 [主張] 確認日: 2026-07-28根拠1根拠2根拠3
判断に効く順に整理する。(1) 学習の呼び方が、同じ配布ページの中で二通りある。 本文は継続事前学習と書いているが、機械可読な定型欄はファインチューニングを意味する 区分になっている。**当方はどちらかに統一せず、両方を記録している。**本文のほうが 説明として詳しいので表示の主にはそちらを採っているが、自動収集する側は 定型欄しか見ないことがある。同じ対象について、人が読む面と機械が読む面で 違う答えが出る状態にある。 (2) 配布条件は標準的な許諾で、**リポジトリ内の条文原文まで確認できている。** 土台が同じ許諾だからといって派生も同じとは限らないため確認したが、 追加や改変は見当たらなかった。確認した結果として同じである。 (3) 日本語の評価基盤に掲載があり、**実行条件まで追える形で記録が残っている。** 当サイトの対象の中では条件が特定できる数少ない例にあたる。ただし数値は載せていない。 結果データの再利用を許す根拠が確認できていないためである。 (4) 総パラメータ数の正確な値は公開されていない。名前から桁は分かるが、 それは名称であって仕様値ではないため未確認としている。 [仮説] 確認日: 2026-07-28根拠1根拠2根拠3根拠4
全件(0件)は下の層③「更新履歴(フル)」を参照。
| ベンチマーク | 版 | スキャフォールド | 試行回数 | 実施主体 | 評価対象 | 数値or解釈 |
|---|---|---|---|---|---|---|
| llm-jp-eval | llm_jp_eval v1.4.1 | 該当なし(この項目自体が存在しないため) | 未確認(当方がまだ確認できていません) | ベンチマーク運営元(開発元とは別法人) | ● モデル単体 | 権利上の理由により当サイトでは保持しない Open Japanese LLM Leaderboard(llm-jp-eval系)に本モデルの評価結果ファイルが存在することを確認した(status=FINISHED)。運営主体はllm-jp(NIIを中核とするコンソーシアム)であり、ABEJA自身による自己評価ではない。数値そのもの(正答率等)は本サイトの方針により転載していない。条件の詳細はcond_abeja-qwen2.5-32b-japanese-v0.1_llmjp_eval参照。[事実] 一次リンク 確認日: 2026-07-28 |
| 対象項目 | 変更前 | 変更後 | 検知日 | 確認日 |
|---|---|---|---|---|
| 未確認(当方がまだ確認できていません) | ||||
確認者: sonnet-subagent-3-4-d6、sonnet-subagent-3-1d
プロセス: 人手確認(human_confirmed)フラグが真である項目: モデル版本体。一次資料を人手で突合し、差異があれば確認日の新しい方を採択しています。
version_id: abeja-qwen2.5-32b-japanese-v0.1