← トップページ

層①

30秒で分かる要約

8項目
1. 一言でいうと標準的な許諾条件で公開された混合エキスパート版。公開資料に載っている評価指標の表記が 当サイトの登録指標と細かく食い違っており、**そのまま比較できない例**にあたる。 [主張] 確認日: 2026-07-28根拠1(外部サイト・新しいタブで開きます)根拠2(外部サイト・新しいタブで開きます)根拠3(外部サイト・新しいタブで開きます)
2. 何を判断するための情報か配布条件は標準的な許諾で、追加の制限は確認されていない。判断の中心は規模と、 扱えるテキストの長さになる。公称の長さは大きいが、拡張には設定の書き換えが要る点は 先に把握しておくとよい。 [事実] 確認日: 2026-07-28根拠1(外部サイト・新しいタブで開きます)根拠2(外部サイト・新しいタブで開きます)根拠3(外部サイト・新しいタブで開きます)
3. 向いている用途未確認(当方がまだ確認できていません)
4. 注意点公開資料の指標名を、当サイトや他社の資料に出てくる似た名前の指標と同じものとして 読まないほうがよい。サブセットの絞り込み、年度、タスクの修正の有無で、 同じ名前でも別の測定になる。 次に、拡張時の最大長を常用できる長さと読まないこと。設定の書き換えが前提である。 また、活性化パラメータ数が小さいことを、必要なメモリが小さいことと読み替えないこと。 重み全体は載せる必要がある。 [仮説] 確認日: 2026-07-28根拠1(外部サイト・新しいタブで開きます)根拠2(外部サイト・新しいタブで開きます)根拠3(外部サイト・新しいタブで開きます)
5. 提供方式ウェイト公開[事実]一次リンク(外部サイト・新しいタブで開きます)
6. 商用利用可否
(b) API利用: Alibaba Cloud Model Studio: 未確認(当方がまだ確認できていません)
※ (a)(b)は別項目です。商用利用可否を1つに合成した表示は行いません。
7. 最終確認日2026-07-28
8. 一次ソースへの最短リンクQwen公式ブログ・Alibaba Cloud Model Studio / https://qwen.ai/(外部サイト・新しいタブで開きます)
層②

比較・選定の詳細

10セクション
この10セクションの見出し右にあるバッジの読み方:「集約」はそのセクション内に出てくる証拠水準のうち最も弱いもの、確認日はそのセクション内で確認されている日付のうち最も古いものを示しています(個々の項目に付いている証拠水準バッジ・確認日を上書きするものではありません)。セクション内に固有の確認日が無い場合は、ページ全体の最終確認日で代用しています。

1. 価格

集約:[主張]確認日: 2026-07-28
事業者種別入力単価出力単価表示形態確認日
Alibaba Cloud Model Studio開発元直販$0.25 / 100万トークン (条件: 地域・トークン長でティアが分かれる(claim_qwen36_api_price参照)。シンガポール(国際): 入力$0.25/100万トークン(0〜256K)・$1(256K〜1M)、出力$1.5(0〜256K)・$4(256K〜1M)。北京・香港・フランクフルト: 入力$0.165(0〜256K)・$0.66(256K〜1M)、出力$0.99(0〜256K)・$3.961(256K〜1M)。90日間100万トークンの無料枠あり。課金はリクエスト単位の入力トークン総数で決まるティア制。ここに収録したprice_input/output_per_million_tokensはシンガポール(国際)0〜256Kレンジの代表値。)[主張]$1.5 / 100万トークン (条件: 地域・トークン長でティアが分かれる(claim_qwen36_api_price参照)。シンガポール(国際): 入力$0.25/100万トークン(0〜256K)・$1(256K〜1M)、出力$1.5(0〜256K)・$4(256K〜1M)。北京・香港・フランクフルト: 入力$0.165(0〜256K)・$0.66(256K〜1M)、出力$0.99(0〜256K)・$3.961(256K〜1M)。90日間100万トークンの無料枠あり。課金はリクエスト単位の入力トークン総数で決まるティア制。ここに収録したprice_input/output_per_million_tokensはシンガポール(国際)0〜256Kレンジの代表値。)[主張]①値保持型2026-07-28

2. 速度

集約:確認日: 2026-07-28
未確認(当方がまだ確認できていません)

3. 評価サマリ(辞典6本+代表ベンチの抜粋)

集約:[主張]確認日: 2026-07-28

登録済みの評価指標7件をすべて行として表示します(結果が確認できない指標も欠損理由を示します)。 数値が載る場合も原則非保持(R1準拠。リーダーボード表示スコアの実数値は転記しません)。 評価指標そのものの読み方はこちら →

ベンチマーク実施主体評価対象表示辞典リンク
AIME開発元● モデル単体
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にAIME系の評価結果が掲載されている(開発元発表)。上位モデルが飽和しているベンチマークであることがbm_aime自体の特性として登録済み。数値自体は転載せず、掲載の事実と年次条件のみを記録する。[主張](条件: 版=full AIME 2026 (I & II)(開発元脚注記載の原文表現。行ラベルは「AIME26」)) 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28
読み方を見る
GPQA Diamond開発元● モデル単体
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にGPQA系の評価結果が掲載されている(開発元発表)が、対象がGPQA全体かDiamondサブセットかが原文表記からは判別できない。数値自体は転載せず、掲載の事実と条件不明点のみを記録する。[主張](条件: 版=GPQA(原文の行ラベルは「GPQA」のみで「GPQA Diamond」という表記ではない。Diamondサブセット限定か全体セットかは一次ソース上判別不能)) 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28
読み方を見る
llm-jp-eval未確認(当方がまだ確認できていません)読み方を見る
LMArena Text未確認(当方がまだ確認できていません)読み方を見る
METR Time Horizon未確認(当方がまだ確認できていません)読み方を見る
Nejumiリーダーボード未確認(当方がまだ確認できていません)読み方を見る
SWE-bench Verified開発元◆ エージェント構成 (エージェント名は非開示)
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にSWE-bench系の評価結果が掲載されている(開発元発表)が、独立第三者による評価ではなく、開発元が独自に修正した非標準の"refined benchmark"上での結果である。数値自体は転載せず、掲載の事実と条件の違いのみを記録する。[主張](条件: 版=開発元が一部タスクを独自に修正した"refined benchmark"(正式なバージョン名・タスク数の詳細は開示未確認。標準のSWE-bench Verifiedとは別条件)) 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28
読み方を見る

4. ライセンス/API利用条件

集約:[主張]確認日: 2026-07-28

(a) 重み配布ライセンスと (b) API利用条件は別物です。合成した「商用利用可否」は作りません(R3)。

(a) 重み配布ライセンス

正式名Apache License, Version 2.0[主張]
商用利用無条件可[主張]
条件要点該当なし(この項目自体が存在しないため)
原文リンク原文を確認する一次リンク(外部サイト・新しいタブで開きます)
原文確認状態未精読
商用可否の法的評価状態要再確認
確認日未確認(当方がまだ確認できていません)

(b) API利用条件(事業者ごと)

事業者商用利用可否確認日
Alibaba Cloud Model Studio未確認(当方がまだ確認できていません)未確認(当方がまだ確認できていません)

5. 必要計算資源(ローカル実行)

集約:[事実]確認日: 2026-07-28
形式量子化DLサイズ必要VRAM(最低)対応ランタイム配布先公式/非公式
safetensorsFP8未確認(当方がまだ確認できていません)未確認(当方がまだ確認できていません)Transformers(未検証)Hugging Face配布先(外部サイト・新しいタブで開きます)公式
safetensors非該当(フル精度FP16/BF16)未確認(当方がまだ確認できていません)未確認(当方がまだ確認できていません)Transformers(未検証)Hugging Face配布先(外部サイト・新しいタブで開きます)公式
注記: DLサイズ・必要VRAM のうち「当方算出」表記のものは実測値ではなく、パラメータ数等からの理論値です。

6. コンテキスト・入出力仕様

集約:[主張]確認日: 2026-07-28

コンテキスト長: 262,144 トークン[主張]

入出力: マルチモーダル

7. 類似モデルとの差

集約:確認日: 2026-07-28
モデル関係性比較理由導線
未確認(当方がまだ確認できていません)

8. 開発元の主張/Rasideの整理

集約:[仮説]確認日: 2026-07-28

開発元の主張

開発元は、この版を事前学習と後段の学習を経たものとして公開し、 複数の指標で測ったとする評価結果を自ら公表している。一部の指標については、 採点に用いた設定や試行の条件まで注記している。 [主張] 確認日: 2026-07-28根拠1(外部サイト・新しいタブで開きます)根拠2(外部サイト・新しいタブで開きます)根拠3(外部サイト・新しいタブで開きます)

Rasideによる整理

判断に効く順に整理する。(1) **この版は「同名だが条件が違う」が三つ重なっている。** 第一に、公開資料の表の行ラベルは大学院レベルの知識を問う指標の一般名であって、 当サイトが登録している絞り込み済みのサブセットとは表記が一致しない。同じものを 指しているかを公開資料から判別できないため、当方は条件不明として記録している。 第二に、数学の指標は特定の年度の問題に固定されている。別の版が別の年度で測っていれば、 同じ指標名でも比較はできない。第三に、コーディングの指標について、開発元は 一部のタスクを自ら修正した版で測ったと注記している。標準の指標とは別条件である。 (2) 上の三点は、この事業が扱う主題そのものである。**指標名が一致することと、 比べられることは別である。**当サイトは評価結果を指標に直付けせず、実行条件を経由して 記録しているので、条件が違えば比較不可として表示できる。 (3) 扱えるテキストの長さは、標準の状態と拡張時で異なる。拡張は既定ではなく、 利用者が設定を書き換えて有効にする方式である。公称の上限値だけを見て 常用できると考えないほうがよい。 (4) 評価結果の数値は載せていない。掲載されている面に再利用を許す根拠が無いためである。 [仮説] 確認日: 2026-07-28根拠1(外部サイト・新しいタブで開きます)根拠2(外部サイト・新しいタブで開きます)根拠3(外部サイト・新しいタブで開きます)根拠4(外部サイト・新しいタブで開きます)

9. 確認されていること/分からないこと

集約:確認日: 2026-07-28

確認されていること

  • 公開方式(ウェイト公開)
  • 公開日(2026-04-14)
  • 重み配布ライセンスの正式名(Apache License, Version 2.0)
  • コンテキスト長
  • 配布形式(safetensors)の存在

分からないこと(欠損区分)

  • Alibaba Cloud Model StudioのAPI商用利用条件未確認(当方がまだ確認できていません)

10. 関係する人・前回からの変更

集約:[仮説]確認日: 2026-07-28

どんな人に関係するか

前回からの変更(直近3件)

未確認(当方がまだ確認できていません)

全件(0件)は下の層③「更新履歴(フル)」を参照。

層③

検証可能な根拠

6項目・既定で折りたたみ
層③ 検証可能な根拠(6項目)を開く/折りたたむ

1. 条件付き評価結果(全件)

ベンチマークスキャフォールド試行回数実施主体評価対象数値or解釈
AIMEfull AIME 2026 (I & II)(開発元脚注記載の原文表現。行ラベルは「AIME26」)未確認(当方がまだ確認できていません)未確認(当方がまだ確認できていません)開発元● モデル単体
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にAIME系の評価結果が掲載されている(開発元発表)。上位モデルが飽和しているベンチマークであることがbm_aime自体の特性として登録済み。数値自体は転載せず、掲載の事実と年次条件のみを記録する。[主張] 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28
GPQA DiamondGPQA(原文の行ラベルは「GPQA」のみで「GPQA Diamond」という表記ではない。Diamondサブセット限定か全体セットかは一次ソース上判別不能)未確認(当方がまだ確認できていません)未確認(当方がまだ確認できていません)開発元● モデル単体
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にGPQA系の評価結果が掲載されている(開発元発表)が、対象がGPQA全体かDiamondサブセットかが原文表記からは判別できない。数値自体は転載せず、掲載の事実と条件不明点のみを記録する。[主張] 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28
SWE-bench Verified開発元が一部タスクを独自に修正した"refined benchmark"(正式なバージョン名・タスク数の詳細は開示未確認。標準のSWE-bench Verifiedとは別条件)非開示(開発元の方針として非公開です)未確認(当方がまだ確認できていません)開発元◆ エージェント構成 (エージェント名は非開示)
権利上の理由により当サイトでは保持しない
モデルカード表・公式ブログの双方にSWE-bench系の評価結果が掲載されている(開発元発表)が、独立第三者による評価ではなく、開発元が独自に修正した非標準の"refined benchmark"上での結果である。数値自体は転載せず、掲載の事実と条件の違いのみを記録する。[主張] 一次リンク(外部サイト・新しいタブで開きます) 確認日: 2026-07-28

4. 更新履歴(フル・0件)

対象項目変更前変更後検知日確認日
未確認(当方がまだ確認できていません)

5. 一次ソース一覧

IDソース種別リンク
src_qwen_officialQwen公式ブログ・Alibaba Cloud Model Studio一次開く(外部サイト・新しいタブで開きます)
src_hf_cn_orgHugging Face(中国OW各社org: deepseek-ai/Qwen/zai-org/moonshotai/MiniMaxAI等)一次開く(外部サイト・新しいタブで開きます)

6. 確認者・確認プロセス

確認者: sonnet-subagent-3-4-b2

プロセス: 人手確認(human_confirmed)フラグが真である項目: モデル版本体、価格情報。一次資料を人手で突合し、差異があれば確認日の新しい方を採択しています。

version_id: qwen3.6-35b-a3b