アリババ新AI「Qwen3.8-Max」、米大手と比較

  • Qwen3.8-Maxは、ArenaのコーディングランキングでClaude Opus 5およびKimi K3に次いで4位となった。
  • Qwen3.8-Maxと小型の270億パラメータモデルのオープンウェイトが来週公開される予定だ。
  • アリババ株は月曜日、香港市場で6.15%高の124.20香港ドルとなった。
プロモーション

アリババは月曜日にQwen3.8-Maxを発表し、初の公開ベンチマークでArenaのFrontend Codeリーダーボードで4位となった。テストでQwen3.8-Maxを上回ったのは、クロードOpus 5とMoonshotのKimi K3のみ。

2兆4000億パラメーターのこのモデルは、7月のプレビューを終え、950億個のアクティブパラメーター、100万トークンのコンテキストウィンドウ、一般向けAPI価格を備えて登場した。

スポンサード
スポンサード

Qwen3.8-Max、コーディングテストでクロードとKimiに次ぐ成績

ArenaのリーダーボードでQwen3.8-Maxは1668ポイントを獲得し、クロードOpus 5(High)の1670ポイントに1ポイント差で迫った。クロードOpus 5(Max)が1705ポイントでトップ、Kimi K3(Max)が1676ポイントで2位だった。また、ArenaのConsumer Productカテゴリでは2位に入った。

Xで最新ニュースをリアルタイムでフォロー

アリババが公開したデータでは、Qwen3.8-MaxはクロードOpus 4.8、Fable 5、GPT-5.6に対してエージェント機能やマルチモーダルベンチマークで優位に立ったとされる。TerminalBench-2.1で86.6、PaperBenchで93.0、OSWorld-Verifiedで86.1などのスコアを記録した。

一方、AnthropicのFable 5は、ソフトウェア工学の主要指標で依然として大きくリードしている。SWE-Proで80.0を記録し、Qwenの67.7を上回る。FrontierSWEでも88.8で、Qwenの73.5を大きく引き離した。

Qwen3.8-MaxとClaude、ChatGPTの比較
Qwen3.8-MaxとClaude、ChatGPTの比較 出典: X/Qwen

初の「Max」オープンモデル登場、アリババ株も上昇

今回の発表は、アリババがQwen-Maxクラスのモデルの重みを初めてオープンソース化することを意味する。

「来週にはQwen3.8-Maxのオープン重みを公開し、Qwen3.8-27Bもオープン重み化して皆さまにお届けします」とチームは述べた。

重みはHugging FaceとModelScopeで公開予定。API価格は入力100万トークン当たり2ドル、出力100万トークン当たり6ドルで設定された。

投資家も素早く反応した。アリババ株は香港市場で6.15%上昇し、ランチタイムには124.20香港ドルに達した。前営業日は117香港ドルだった。

アリババ株価推移
アリババ株価推移 出典: Google Finance

同株は金曜日の4.65%上昇も継続、これはMoonshotチップの取引報道も材料視された。重みの公開後、独立した評価が進めば、さらに全体像が明確になる見通し。

YouTubeチャンネルを登録して、専門家や記者による解説動画を見る


BeInCryptoの最新の暗号資産市場分析は、こちらをご覧ください

免責事項

当ウェブサイトに掲載されているすべての情報は、誠意をもって作成され、一般的な情報提供のみを目的としています。当ウェブサイトに掲載されている情報に基づいて行う一切の行為については、読者ご自身の責任において行っていただきますようお願いいたします。

スポンサード
スポンサード