本日、Alibaba Tongyi Qianwen は新しい小型モデルのリリースを発表しました—Qwen3-4B-Instruct-2507 および Qwen3-4B-Thinking-2507。現在、新しいモデルは Magic Community と HuggingFace で正式にオープンソース化されています。報道によると、非推論分野では、Qwen3-4B-Instruct-2507 はクローズドソースの GPT4.1-Nano を包括的に上回っています。

推論の分野では、Qwen3-4B-Thinking-2507 は中型の Qwen3-30B-A3B (思考) にさえ匹敵します。

関係者は、Qwen3-4B モデルの 2507 バージョンは、携帯電話などのエンドサイド ハードウェアの導入に特に適していると述べています。

以下はモデルの主要なハイライトです

クウェン3-4B-命令-2507

一般的な性能は大幅に向上しており、市販のクローズドソース小型モデル GPT-4.1-nano を上回り、中型 Qwen3-30B-A3B (非思考) の性能に近づいています。

新しいモデルは、より多くの言語のロングテール知識をカバーし、主観的で自由なタスクにおける人間の好みの調整を強化し、人々のニーズにより沿った応答を提供することができます。

コンテキストの理解は 256K まで拡張され、小型モデルは長いテキストも処理できます。

クウェン3-4B-思考-2507

推理力は大幅に強化されており、AIME25のスコアは81.3にも達した。 Qwen3-4B-Thinking-2507 の推論性能は、ミッドレンジ モデル Qwen3-30B-Thinking に匹敵します。

特に数学的能力を重視したAIME25の評価では、4Bパラメータで81.3点を獲得した。

エージェントのスコアはチャートから外れており、関連するすべてのレビューはより大きな Qwen3-30B-Thinking モデルを上回っています。

256K トークンの文脈理解能力は、より複雑な文書分析、長文コンテンツの生成、段落間の推論、その他のシナリオをサポートします。