Alibaba Tongyi Qianwen kündigte heute die Veröffentlichung eines neuen kleineren Modells an –Qwen3-4B-Instruct-2507 und Qwen3-4B-Thinking-2507.Derzeit ist das neue Modell offiziell als Open Source in der Magic Community und HuggingFace verfügbar. Berichten zufolgeIm Nicht-Inferenzbereich übertrifft Qwen3-4B-Instruct-2507 das Closed-Source-GPT4.1-Nano bei weitem.
Im Bereich des Denkens ist der Qwen3-4B-Thinking-2507 sogar mit dem mittelgroßen Qwen3-30B-A3B (Denken) vergleichbar.
Beamte gaben an, dass die 2507-Version des Qwen3-4B-Modells besonders gut für den Einsatz endseitiger Hardware wie Mobiltelefone geeignet sei.

Im Folgenden sind die wichtigsten Highlights des Modells aufgeführt
Qwen3-4B-Instruct-2507
Die allgemeinen Fähigkeiten wurden erheblich verbessert und übertreffen das kommerzielle Closed-Source-Kleinmodell GPT-4.1-nano und nähern sich der Leistung des mittelgroßen Qwen3-30B-A3B (nicht denkend).
Das neue Modell deckt Long-Tail-Wissen in mehr Sprachen ab, verbessert die Ausrichtung menschlicher Präferenzen bei subjektiven und offenen Aufgaben und kann Antworten liefern, die besser auf die Bedürfnisse der Menschen abgestimmt sind.
Das Kontextverständnis reicht bis 256K, und kleine Modelle können auch lange Texte verarbeiten.
Qwen3-4B-Thinking-2507
Die Denkfähigkeit wurde erheblich verbessert, und AIME25 erreichte einen Wert von 81,3. Die Argumentationsleistung von Qwen3-4B-Thinking-2507 ist vergleichbar mit dem Mittelklassemodell Qwen3-30B-Thinking.
Insbesondere in der AIME25-Bewertung, die sich auf mathematische Fähigkeiten konzentriert, erreichte es 81,3 Punkte bei 4B-Parametern.
Die Agentenbewertungen liegen über den Erwartungen und alle relevanten Bewertungen übertreffen das größere Qwen3-30B-Thinking-Modell.
Die kontextbezogene Verständnisfähigkeit von 256K-Tokens unterstützt komplexere Dokumentanalysen, die Generierung langer Inhalte, absatzübergreifendes Denken und andere Szenarien.


