• Главная
  • Новости
  • Блог
  • Релизы
  • История LLM
  • Сравнение LLM
  • Библиотека
  • Обо мне
⌘K
Вход
Alibaba

29 апреля 2025

Qwen3 235B-A22B

Контекст: 131.1KВход: — / 1MВыход: — / 1M

Что нового
  • Гибрид thinking/non-thinking в одном чекпойнте с управляемым бюджетом рассуждений
  • Флагманская MoE-модель: 235B параметров, 22B активных; младшая MoE — 30B-A3B
  • Открыты ещё шесть dense-моделей от 0.6B до 32B под Apache 2.0
  • Обучение примерно на 36 трлн токенов и 119 языках/диалектах; контекст флагмана 128K
  • 235B-A22B конкурентен DeepSeek-R1, o1, o3-mini, Grok-3 и Gemini 2.5 Pro на математике, коде и общих тестах
Вердикт

Qwen3 объединила быстрый ответ и reasoning в одной открытой линейке, сохранив редкую широту размеров — от локальных моделей до крупного MoE-флагмана.

Qwen Team

Блог и заметки о разработке. Для связи удобнее всего использовать соцсети ниже.

Контакты
talalaev.misha@gmail.com
Документы
Политика обработки персональных данныхСогласие на обработку персональных данных