• Главная
  • Новости
  • Блог
  • Релизы
  • История LLM
  • Сравнение LLM
  • Библиотека
  • Обо мне
⌘K
Вход
Moonshot AI

6 ноября 2025

Kimi K2 Thinking

Контекст: 262.1KВход: — / 1MВыход: — / 1M

Что нового
  • Reasoning-модель с interleaved thinking и 200–300 последовательными вызовами инструментов
  • HLE с инструментами 44.9%, BrowseComp 60.2%, BrowseComp-ZH 62.3% и Seal-0 56.3%
  • SWE-bench Verified 71.3%, SWE-bench Multilingual 61.1%, Terminal-Bench 47.1% и LiveCodeBench v6 83.1%
  • AIME 2025 94.5% без Python и 99.1% с Python; GPQA-Diamond 84.5%
  • Нативное INT4 QAT примерно удваивает скорость генерации; все опубликованные результаты сняты в INT4
Вердикт

K2 Thinking превратила Kimi из быстрого tool-user в полноценного reasoning-агента, способного удерживать сотни шагов и конкурировать с закрытыми флагманами.

Moonshot AI

Блог и заметки о разработке. Для связи удобнее всего использовать соцсети ниже.

Контакты
talalaev.misha@gmail.com
Документы
Политика обработки персональных данныхСогласие на обработку персональных данных