Команда Empero представила новую reasoning-модель, созданную на базе глубоко модифицированной версии Qwen3.5-9B. Разработчики провели полный fine-tune модели и дополнительно обучили её более чем на 500 миллионах токенов данных Claude Mythos и Claude Fable.
Что известно:
• Контекстное окно увеличено до 1 миллиона токенов.
• Для обучения использовались синтетические Chain of Thought (CoT), созданные на основе сессий Mythos-5 и Fable-5.
• Выполнен полный fine-tune всех параметров модели.
• Основной акцент сделан на улучшение способностей к рассуждению и работе со сложными задачами.
Интересный момент: всё чаще открытые модели обучаются на данных, сгенерированных более мощными ИИ-системами. В результате качество open-source решений продолжает быстро сокращать разрыв с закрытыми моделями.
Модель уже доступна на Hugging Face: https://huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M