Назад к ленте

Эксперимент с qwen3.8-flash-next и настройками контекста

Эксперимент с qwen3.8-flash-next и настройками контекста
🧪 Что будет, если попробовать изменить параметры контекста в qwen3.8-flash-next? По информации из официальной документации, изменение параметров в файле config.json позволяет масштабировать контекст с 262144 до 1 миллиона. С использованием конкретного PR для llama-server, автор задаётся вопросом: сработают ли указанные настройки? Настройки включают размер контекста в 1 миллион, с использованием RoPE и YaRN. Интересно, что может получиться в итоге!
Источник: www.reddit.com

Похожие проекты