Файнтюн Qwen, который в переписке не отличить от человека
Qwen3.8-27B-Humanlike-Chat — комьюнити-файнтюн, обученный на 140 тысячах реальных сообщений. Отвечает коротко, шутит и не звучит как ассистент.

На r/LocalLLaMA хит недели — Qwen3.8-27B-Humanlike-Chat, комьюнити-файнтюн, который в переписке звучит как живой собеседник, а не как ассистент. Пост автора собрал 602 апвоута и почти двести комментариев, а квантованные версии модели за месяц скачали больше 12 тысяч раз.
Что произошло
Автор из LessThanThreeAI обучил LoRA-адаптер на 139 845 реальных сообщениях из 1 396 длительных личных переписок — модель училась предсказывать, что человек на самом деле написал следующим, а не что «полезно ответить». Результат радикально отличается от типичного чат-бота: медианная длина ответа упала с 427 символов у базовой модели до 32, рефлекторные встречные вопросы («А как у тебя дела?») — с 27 из 29 реплик до 3, а канцелярские конструкции вроде «не X, а Y» и ответы списками исчезли полностью — ноль на 590 тестовых реплик.
В примерах из карточки модель отвечает односложно, перескакивает между темами, отшучивается и спокойно оставляет часть сообщения без ответа — ровно так, как ведут себя люди в мессенджерах. Комментаторы на Reddit делятся транскриптами, где отличить модель от человека действительно сложно, и обсуждают очевидное применение: персонажи для ролеплея, NPC в играх и «компаньон-чаты».
Технические детали:
- База: Huihui-Qwen3.8-27B-abliterated (производная Qwen3.8-27B)
- Адаптер: LoRA rank 256, 1,87 млрд обучаемых параметров
- Форматы: GGUF от Q3_K_M (13,3 ГБ) до BF16 (53,8 ГБ), рекомендуемый Q4_K_M — 16,6 ГБ
- Контекст: нативные 262 144 токена
- Лицензия: Apache-2.0, есть бесплатный хостируемый эндпоинт
Почему это важно
Есть и спорный момент: базой выбран «аблитерированный» чекпоинт со снятыми ограничениями — автор утверждает, что механизмы отказов портят естественность речи, и часть треда закономерно ушла в дискуссию об этике безцензурных моделей-компаньонов. Но сам рецепт показателен: пока большие лаборатории оправдываются за то, на чьих разговорах они учат фронтир-модели, энтузиаст с одной видеокартой и архивом собственных чатов сделал то, что не получается у флагманов, — модель, которая просто нормально разговаривает. После бунта против Ollama это ещё одно напоминание, что повестку локальных моделей всё чаще задают не компании, а комьюнити.


