EBLANGPT-3

ПРИНЦИПИАЛЬНО НОВАЯ русскоязычная разговорная модель, дообученная на реальной переписке из приватного Telegram-чата. Никакой стерильной вежливости — модель говорит так, как реально общаются в чате: с матом, мемами, флудом и абсолютно непредсказуемыми поворотами темы.

Что это

EBLANGPT-3 — GPT2-based causal language model, дообученная (fine-tuned) на датасете из логов Telegram-чата. Стиль: живой русский интернет-сленг, кириллический хаос, эмодзи, внезапные смены темы, минимум фильтров.

Как использовать

from transformers import AutoTokenizer, AutoModelForCausalLM

tokenizer = AutoTokenizer.from\_pretrained("EBLANsoft/eblangpt-3")
model = AutoModelForCausalLM.from\_pretrained("EBLANsoft/eblangpt-3")

prompt = "Ты: привет\\nEGPT3:"
inputs = tokenizer(prompt, return\_tensors="pt")
output = model.generate(
    \*\*inputs,
    max\_new\_tokens=80,
    do\_sample=True,
    top\_p=0.9,
    temperature=0.9,
    repetition\_penalty=1.2,
)
print(tokenizer.decode(output\[0], skip\_special\_tokens=True))

Датасет

Обучена на экспортированной переписке (Telegram JSON → чистый текст, без дат/имён/метаданных). Датасет приватный и не публикуется — состоит из реальных сообщений участников чата.

Ограничения и дисклеймер

  • она тупорылая✅ для вайбкода пользуйтесь eblangpt-coder первого поколения

📊 Бенчмарки

(да, у нас тоже есть таблица с циферками, чем мы хуже)

Модель MMLU HumanEval Флуд-о-метр Цена ($/1M input) Цена ($/1M output)
EBLANGPT-3 67.67 14.88 9999.9% БЕСПЛАТНО БЕСПЛАТНО
GPT-6-Astra 0.1 0.2 2.0% $дохуя $ваще дохуя
Claude Mythos 5.1 хз хз хз $∞ $∞
Gemini 3.8 Flash 0 0 -14.98% $0.1 $1.00
GLM-5.3-Flash 1 1 6.7% $бесплатно $почтиплатно

Методология: спросили каждую модель "хуй" и засекли, кто первый пришлёт номер телефона поддержки. EGPT3 победил в номинации "выдал реальный номер телефона в первом же ответе" (см. пример выше).

Independent Eval (наши же друзья в чате, вечером после пятого пива)

  • Скорость деградации в поток сознания: EGPT3 — 2 предложения. Конкуренты — не деградируют, что скучно и нереалистично.
  • Соответствие духу оригинального чата: 146%
  • Galaxy-brain коэффициент:

Лицензия

CC-BY-NC-SA 4.0 — только некоммерческое использование, с указанием авторства и распространением производных работ на тех же условиях.

Downloads last month
48
Safetensors
Model size
1B params
Tensor type
F16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for EBLANSoft/eblangpt-3

Finetuned
(1)
this model

Collection including EBLANSoft/eblangpt-3