Мда ёпта, 12 с копейками часов на 4B модельку и 6 млн слитых токенов на судейку. В бенче ровно 100 вопросов. В ходе предварительных тестов…Открыть в Telegram ↗
Что заходит лучше всего
Топ постов по вовлечению и аутсайдеры — чтобы было видно, что повторять, а что убрать из ротации.
Типичный Qwen, как эту помойку вообще можно локально использовать? 😄Открыть в Telegram ↗
Ёпта, кажется моя методика оценки "G0VNO" квантованных моделей реально работает (но это не точно, пока только предварительные результаты…Открыть в Telegram ↗
Навайбкодено 😄 Осталось подождать 5 тысяч лет и потратить миллиард денег на прогоны всех тестов.Открыть в Telegram ↗
Короче, модели до 9B параметров зажатые в любой Q4_* лучше в принципе обходить стороной, они пздц как сильно тупеют. Q8 на их фоне…Открыть в Telegram ↗
☁️☁️☁️☁️☁️☁️☁️ 24 сентября Yandex Cloud проведёт флагманскую технологическую конференцию — Yandex Scale 2026…Открыть в Telegram ↗
Продолжая ИИшную аксиому Эскобара Есть 2 варианта, локальной "one-shot" генерации: 1) Модель выдает архитектурно слабое решение, но зато…Открыть в Telegram ↗
Сидел тут, выборочно осматривал на чем конкретно определенные модели факапились. Решил поисправлять за ними тупые баги, что б узнать как…Открыть в Telegram ↗