TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #569 · 25.09

Недавно в сеть слили утекшие материалы GTA 6: видео с игровым процессом (сырым и с сырой графикой, конечно). Пишут, что вроде как это результат одного из взломов Rockstar со стороны хакеров. Как, вероятно, думал хакер: игру все ждут, а проклятая студия скрывает подробности разработки. Покажу всем фанатам, чтобы они хоть какую-то инфу получили! Что получилось на деле: студия, вероятно, вынуждена будет переделывать некоторые куски, которые уже слиты, чтобы оставить в сюжете и механиках интригу. К тому же, дополнительные ресурсы сейчас ещё и уйдут на усиление внутренней безопасности, поиск кротов и так далее. Атмосфера в командах разработки из-за этого тоже ухудшится. Срок выхода игры отодвинется. Неизвестно, надолго ли, но точно это на срок повлияет. Фанатам игры, которые её ждут, станет хуже. Впрочем, всегда есть вероятность, что хакер просто ненавидит корпорации, на игру ему плевать, он просто хотел сделать плохо Rockstar. Кстати, если бы, грубо говоря, фанаты договорились не смотреть видео и не пересылать его друг другу, ущерб студии был бы куда меньше, и игра вышла бы скорее. Эта идея в несколько другой форме была в самой первой серии первого сезона Black Mirror (да, про свинью). #games

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #2bitq

当前筛选 #2bitq清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9516 · 13.02.2026 г., 15:23

🌟Tencent сжали 1.8B модель в 2 бита: 600 МБ веса и Dual-CoT на борту. Tencent Hunyuan выкатили open-source решение для тех, кто хочет запускать LLM локально на кофеварке. HY-1.8B-2Bit - модель, которую утрамбовали так плотно, что она занимает меньше места, чем многие современные мобильные приложения. Модель пилили методом Quantization-Aware Training, который в отличие от PTQ, позволяет адаптироваться к низкой разрядности весов еще на этапе тренировки. За основу взяли backbone Hunyuan-1.8B-Instruct и жестко сжали веса до 2 бит. При этом эффективный размер в памяти получился эквивалентен модели на 300М параметров, а физический вес получился всего 600 МБ. Что самое ценное - сохранили фичу Dual-CoT: модель умеет переключаться между быстрым мышлением для простых тасков и глубоким long-CoT для сложных. 🟡Бенчмарки 🟢По сравнению с fp16-учителем (1.8B), деградация метрик всего ~4%. Это очень мало для 2-битного квантования. 🟢Разница в точности на сравнении с INT4 ничтожна - 0.13%, хотя весит модель в 2 раза меньше. 🟢Если взять плотную модель на 0.5B параметров, то HY-1.8B-2Bit обходит ее в среднем на 16-17%. На GSM8K разрыв вообще дикий: +22.29%. 🟢Prefill ускорился в 3-8 раз, генерация токенов - в 2-3 раза на поддерживаемом железе. 🟡Жирный нюанс Текущая реализация требует поддержки инструкций Arm SME2. Это значит, что вся эта красота заведется только на Apple M4 и MediaTek Dimensity 9500. Если у вас M1/M2 или Snapdragon прошлых поколений - пока мимо. Разработчики обещают подвезти Neon kernel позже. Кстати, GGUF тоже есть, так что если под рукой есть M4 - можно тестить. Остальным остается ждать оптимизации под старые инструкции. 🟡Модель 🟡GGUF 🟡Техотчет 🖥GitHub @ai_machinelearning_big_data #AI#ML#SLM#2bitQ#Tencent