TGTGInsighttelegram intelligenceLIVE / telegram public index
← IT news | Tg Bots

TGINSIGHT SIMILAR POSTS

유사한 콘텐츠 찾기

소스 채널 @phpdevelopersuz · Post #3292 · 8월 14일

🥳Bugun Telegram 10 yoshga to'ldi. Pavel Durovtug'ilgan kun haqida shunday dedi: Atigi oʻn yil ichida Telegram 800 milliondan ortiq faol foydalanuvchilarga ega boʻldi. Yillar davomida ko'plab yangilanishlar va takomillashtirishlar orqali Telegram zamonaviy xabar almashish tajribasi qanday bo'lishi kerakligini qayta belgilab berdi. Telegram uchun navbatdagi qadam - bu xabar almashishdan tashqariga chiqish va umuman, ijtimoiy tarmoqlarda innovatsiyalarni rivojlantirish. Biz mashhurligimizdan milliardlab odamlarning hayotini yaxshi tomonga o'zgartirish, sayyoramizdagi odamlarni ilhomlantirish va ko'tarish uchun foydalanishimiz kerak. Bugungi kunda barcha foydalanuvchilar uchun hikoyalarning bosqichma-bosqich chiqarilishi Telegram tarixidagi ushbu yangi bosqichning boshlanishini anglatadi. O'tgan o'n yillik hayajonli bo'lsa-da, keyingi 10 yil Telegram o'zining haqiqiy salohiyatiga erishadigan vaqt bo'ladi. 🥳 #durov#telegram#10yosh ✅@TGraphUz | 📺YouTube

결과

1개의 유사한 게시물이 발견되었습니다

검색: #2bitq

当前筛选 #2bitq清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #9516 · 2026. 02. 13. PM 03:23

🌟Tencent сжали 1.8B модель в 2 бита: 600 МБ веса и Dual-CoT на борту. Tencent Hunyuan выкатили open-source решение для тех, кто хочет запускать LLM локально на кофеварке. HY-1.8B-2Bit - модель, которую утрамбовали так плотно, что она занимает меньше места, чем многие современные мобильные приложения. Модель пилили методом Quantization-Aware Training, который в отличие от PTQ, позволяет адаптироваться к низкой разрядности весов еще на этапе тренировки. За основу взяли backbone Hunyuan-1.8B-Instruct и жестко сжали веса до 2 бит. При этом эффективный размер в памяти получился эквивалентен модели на 300М параметров, а физический вес получился всего 600 МБ. Что самое ценное - сохранили фичу Dual-CoT: модель умеет переключаться между быстрым мышлением для простых тасков и глубоким long-CoT для сложных. 🟡Бенчмарки 🟢По сравнению с fp16-учителем (1.8B), деградация метрик всего ~4%. Это очень мало для 2-битного квантования. 🟢Разница в точности на сравнении с INT4 ничтожна - 0.13%, хотя весит модель в 2 раза меньше. 🟢Если взять плотную модель на 0.5B параметров, то HY-1.8B-2Bit обходит ее в среднем на 16-17%. На GSM8K разрыв вообще дикий: +22.29%. 🟢Prefill ускорился в 3-8 раз, генерация токенов - в 2-3 раза на поддерживаемом железе. 🟡Жирный нюанс Текущая реализация требует поддержки инструкций Arm SME2. Это значит, что вся эта красота заведется только на Apple M4 и MediaTek Dimensity 9500. Если у вас M1/M2 или Snapdragon прошлых поколений - пока мимо. Разработчики обещают подвезти Neon kernel позже. Кстати, GGUF тоже есть, так что если под рукой есть M4 - можно тестить. Остальным остается ждать оптимизации под старые инструкции. 🟡Модель 🟡GGUF 🟡Техотчет 🖥GitHub @ai_machinelearning_big_data #AI#ML#SLM#2bitQ#Tencent