Намери подобно съдържание

Изходен канал @clockstackwheels · Post #128 · 2.01

Стоило написать личный пост — минус один подписчик. Похоже, основная проблема в том, что люди, проголосовавшие за личный блог, не станут отписываться от технического. А вот наоборот — станут. Но пофигу. Мне давали разные советы, но у них было одно общее: рекомендовали писать чаще. Так что объявляю себе челлендж: пост каждый день. Буду дублировать ВКонтакте и в Телеграме. В общем, я вас задолбаю постами, лучше сразу отписывайтесь. 365 дней - 365 постов (или больше). При этом имеется ввиду бытовой день, а не астрономический — то есть в моем случае промежуток с 5:00 до 5:00, так что этот пост за 1 января. На текущий момент ВКонтакте 5791 подписчик. В среднем у поста там пара десятков комментариев и полсотни-сотня лайков. В Телеграме 224 подписчика, и у поста в среднем до десяти комментариев, то есть активность в 3-5 раз ниже. Моя цель посмотреть: 1. Влияет ли на прирост или убыль подписчиков частота постинга в Телеграме. 2. Было ли ошибочным решение вести канал как личный, а не тематический. 3. Что произойдет с активностью людей ВКонтакте от увеличения частоты постинга. Через год посмотрим. #web#life

Hashtags

#web #life

Резултати

Намерени 1 подобни публикации

Търсене: #efficientmodels

当前筛选 #efficientmodels清除筛选

Machinelearning

@ai_machinelearning_big_data · Post #8519 · 11.09.2025 г., 18:21

Намери подобни Прегледай

🚀 Релиз:Qwen3-Next-80B-A3B - эффективная модель заточенная на работа работу с очень длинным контекстом! 🔹80B параметров, но активируется только 3B на токен → тренировка и инференс 10x дешевле и быстрее, чем у Qwen3-32B (особенно при 32K+ контексте). 🔹Гибридная архитектура: Gated DeltaNet + Gated Attention → сочетает скорость и точность. 🔹Ultra-sparse MoE: 512 экспертов, маршрутизируется 10 + 1 общий. 🔹Multi-Token Prediction → ускоренное speculative decoding. 🔹 По производительности обходит Qwen3-32B и приближается к Qwen3-235B в рассуждениях и long-context задачах. 🟢Qwen3-Next-80B-A3B-Instruct показатели почти на уровне 235B flagship. 🟢Qwen3-Next-80B-A3B-Thinking превосходит Gemini-2.5-Flash-Thinking. ▪Попробовать: https://chat.qwen.ai ▪Анонс: https://qwen.ai/blog?id=4074cca80393150c248e508aa62983f9cb7d27cd&from=research.latest-advancements-list ▪ HuggingFace: https://huggingface.co/collections/Qwen/qwen3-next-68c25fd6838e585db8eeea9d ▪ ModelScope: https://modelscope.cn/collections/Qwen3-Next-c314f23bd0264a ▪Kaggle: https://kaggle.com/models/qwen-lm/qwen3-next-80b ▪ Alibaba Cloud API: https://alibabacloud.com/help/en/model-studio/models#c5414da58bjgj @ai_machinelearning_big_data #AI#LLM#Qwen#DeepLearning#MoE#EfficientModels#LongContext#Reasonin

Hashtags

#ai #llm #qwen #deeplearning #moe #efficientmodels #longcontext #reasonin