TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #239 · 3.03

Сервисы вопросники вроде TheQuestion и Яндекс.Кью не слишком честно обращаются с экспертами. Вот ты регистрируешься как, например, программист. Тебе там сразу рассказывают о том, как много людей ждёт именно твоих ответов на их вопросы. «Наконец-то я смогу поделиться своими знаниями с миром!» — думаешь ты. На деле большинство вопросов (по крайней мере по программированию) делятся на два вида: 1. Какая-то абсолютно невежественная дичь, типа «Как взломать QR код с помощью логарифмов?» 2. Вопрос связанный с очень узкой конкретной задачей на конкретных данных спрашивающего. Всё бы хорошо, но чаще всего вопрос сформулирован очень плохо, потому что это чьё-то домашнее задание или студенческая работа. Нередко спрашивающий хочет сойти за умного и просто нагромождает термины без нужного контекста, типа «Как обрезать дерево решений?» (и всё, больше никаких подробностей в вопросе). В итоге настоящего «Поделиться знаниями» так и не происходит. Я вот получил ещё в прошлом году статус эксперта на Кью, и забил. Вопросы очень скучные. #web

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #fp8

当前筛选 #fp8清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8721 · 08.10.2025 г., 18:50

✔️Ling-1T - новая модель от inclusionAI с 1 триллионом параметров Модель на 1 трлн, из них ≈ 50 млрд активны на токен (MoE-архитектура). Она обучена на 20 трлн+ токенов, специально отобранных для задач логического мышления и рассуждений. Контекст: 128 000 токенов. Построена на базе Evo-CoT (Evolutionary Chain of Thought) и Linguistics-Unit RL - нового метода обучения для масштабируемых рассуждений. При помощи Evo-CoT модель постепенно улучшает баланс между точностью рассуждений и вычислительной эффективностью. То есть с каждым шагом она пытается делать рассуждения «глубже», но не слишком дорого по ресурсам. Моделька демонстрирует сильные результаты в задачах кода, математики, логики и фронтенд-генерации. В архитектуре задействованы Mixture-of-Experts (1/32 активация), MTP слои и маршрутизация экспертов. Ling-1T показывает, что огромные модели можно сделать не только мощными, но и экономичными. https://huggingface.co/inclusionAI/Ling-1T @ai_machinelearning_big_data #Ling1T#AI#ML#OpenSource#Reasoning#TrillionScale#FP8