TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #421 · 4.07

Если вовремя остановиться и надеть дождевик, то даже поездка под дождём не так страшна. Особенно на трицикле, который не боится скользкой дороги. Доехали до Петрозаводска за полдня и дальше гуляли тут. Петрозаводск я вам уже показывал в одном из предыдущих путешествий, так что фоток не будет (но видео будет в фильме, который я сделаю по возвращении). Только одно новое: до этого был в Петрозаводске своим ходом и не замечал, что здесь нет разметки на многополосных дорогах, кроме разве что самых основных. Разметка просто не нарисована, хотя знаки о многополосности висят, а там понимай, как знаешь. По пути встретили другую группу из троих мотопутешественников, которые то обгоняли нас, то отставали. Тоже вот ребята поехали по Карелии. Ну и, конечно, большой привет всем водителям, которые по трассе с одной полосой в каждую сторону вне населенных пунктов едут 60-80 км/ч и собирают за собой огромную вереницу других транспортных средств. Интересно, о чем они думают, глядя в зеркала. Завтра самый сложный участок, но должен быть классный контент, stay tuned. #travel

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #speculativedecoding

当前筛选 #speculativedecoding清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8524 · 12.09.2025 г., 11:00

⚡Speculative Cascades — как ускорить работу LLM Google Research придумали новый способ сделать большие языковые модели быстрее и дешевле. Что это такое: 🔹Каскады Сначала отвечает маленькая модель. Если задача слишком сложная - подключается большая. Так экономятся ресурсы, но качество может прыгать. 🔹Спекулятивная декодировка Маленькая модель угадывает сразу несколько слов вперёд. Большая быстро проверяет данные и подтверждает. Скорость выше, но большая модель всё равно тратит много ресурсов. 🟢Speculative Cascades Это комбинация: маленькая модель иногда отвечает полностью сама, а иногда используется как ускоритель для большой. В итоге получаем меньше затрат, больше скорости и то же качество. 🔥Что показали тесты (тестили на Gemma, T5): - быстрее, чем обычная спекулятивная декодировка - дешевле и качественнее, чем каскады - удобнее настраивать баланс «скорость ↔ качество» При том же уровне качества, что и у спекулятивной декодировки, новый метод работает быстрее (генерирует больше токенов за один вызов большой модели). А в задачах математических рассуждений получен явный апгрейд по скорости при сохранении или даже улучшении качества. LLM всё чаще используются в поиске, чатах, ассистентах. Чтобы они реально были полезными, их нужно ускорять и удешевлять. *Speculative cascades* помогают это сделать без потери качества. 🔗Подробнее: https://research.google/blog/speculative-cascades-a-hybrid-approach-for-smarter-faster-llm-inference/ @ai_machinelearning_big_data #AI#LLM#Inference#SpeculativeDecoding#Cascades#GoogleResearch