TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #388 · 20.06

Telegram вчера запустил подписку Premium только на iOS. Это, кстати, очень любопытно: Павел Дуров вот уже несколько лет ведёт систематическую критику компании Apple, и совсем недавно высказался очередной раз. По его словам, умышленные ограничения устройств Apple и отставание от веб-стандартов создают наиболее значительное в наши дни препятствие для развития мобильного веба. А самой компании это нужно, чтобы привязывать разработчиков к магазину приложений и диктовать свои условия + брать процент от выручки. Это, конечно, совершенно верное замечание. Об индуцированном отставании мобильного веба у Apple я писал вот тут. Но вот Telegram выпускает важнейшее мажорное обновление только на айфонах. Понятно, что на Android тоже подтянут, я просто обращаю внимание на то, что лучше бы не словом, а делом. Подписку из России на айфонах, вроде как, люди могут купить, используя костыль с пополнением через мобильного оператора. На андроидах такого костыля нет, так что, скорее всего, Premium на андроиде будет для россиян недоступен (UPD в комментариях написали, что есть другой способ оплаты). Лично для меня из ценного там только десять закрепов и папка по-умолчанию, но это, кажется, не стоит ни возни с попытками оплатить, ни 449 рублей в месяц, которые за такую подписку просят. Тем не менее, идейно это правильная монетизация, в отличие от рекламы в том виде и на тех условиях, на которых она появилась. Поразмышлял о том, за какие функции в Telegram я бы всё-таки стал платить, и понял, что таких особо нет. Да, больше всего хотелось бы адекватное оформление каналов: текст во всю ширину экрана, возможность крепить картинки с хорошим UI, а не как сейчас. Вообще это, на мой личный взгляд, одна из самых серьёзных недоработок Телеграма, вызванная, как я понимаю, изначально "сообщенческой" природой каналов: канал это как бы чат с одним пишущим участником, со всеми вытекающими. Но было бы очень глупо делать такое обновление для небольшой доли донаторов, а все бесплатные каналы оставлять со старым ужасным внешним видом. Все остальные проблемы Телеграма тоже не выглядят, как опции для премиум-функций. За деньги добавляется дискавери, а без них нет? Ну тогда проще рекламную платформу в нормальный вид привести. Или, скажем, за деньги не так шакалятся фотографии? Но ведь возможность отправлять фото без сжатия уже есть бесплатно, просто это менее красиво и менее удобно. Не слишком правильно продавать за деньги понижение уровня неудобства, как я уже рассказывал. Впрочем, папка по-умолчанию это вот тоже оно самое: такая опция должна была быть изначально при появлении функциональности папок, потому что, если человек в принципе пользуется систематизацией, значит, ему внезапно нужна систематизация, и оставлять главный экран беспорядочным в таком случае неправильно, это полностью отключает смысл папок (мне вот они нужны, но по факту я ими не пользуюсь). И за деньги, как бы сказать, "включили" обратно эти папки, чтобы ими можно было пользоваться. По сути это нормально, как платная опция, но ведь по заявлениям компании папки бесплатны, а то, что пользоваться ими неудобно, это уже детали. Ну, посмотрим. Платные пользователи светятся у всех, хочу понаблюдать, купит ли хоть кто-нибудь из моих друзей подписку. #web

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #flextok

当前筛选 #flextok清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #7942 · 02.07.2025 г., 09:01

🌟 FlexTok: адаптивная 1D-токенизация изображений от Apple. FlexTok - метод токенизации изображений, который преобразует 2D-изображения в упорядоченные 1D-последовательности переменной длины. Его цель - сократить объем данных, необходимых для обучения генеративных моделей, и при этом оставить достаточную информацию для качественной реконструкции и генерации. В отличие от традиционных подходов, где число токенов фиксировано и зависит только от размера изображения, FlexTok подстраивается под сложность контента: простейшая сцена может кодироваться несколькими токенами, а сложная - десятками и сотнями . FlexTok, это по сути, пайплайн из 3 компонентов: ViT‑энкодер, квантование регистров и маскирование внимания: ViT‑энкодер с набором «регистровых» токенов читает латентные представления VAE‑GAN и конденсирует их в 1D-последовательность до 256 регистров . Затем, с помощью FSQ‑квантования, каждый регистр дискретизируется в код из заранее определенного словаря размером ~64 000. На этом этапе применяется "nested dropout": во время обучения случайно обрезаются последние токены, чтобы модель научилась упорядочивать информацию от грубых форм к деталям. Параллельно применяется авторегрессионная маска внимания: каждый токен в цепочке видит только те, что были до него, и не знает о тех, что идут после. Это заставляет модель генерировать изображения шаг за шагом, от первого токена к последнему, и упрощает ей задачу прогнозирования следующих элементов. Декодер в FlexTok - это модель rectified flow, которая на вход берет укороченные токены и слегка зашумленные латенты VAE и учится предсказывать тот шум, который нужно убрать, чтобы вернуть исходное представление. Чтобы обучение шло быстрее и давало более точные результаты, добавляют REPA‑Loss: он сравнивает промежуточные признаки с векторами из DINOv2‑L. Благодаря этому даже при очень жесткой компрессии (от 1 до 256 токенов), FlexTok успешно восстанавливает детали изображения. FlexTok легко встраивается в текстово‑ориентированные модели и может улучшить соответствие изображения описанию, даже если число токенов меняется. К тому же его адаптивная токенизация применима не только к картинкам, но и к аудио или видео. ▶️Набор токенизаторов: 🟢Flextok_d12_d12_in1k - 12\12 слоев энкодер-декодер, датасет IN1K; 🟢Flextok_d18_d18_in1k - 18\18 слоев энкодер-декодер, датасет IN1K; 🟢Flextok_d18_d28_in1k - 18\28 слоев энкодер-декодер, датасет IN1K; 🟢Flextok_d18_d28_dfm - 18\28 слоев энкодер-декодер, датасет DFN. ▶️VAE: 🟠Flextok_vae_c4 - 4 каналов латента, коэффициент понижающей дискретизации 8; 🟠Flextok_vae_c8 - 8 каналов латента, коэффициент понижающей дискретизации 8; 🟠Flextok_vae_c16 - 16 каналов латента, коэффициент понижающей дискретизации 8. 🟡Страница проекта 🟡Набор на HF 🟡Arxiv 🟡Demo 🖥GitHub @ai_machinelearning_big_data #AI#ML#Tokenizer#Flextok#Apple