TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #500 · 11.08

В ЛентеРу вышла статья о том, что ВК поставила рекорд по посещаемости и по просмотрам видеороликов. Давайте вместо разбора статьи я вам цитату из классики приведу. «Как будто в подтверждение его слов телекран у них над головами сыграл фанфару. Но на этот раз была не победа на фронте, а сообщение министерства изобилия. — Товарищи! — крикнул энергичный молодой голос. — Внимание, товарищи! Замечательные известия! Победа на производственном фронте. Итоговые сводки о производстве всех видов потребительских товаров показывают, что по сравнению с прошлым годом уровень жизни поднялся не менее чем на двадцать процентов. <...> Телекран все извергал сказочную статистику. По сравнению с прошлым годом стало больше еды, больше одежды, больше домов, больше мебели, больше кастрюль, больше топлива, больше кораблей, больше вертолетов, больше книг, больше новорожденных — всего больше, кроме болезней, преступлений и сумасшествия. С каждым годом, с каждой минутой все и вся стремительно поднималось к новым и новым высотам. <...> Завершив фанфарой сводку из министерства изобилия, телекран заиграл бравурную музыку. Парсонс от бомбардировки цифрами исполнился рассеянного энтузиазма и вынул изо рта трубку. — Да, хорошо потрудилось в нынешнем году министерство изобилия, — промолвил он и с видом знатока кивнул. — Кстати, Смит, у вас, случайно, не найдется свободного лезвия? — Ни одного, — ответил Уинстон. — Полтора месяца последним бреюсь.» Джордж Оруэлл, «1984» #web

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #smallmodel

当前筛选 #smallmodel清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8975 · 12.11.2025 г., 13:03

⭐VibeThinker-1.5B - миниатюрная модель, которая показывает SOTA-результаты в задачах рассуждения. 🚀Производительность: одна из лучших на AIME24/25 и HMMT25 - превосходит DeepSeek R1-0120 по математическим задачам и опережает модели такого же размера в соревновательном программировании. ⚡Эффективность: всего 1.5B параметров. то есть в 100–600 раз меньше, чем гиганты вроде Kimi K2 и DeepSeek R1. 💰Стоимость: полный пост-тренинг обошёлся всего в $7.8K, примерно в 30–60 раз дешевле, чем у DeepSeek R1 или MiniMax-M1. Модель основана на Spectrum-to-Signal Principle (SSP) и MGPO-фреймворке, оптимизирующих процесс рассуждения. 📦Model:https://huggingface.co/WeiboAI/VibeThinker-1.5B 💻GitHub:https://github.com/WeiboAI/VibeThinker 📄Arxiv:https://arxiv.org/abs/2511.06221 @ai_machinelearning_big_data #AI#LLM#Reasoning#OpenSource#SmallModel