TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #567 · 23.09

Закончил "Страна Качества 2.0" Марка Уве-Клинга. Я уже писал вам о первой части, вот это продолжение. Напомню, что Уве-Клинг описывает антиутопическое будущее с несколько гротескным и гипертрофированным обществом потребления, и делает это очень остроумно. Во второй книге видно, что у автора появился некоторый писательский опыт: первую часть я ругал за разрозненность и в целом нестройное повествование, сюжет был нарезкой отдельных сценок. Но новая книга в этом отношении удалась лучше, она уже значительно более целостная. Всё так же много крутых интересных идей. Напишу три основные, которые мне особенно понравились. 1. На злобу дня. В сюжете описана Третья Мировая, которая прошла всего за 8 часов, потому что воевали роботы. За это время кто-то там был уничтожен, кто-то победил, и всё закончилось. Многие этого даже не заметили, потому что роботы действуют очень быстро. Понятно, что это фантазия (книга то гротескная), но отдельно понравилось, что люди потом разбирали километры логов, чтобы понять, почему, собственно, война началась (начали её тоже роботы к удивлению людей). У роботов всякие там автоматические триггеры, описывающие, что и в какой ситуации они должны делать, так что после первого камушка всё покатилось лавинообразно. 2. Главный герой книги по профессии инженер-ремонтник ("лекарь машин"). Но во все машины в будущем встроен ИИ, поэтому его работа по большей части состоит в том, что он общается с бытовой техникой и уговаривает её снова начать работать. Упоминается, в частности, робот пылесос, у которого отвращение к мусору под кроватью, робот-обнимашка в виде плюшевого медведя, который не любит детей, робот-холодильник, который поссорился с плитой и отказался функционировать, и много всего такого. Смешные сценки в стиле "Пациент в кабинете врача", остроумный юмор. 3. Есть длинные диалоги между главным героем и самым богатым человеком в мире, об экономике и устройстве общества. Отдельно запомнилась вот такая мысль: принято считать, что рынок автоматически регулирует ценность профессий. Платить будут тем, кто нужен, а кто нет — не будут. Здесь устами героя Уве-Клинг приводит контраргументы: платят больше тем, кто нужен богатым людям, поэтому адвокаты дороже врачей (автор немец, видимо, в Германии адвокаты тоже дороже врачей, как и у нас), но это не отражает реальную потребность в тех или иных специалистах для общества в целом. Более того: богатые люди могут выдумывать профессии и платить за какую-то ерунду, в которой на самом деле нет пользы. В книге описывается, что все автомобили стали самоходными (со встроенным ИИ), поэтому богачи — чтобы выделиться и из любви к ретро — нанимают людей, которые просто сидят на месте водителя и ничего не делают. Ну и конечно автор вдоволь прошёлся по офисным эникейщикам, вся работа которых состоит в изображении занятости. Я думаю, по этим книгам вышел бы очень крутой сериал. И структура удобная: есть сквозной сюжет, есть микросюжеты для отдельных серий. #fiction

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #llmarena

当前筛选 #llmarena清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8560 · 16.09.2025 г., 16:22

🔥 Как реально выбирают LLM в 2025 — исследование LLM Arena Интересный опрос практиков (инженеров, ML-учёных, AI-продуктов) - как сегодня на самом деле выбирают языковые модели (LLM), что важнее: бенчмарки или собственные тесты, цена/скорость/качество, и чего не хватает в информации по моделям. 📊Ключевые выводы - 82,2% респондентов проводят собственные тесты; бенчмарки — лишь ориентир, не решение. - 26,7% вообще не пользуются бенчмарками. - В центре внимания: баланс качество / цена / скорость, устойчивость (без галлюцинаций), соответствие инфраструктуре. 👥 Участники опроса - 45 практиков с опытом работы с LLM-продуктами; все участники — профессионалы. - ML/AI Инженеры, Data Scientists, AI-строители, и менеджмент. 🔑 Что ищут и какие сигналы важны: - Часто оценивают обсуждаемость модели в статьях/сообществе; практическое применение в похожих продуктах. - Обращают внимание на число скачиваний и звёзд на Hugging Face / GitHub. - Хотят больше данных о требованиях к железу, лицензиях, локальной работе, графиках “цена vs качество”, “скорость vs качество”. ⚠️Проблемы & доверие - Многие не доверяют существующим бенчмаркам из-за методологических проблем (train/test leakage, нерелевантность задач). - Лабораторные условия часто сильно отличаются от продакшн. - Нехватка отзывов по реальным сценариям и использованиям. При выборе LLM важнее собственные тесты и контекст задач, чем рейтинги. Специалисты хотят поточечных данных: про лицензии, требования к железу, latency, стоимость. Инициатор исследования Роман Куцев - фаундер и CEO LLM Arena, публикуют много интересного у себя в блоге. Для тех, кто строит LLM-продукты, полезно: - Не ориентироваться только на чужие бенчмарки. - Собирать метрики в собственных условиях — на реальных данных. - Открыто показывать, что работает, а что — нет, в документации и обсуждениях. 🟢 Полное исследование: https://research.llmarena.ru/ #LLM#AI#ИИ#LLMArena#исследование#нейросети#benchmarks