TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #441 · 9.07

Раньше был Букинг для аренды отелей, а теперь Островок и похожие сервисы. И там везде есть рейтинг от 0 до 10. Как я понимаю, на рейтинг сильно смотрят, когда принимают решение, какой отель взять. Ну я вот точно смотрю. По пути туда в Петрозаводске мы останавливались в Piter Inn — крутой топовый отель за много денег. У него был ожидаемо высокий рейтинг, и он этот рейтинг оправдывает. По пути обратно мы, как вы знаете, остановились нештатно. Крутые отели были заняты, и пришлось взять дешёвый. Он был ожидаемо убогонький по обстановке и оснащению, с низким рейтингом. Однако, персонал в последнем отеле общался с нами очень вежливо и выполнил нестандартные просьбы, бельё было чистое, вообще никаких претензий у нас не возникло. И я вот подумал: в рамках своей цены дешёвый отель тоже себя полностью оправдывает. Он просто существует в другом классе — дешёвые номера, чтобы быстро переночевать. Но внутри своего класса он справляется хорошо. Должен ли у него быть ниже рейтинг? С одной стороны вроде да, ведь рейтинг используется для сравнения отелей между собой, и дешёвый точно проигрывает дорогому по всем параметрам, кроме цены. С другой стороны, если у нас рейтинговая шкала абсолютная, то как вообще награждать и продвигать хорошие вещи в более дешёвых классах? Тогда 9-10 будет только у супер дорогих, а что-то попроще — даже образцовое — упрется в потолок. В такси же в экономе у водителя может быть 5 звёзд, если машина чистая, а сам он аккуратно водит. #life

Hashtags

Резултати

Намерени 1 подобни публикации

Търсене: #rrncb

当前筛选 #rrncb清除筛选

🚀 20 августа 2025 Стартует RRNCB – Russian RAG Normative – Corporate Benchmark, первый российский открытый бенчмарк для оценки RAG-решений при работе с нормативной, правовой и технической документацией компаний. Почему это важно? ✅ На рынке десятки RAG-решений, но нет методики и инструмента оценки и сопоставления характеристик RAG сервисов, оценить их качество очень трудно. ✅RRNCB – это первый продуктовый бенчмарк, цель которого провести комплексную оценку Retrieval augmented generation продуктов для работы с корпоративной и технической документацией. ✅ Специально создан для оценки систем, работающих с русскоязычными нормативами, кодексами, ГОСТами и корпоративными документами. ✅ Открытость и прозрачность: методики оценки и данные будут в открытом доступе. Сравнение проходит по ключевым метрикам (ROUGE, LLM-судья, скорость, качество уточняющих вопросов). Участие. 📋Приглашаем ИИ компании к участию в бенчмарке RRNCB со своими RAG-решениями и продуктами. Заполните заявку на участие. В вашем распоряжении будут: • Независимый лидерборд. • Управление сабмитами. • Возможность тестировать сабмиты до отправки в лидерборд. • Разделение сабмитов на категории cloud и on-prem. 🗓Даты проведения: Запуск: 20 августа Регистрация RAG решений участников: до 3го сентября Результаты: 20 сентября. Почему стоит участвовать. • Участие в открытом бенчмарке — это стратегическая инвестиция для владельца продукта. Вы перестаете просто говорить, что ваш продукт «лучший». Вы доказываете это на объективных метриках в сложных, приближенных к реальности условиях. Это самый мощный аргумент для сомневающихся клиентов, который резко повышает доверие. • Попадание в топ лидерборда — это готовый повод для PR. • Реальные запросы и строгая оценка бенчмарка действуют как мощный стресс-тест. Выявляются проблемы, которые можно было не заметить на внутренних тестах. • Результаты бенчмарка — это не просто цифры, а конкретные данные для вашей R&D-команды. • Экономия ресурсов на собственном тестировании. Бенчмарк предоставляет инфраструктуру и датасеты готовыми, вместе с продуманной методологией оценки. Подробнее о бенчмарке:https://fractalagents.ai/rrncb-rag-benchmark/ Инициатор проведения бенчмарка - ООО Аватар Машина. #RAG#AI#RRNCB#Benchmark#ИскусственныйИнтеллект#OpenSource