TGTGInsighttelegram intelligenceLIVE / telegram public index
← GZ学习频道

TGINSIGHT SIMILAR POSTS

Find similar content

Source channel @olddriverGDstudy · Post #29 · Mar 17

搜索使用说明 #搜索指南 因为电报软件对中文搜索支持不好,大队特别对队内资源搜索进行了整理汇集,使用方法说明如下: 1.1 原理: 电报对中文搜索支持不佳,汉字只有在前后含有asic码字符的前提下可以被正确搜索出,如 _广州修车大队_ (“_”指代空格)、(广州修车大队);等形式可以搜索“广州修车大队”搜索出相关信息;搜索“广州”等未被asic码间隔的汉字无法正确显示。 为正确搜索,在编制频道资源时,对重要信息可以采取Hashtag的形式已方便搜索,即以"#"字符开头,接汉字,以“空格字符”结尾的形式,点击一个hashtag即可快速定位该频道或聊天群内所有相同标签,建议所有管理在编辑重要资料包括ls信息、广播台、学习频道时正确使用hashtag。 !!注意标签不要随意编写,要参考搜索指南中有的标签类型!! 1.2 JS资源定位: JS目前支持 Hasgtag(#K老师)、数字标签(#GZ003)的搜索方式,在对应榜单和报告区中试用上述方式均可查找到JS的相关信息。 使用举例:在“广州公开榜”或“广州修车大队”的搜索栏中输入 #K老师 或 #GZ003,均可定位到K老师资料页;在报告区的搜索栏中输入#K老师 或 #GZ003,均可定位到K老师的验证报告。这两者是快速了解JS基本信息和评价的便捷办法。 1.3 标签查找 公榜榜单目前均支持标签查找,可以快速定位某种类型或地区的所有JS,目前仅支持Hashtag查找,目前常用标签解释如下: 地区标签: 一定要使用一级标签,例如 #天河区(注意不要有错别字) #颜值: 不解释 #服务: 评价中92、95的,有场子出身花式水平的,均会归入此类; #大胸: 不解释,一般D以上归入此类; #长腿: 不解释,一般168以上归入此类; #身材: 不解释,较为宽松; #嫩妹: 22岁以下或者长相很嫩的,白小纯的,loli系的,cos系的归入此类; #熟女: 30岁以上风韵犹存的,归入此类; #特服: 提供3p、3t、wt、字母等特殊服务的JS归入此类。 使用举例:在红榜的搜索栏中输入 #长腿,可以快速查看“莉贝伦”等8位长腿JS。 类型标签评价目前非常主观,有不妥之处请队内私信 JackJack 或其他管理人员修改。 1.4 资料查找 目前学习频道中试用hashtag来快速定位资料,目前使用的标签有如下几种: #安全CJ#素质CJ#卫生CJ #搜索指南 #大队玩法 #语录#秀哥语录 #技巧#知识

Results

1 similar post found

Search: #activelearning

当前筛选 #activelearning清除筛选
Machinelearning

@ai_machinelearning_big_data · Post #8234 · 08/08/2025, 10:01 AM

🚀Прорыв от Google: активное обучение с экономией данных на 10 000× при дообучении LLM Google разработала масштабируемый процесс *active learning*, который позволяет в десятки тысяч раз сократить объём размеченных данных, необходимых для тонкой настройки больших языковых моделей на сложных задачах — например, при модерации рекламного контента. 🟢 Как работает метод: 1. Стартовая модель (LLM-0) получает промпт и автоматически размечает огромный массив данных. 2. Кластеризация выявляет примеры, где модель путается (наиболее спорные и ценные для обучения). 3. Отбор данных: из этих кластеров выбирают информативные и разнообразные примеры. 4. Экспертная разметка — только для выбранных примеров. 5. Итерации: дообучение модели → новый отбор спорных примеров → разметка → снова обучение. 🟢Результаты: - Сокращение с 100 000 размеченных примеров до менее 500 при сохранении или улучшении качества. - Улучшение метрики *Cohen’s Kappa* на 55–65 %. - В больших продакшн-моделях — до 3–4 порядков меньше данных при сопоставимом или лучшем качестве. 🟢Что такое Cohen’s Kappa? Это метрика, которая показывает, насколько два "судьи" (например, эксперт и модель) согласны между собой с поправкой на случайные совпадения. - 0.0 — нет согласия (или хуже случайного) - 0.41–0.60 — умеренное согласие - 0.61–0.80 — значительное - 0.81–1.00 — почти полное согласие В задачах с дисбалансом классов Kappa даёт более честную оценку, чем обычная точность (accuracy). Чем лучше предыдущих методов: - Точечная разметка: размечаются только самые информативные примеры. - Масштабируемость: метод применим к наборам данных с сотнями миллиардов примеров. - Экономия ресурсов: меньше времени и затрат на разметку. - Быстрая адаптация: подходит для доменов с быстро меняющимися правилами (реклама, модерация, безопасность). 🟢Вывод: При умном отборе данных LLM можно адаптировать в тысячи раз быстрее и дешевле, чем при традиционном обучении на больших размеченных наборах. #GoogleResearch#ActiveLearning#AI#LLM#MachineLearning#DataEfficiency 🟠Почитать подробно @ai_machinelearning_big_data #GoogleResearch#ActiveLearning#AI#LLM#MachineLearning#DataEfficiency