TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #851 · 2.08

Впервые использовал нейросетку для реальной практической пользы в коммерческом заказе. У заказчика есть база данных, куда информация вносится кое-как. Представьте, что вы составляете каталог, например, книг, и в базе данных предусмотрены поля: "Автор книги", "Название книги", "Число страниц" и ещё десяток других полей с информацией. Но заполняют эту базу другие люди, которых вы не контролируете, поэтому информация может случайным образом лежать в любом произвольном поле, быть введена с ошибками, опечатками и так далее. В реальном заказе были не книги, я просто привожу пример такой же задачи. Вот как это может выглядеть: 1. В поле "Автор" написано "Лондон, Дж. Белый Клык", поле "Название" при этом пустое. 2. В поле "Название" написано "150-страничный сборник рецептов", поле "Число страниц" пустое 3. В поле "Название" написано "джеклондон мартин иден", поле с автором пустое 4. В поле "Автор" написано "150-стр.3изд,доп.перераб инструкция по пользованию подстанциями типа ТП-13, М.Васильев москва 98" ...и так далее. А нужно искать нормально по автору, названию, числу страниц, городу и году издания. Никакими прямыми алгоритмами это не берётся: регулярки, поиск по ключевым словам, морфология, нечёткая логика — всё это либо даёт много ложноположительных результатов, либо (если подкрутить пороговые значения) вообще перестаёт искать. И вот тут в какой-то момент мы решили попробовать запрашивать через API GPT. Нейросетке задаётся следующий промт: "Есть следующая информация: «150-страничный роман джеклондон мартин иден». Если здесь есть то, что похоже на имя автора книги, напиши мне его, иначе ответь null". И, надо сказать, даже 3.5 справляется с этой работой очень хорошо. Получилось сравнительно без ошибок разметить около 80% данных (остальные с ошибками даже после нейросетки). Но, важный нюанс. Сначала мы пытались поймать все данные одним запросом: "GPT, выведи мне JSON, в котором есть автор, название, число страниц...", но тесты показали, что значительно эффективнее будет отдельно спросить 5 раз про 5 разных типов данных. Да, это расходует больше токенов, но они и так сравнительно дёшевы. Кстати, API у OpenAI безбожно глючит даже на платном тарифе. Обещанных 3500 запросов в минуту нет даже приблизительно. По факту удаётся отправлять около 200-300 запросов в минуту, потом оно вываливается в таймауты или ошибку 429, нужно делать какие-то умные паузы, ждать итд. Над этим всем пришлось повозиться, зато результат вполне ощутимый. #dev

Hashtags

Резултати

Намерени 3 подобни публикации

Търсене: #deletefacebook

当前筛选 #deletefacebook清除筛选

ЦИТИРУЙТЕ ВЕСКО! Если уж решили цитировать, выбирайте цитату придирчиво, как картоху на базаре. Требований к добротной цитате у вас должно быть ровно две штуки - краткость и эффектность. Вот мы недавно придумывали заголовок для новости про небезызвестного Брайана Эктона, сооснователя WhatsApp, который чего-то там не поделил с Facebook, и с тех пор пишет про Цукерберга всякие гадости. Вплоть до призывов к своим подписчикам массово выпиливаться из этой соцсети. Так вот, кому "гадости", а нам - заголовочек! Правда, искали мы эту "гадость" долго. И таки нашли - оказывается, в твиттере Брайан использует некий хештег - #deletefacebook. И однажды написал такой твит: It is time. #deletefacebook. Всё, это дает нам право считать этот твит полноценным монологом нашего пациента: “It is time to delete facebook”. Осталось добавить составную часть, чтобы получился неплохой говорящий заголовок, на который хочется кликнуть: “It is time to delete facebook — личная борьба сооснователя WhatsApp".

🦅 [ perspective ix ]

@perspectiveix · Post #1232 · 30.04.2018 г., 15:00

​​📈Facebook Remains Strong Despite "Important Challenges" Despite the #CambridgeAnalytica scandal still swirling around #Facebook, resulting in a grilling at the hands of the U.S. Congress for CEO Mark Zuckerberg and the spurring on of the #DeleteFacebook movement, the company recorded strong quarterly figures for Q1 this year - including user growth. This chart concentrates on revenue and profit. Although there was a dip in revenue compared to the previous quarter, net income rose and both figures are healthily up on a year-on-year basis. 🚀@PerspectiveIX 🌀 ⁣http://prs.pctvix.co/TelegramIX

Libreware

@libreware · Post #934 · 26.04.2021 г., 21:51

NoFb Event Scraper This app scrapes Facebook event links and adds the event to your calendar https://github.com/akaessens/NoFbEventScraper https://f-droid.org/repo/com.akdev.nofbeventscraper The purpose of this application is to get access to Facebook events without an account. Therefore it does not use the Facebook API. Instead it opens the Facebook event URI and downloads the website HTML code. This source should contain the event information in form of structured data. That data is extracted and used to create Android events. Features: * Does not use Facebook API * Supports "open-with" and "share-to" * Independent from Facebook regional sub-domain URLs * Saves history of scraped events * Handles upcoming events from pages #fb#Facebook#deletefacebook 📡@libreware📡@nogoolag