TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #851 · 2.08

Впервые использовал нейросетку для реальной практической пользы в коммерческом заказе. У заказчика есть база данных, куда информация вносится кое-как. Представьте, что вы составляете каталог, например, книг, и в базе данных предусмотрены поля: "Автор книги", "Название книги", "Число страниц" и ещё десяток других полей с информацией. Но заполняют эту базу другие люди, которых вы не контролируете, поэтому информация может случайным образом лежать в любом произвольном поле, быть введена с ошибками, опечатками и так далее. В реальном заказе были не книги, я просто привожу пример такой же задачи. Вот как это может выглядеть: 1. В поле "Автор" написано "Лондон, Дж. Белый Клык", поле "Название" при этом пустое. 2. В поле "Название" написано "150-страничный сборник рецептов", поле "Число страниц" пустое 3. В поле "Название" написано "джеклондон мартин иден", поле с автором пустое 4. В поле "Автор" написано "150-стр.3изд,доп.перераб инструкция по пользованию подстанциями типа ТП-13, М.Васильев москва 98" ...и так далее. А нужно искать нормально по автору, названию, числу страниц, городу и году издания. Никакими прямыми алгоритмами это не берётся: регулярки, поиск по ключевым словам, морфология, нечёткая логика — всё это либо даёт много ложноположительных результатов, либо (если подкрутить пороговые значения) вообще перестаёт искать. И вот тут в какой-то момент мы решили попробовать запрашивать через API GPT. Нейросетке задаётся следующий промт: "Есть следующая информация: «150-страничный роман джеклондон мартин иден». Если здесь есть то, что похоже на имя автора книги, напиши мне его, иначе ответь null". И, надо сказать, даже 3.5 справляется с этой работой очень хорошо. Получилось сравнительно без ошибок разметить около 80% данных (остальные с ошибками даже после нейросетки). Но, важный нюанс. Сначала мы пытались поймать все данные одним запросом: "GPT, выведи мне JSON, в котором есть автор, название, число страниц...", но тесты показали, что значительно эффективнее будет отдельно спросить 5 раз про 5 разных типов данных. Да, это расходует больше токенов, но они и так сравнительно дёшевы. Кстати, API у OpenAI безбожно глючит даже на платном тарифе. Обещанных 3500 запросов в минуту нет даже приблизительно. По факту удаётся отправлять около 200-300 запросов в минуту, потом оно вываливается в таймауты или ошибку 429, нужно делать какие-то умные паузы, ждать итд. Над этим всем пришлось повозиться, зато результат вполне ощутимый. #dev

Hashtags

Резултати

Намерени 771 подобни публикации

Търсене: #breaking

当前筛选 #breaking清除筛选

#BREAKING | 🇺🇸🇮🇷 — El senador estadounidense Lindsey Graham sobre Irán: Mañana a esta hora, o bien [el régimen iraní] hará un acuerdo que tenga sentido para el mundo, la región y para el propio Irán, o los haremos explotar.

Hashtags

FG - Freie Gedanken 🦁

@FGNews07 · Post #81069 · 02.03.2026 г., 17:28

#BREAKING Frankreich hat eine Aufstockung seiner Atomwaffen angekündigt. Der Präsident des Landes erklärte: „Von nun an werden wir niemandem mehr die Anzahl unserer Atomwaffen mitteilen.“ *** Das Wettrüsten in Europa wird mit neuer Kraft beginnen. (ahn) t.me/FGNews07

Hashtags

FG - Freie Gedanken 🦁

@FGNews07 · Post #80961 · 28.02.2026 г., 22:15

#BREAKING Berichten zufolge hat eine iranische Drohne das Fünf-Sterne-Hotel Burj Al Arab in Dubai, Vereinigte Arabische Emirate, getroffen. Der 321 Meter hohe Turm mit 60 Stockwerken steht auf einer künstlichen Insel. IRGC: Der US-Marinestützpunkt in Kuwait wurde von 4 Raketen und 12 iranischen Drohnen getroffen. Bei unserem Angriff auf den US-Marinestützpunkt in Kuwait wurden mehrere amerikanische Soldaten getötet und verwundet. t.me/FGNews07

Hashtags

Selena - News and Updates

@selena_updates · Post #61906 · 15.04.2026 г., 15:10

#BREAKING | 🇬🇧 — The BBC is set to cut up to 2,000 jobs — approximately 10% of its workforce — in its largest round of redundancies in 15 years. Staff were briefed on the proposals today as part of a major cost-saving drive ahead of Matt Brittin’s takeover as Director-General next month. The move aims to address ongoing financial pressures on the public broadcaster. The Global Eye | Subscribe

Hashtags

Selena - News and Updates

@selena_updates · Post #61621 · 11.04.2026 г., 18:50

#BREAKING | 🇮🇷🇺🇸 — Iran has installed makeshift roadblocks—including earthen berms, fences, rubble piles, and other barriers—in front of the three tunnel entrances to its underground nuclear complex at Isfahan. According to new satellite imagery analyzed by the Institute for Science and International Security (ISIS), the measures appear intended to hinder any potential ground operation aimed at seizing Iran's stockpile of highly enriched uranium stored at the site. The Global Eye | Subscribe

Hashtags

Selena - News and Updates

@selena_updates · Post #61466 · 10.04.2026 г., 05:58

#BREAKING | 🇺🇸 — U.S. President Donald Trump calls Alex Jones, Tucker Carlson, Candace Owens and Megyn Kelly, "Low IQ... stupid people... nobody cares about them, they’re NUT JOBS, TROUBLEMAKERS." The Global Eye | Subscribe

Hashtags

ESPN FC

@BorussiaDortmund · Post #61369 · 01.05.2026 г., 03:27

#BREAKING: Jurgen Klopp is not a candidate for the Real Madrid job. ⚪❌ The coach is waiting for the German national team. Until then, his role will continue as sporting director of the Red Bull group. [diarioas]

Hashtags

Selena - News and Updates

@selena_updates · Post #61298 · 08.04.2026 г., 11:19

#BREAKING | 🇮🇷🇺🇸🇵🇰 — Iran's Farsi-language version of its proposed 10-point ceasefire plan includes a reference to “acceptance of enrichment” for its nuclear program, a phrase absent from the English versions shared by Iranian diplomats with journalists. The Global Eye | Subscribe

Hashtags

123•••5•••10•••15•••20•••25•••30•••35•••40•••45•••50•••55•••60•••6465
ПредишнаСтр. 1 от 65Следваща