TGTGInsightтелеграм анализLIVE / telegram public index
← Такты, стеки, два колеса

TGINSIGHT SIMILAR POSTS

Намери подобно съдържание

Изходен канал @clockstackwheels · Post #851 · 2.08

Впервые использовал нейросетку для реальной практической пользы в коммерческом заказе. У заказчика есть база данных, куда информация вносится кое-как. Представьте, что вы составляете каталог, например, книг, и в базе данных предусмотрены поля: "Автор книги", "Название книги", "Число страниц" и ещё десяток других полей с информацией. Но заполняют эту базу другие люди, которых вы не контролируете, поэтому информация может случайным образом лежать в любом произвольном поле, быть введена с ошибками, опечатками и так далее. В реальном заказе были не книги, я просто привожу пример такой же задачи. Вот как это может выглядеть: 1. В поле "Автор" написано "Лондон, Дж. Белый Клык", поле "Название" при этом пустое. 2. В поле "Название" написано "150-страничный сборник рецептов", поле "Число страниц" пустое 3. В поле "Название" написано "джеклондон мартин иден", поле с автором пустое 4. В поле "Автор" написано "150-стр.3изд,доп.перераб инструкция по пользованию подстанциями типа ТП-13, М.Васильев москва 98" ...и так далее. А нужно искать нормально по автору, названию, числу страниц, городу и году издания. Никакими прямыми алгоритмами это не берётся: регулярки, поиск по ключевым словам, морфология, нечёткая логика — всё это либо даёт много ложноположительных результатов, либо (если подкрутить пороговые значения) вообще перестаёт искать. И вот тут в какой-то момент мы решили попробовать запрашивать через API GPT. Нейросетке задаётся следующий промт: "Есть следующая информация: «150-страничный роман джеклондон мартин иден». Если здесь есть то, что похоже на имя автора книги, напиши мне его, иначе ответь null". И, надо сказать, даже 3.5 справляется с этой работой очень хорошо. Получилось сравнительно без ошибок разметить около 80% данных (остальные с ошибками даже после нейросетки). Но, важный нюанс. Сначала мы пытались поймать все данные одним запросом: "GPT, выведи мне JSON, в котором есть автор, название, число страниц...", но тесты показали, что значительно эффективнее будет отдельно спросить 5 раз про 5 разных типов данных. Да, это расходует больше токенов, но они и так сравнительно дёшевы. Кстати, API у OpenAI безбожно глючит даже на платном тарифе. Обещанных 3500 запросов в минуту нет даже приблизительно. По факту удаётся отправлять около 200-300 запросов в минуту, потом оно вываливается в таймауты или ошибку 429, нужно делать какие-то умные паузы, ждать итд. Над этим всем пришлось повозиться, зато результат вполне ощутимый. #dev

Hashtags

Резултати

Намерени 3 подобни публикации

Търсене: #downstream

当前筛选 #downstream清除筛选

🚢Orlen превзошла ожидания по EBITDA на фоне сильной переработки. Польская энергетическая группа Orlen опубликовала квартальные результаты: скорректированная EBITDA LIFO составила PLN 12,15 млрд ($3,4 млрд), превысив консенсус (PLN 11,4 млрд) несмотря на снижение на 15% г/г. Поддержку обеспечил сильный downstream-сегмент (переработка и нефтехимия) на фоне благоприятной маржинальной среды. Чистая прибыль за квартал — PLN 3,13 млрд, ниже ожиданий (PLN 4,8 млрд) из-за обесценивания активов на PLN 3,34 млрд, включая PLN 2,2 млрд в downstream (переработка, нефтехимия и «новая химия»). Влияние оказали и более низкие цены на нефть и газ. Компания анонсировала капвложения PLN 36,3 млрд в 2026 году (против PLN 32,6 млрд годом ранее). Среди ключевых проектов — первая офшорная ВЭС Польши в Балтийском море и газовая электростанция в Грудзёндзе. 📌Orlen основана в 1999 году (консолидация польских НПЗ). Компания публичная (WSE); контрольный пакет принадлежит государству Польша через Министерство государственных активов. #energy#refining#Poland#downstream#Orlen

Venture Village Wall 🦄

@venturevillagewall · Post #3618 · 21.12.2024 г., 10:22

New Wave Biotech Secures $1.25M Investment New Wave Biotech has raised $1.25M to enhance its Bioprocess Foresight software, which aids biomanufacturing innovations in scaling processes, accelerating commercialization, and promoting sustainability. The software offers bioprocess modeling, operation simulations, and economic analysis tools to optimize biomanufacturing efficiency and sustainability. Learn more at New Wave Biotech. #Biotech#Funding#Bioprocessing#Sustainability#Software#Investment#SupplyChain#Innovation#TechAnalysis#Manufacturing#Commercialization#Scale#AnalysisTools#ProcessModeling#Downstream#TechEconomic#ProcessOptimization#GlobalSupplyChain

Меньше месяца остается до начала проведения Конгресса РНТК 2024. Российский нефтегазовый технический конгресс (Конгресс РНТК 2024) состоится в Москве 29 - 31 октября 2024 года. Конгресс РНТК является продолжателем традиций Российской нефтегазовой технической конференции, которая ежегодно проводилась в октябре в течение 17 лет. Сегодня Конгресс заслуженно является значимым событием для порядка 400 профессионалов нефтегазовой отрасли. В 2024 году на его платформе запланировано проведение ряда пленарных заседаний, круглых столов, 26 технических сессий. Прозвучат более 150 докладов. Программа включает в себя разнообразные темы: проектирование и разработка месторождений, строительство скважин, МУН, интенсификация добычи, цифровые технологии, моделирование и другие. Часть работы Конгресса РНТК 2024 года будет связана с новыми направлениями, перспективами декарбонизации и развитием альтернативной энергетики. В ходе работы Конгресса РНТК 2024 предусмотрена выездная сессия на ведущие предприятия отрасли на территории Москвы и Московской области. С площадок мероприятия будет вестись веб-трансляция. Подробнее о Конгрессе РНТК 2024 на www.rntk.org, https://vk.com/rntkcongress, https://t.me/rntk_congress #рнтк#rntk#нефть#газ#нефтегазовый#месторождение#шельф#бурение#добыча#нефтепродукты#нефтесервис#технология#проектирование#инжиниринг#нефтепровод#газопровод#инфраструктура#oil#gas#offshore#drilling#infrastructure#downstream#midstream#upstream