@repo_science · Post #4071 · 19.03.2024 г., 15:19
#webScraping#Python 🕷 Web Scraping with Python: Data Extraction from the Modern Web, 3rd Edition ✏️Ryan Mitchell ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
Hashtags
TGINSIGHT SIMILAR POSTS
Изходен канал @clockstackwheels · Post #356 · 24.05
Некоторые нашли ответ на вчерашнюю загадку: это последовательность животных из песни What Does The Fox Say. И это породило интересное обсуждение здесь, в Телеграме. Часть людей никогда не слышали об этой песне, что лично меня очень сильно удивило. В моём информационном пространстве она является бесспорным масс-культурным феноменом, поэтому знакомство с ней не зависит, например, от ваших музыкальных вкусов. Вам достаточно просто заходить в интернет. По аналогии с, например, Gangnam Style или Harlem Shake: для меня это вещи, которые невозможно было не застать, если вы в принципе пользовались интернетом в период их популярности. Но, как выяснилось, это совершенно не так, и люди действительно живут немножко в разных информационных слоях. Вот я и задумался: от чего это зависит? Какие источники нужно читать или не читать, чтобы ни разу не наткнуться на какой-то относительно популярный феномен, не обсудить его ни с кем из знакомых, не увидеть в ленте ни одной из соцсетей? В моих компаниях друзей, например, очень часто шутят с отсылками к масс-культуре, поэтому буквально невозможно не знать чего-то известного. Я просто не мог ничего сделать, чтобы пропустить какой-нибудь Ice Bucket Challenge, The Dress или Coffin Dance. Но как-то люди пропускают (наверняка среди читающих это есть те, кто не знает о чём-нибудь из перечисленного). И другой вопрос: что отличает масс-культурный феномен от просто очень популярной вещи? В комментариях мне справедливо заметили, что если мы откроем в Википедии топ популярных видео на YouTube, там будут ролики с миллиардами просмотров, о которых мы и не слышали. Например, я никогда не видел и не слышал детский стишок «Johny Johny Yes Papa», а ведь это топ-3 видео на YouTube за всю историю, с поразительными 6 миллиардами просмотров! Ну ладно, допустим, видео для детей нельзя считать, потому что современные родители их просто ставят младенцам по 100 раз в день, чтобы отвлечь и чем-то занять. Но, например, у песни Джастина Бибера «Sorry» более 3.5 млрд просмотров, а я её никогда не слышал. На мой взгляд произведение становится массовым, когда выходит за свои первоначальные границы. Например, если о песне знают не только те, кто в принципе слушает такую музыку и этого исполнителя. А особенно если песня вообще выходит за рамки музыкальной сферы. Например, по песне про лису писали научпоп-статьи о том, какой звук издают лисы. Челлендж Ice Bucket выполняли люди, которые никакого отношения не имеют к медицине или благотворительности. Танец Harlem Shake исполняли люди в военных частях, офисах, в Кембриджском университете. Для меня именно проникновение в нейтральную среду — основной признак. #web
Hashtags
Търсене: #webscraping
@repo_science · Post #4071 · 19.03.2024 г., 15:19
#webScraping#Python 🕷 Web Scraping with Python: Data Extraction from the Modern Web, 3rd Edition ✏️Ryan Mitchell ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
Hashtags
@repo_science · Post #3543 · 29.08.2023 г., 02:03
#Python#webscraping 😎 Automate the Boring Stuff with Python Programming Automate the Boring Stuff with Python was written for people who want to get up to speed writing small programs that do practical tasks as soon as possible. You don’t need to know sorting algorithms or object-oriented programming, so this course skips all the computer science and concentrates on writing code that gets stuff done. - Web scraping - Parsing PDFs and Excel spreadsheets - Automating the keyboard and mouse - Sending emails and texts - And several other practical topics ⚖️10.5 GB 🔗Link ----- Main channel:@repo_science Coupons: @freecoupons_reposcience -----
Hashtags
@repo_science · Post #3215 · 22.05.2023 г., 15:31
#python#webScraping 🐍 Scrapy masterclass: Python web scraping and data pipelines Work on 7 real-world web-scraping projects using Scrapy, Splash, and Selenium. Build data pipelines locally and on AWS 🔗Link ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
Hashtags
@repo_science · Post #3207 · 21.05.2023 г., 02:35
#python#webScraping 🐍 Curso de Python desde ceroorientado a web Scraping 📢#youtube ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
Hashtags
@repo_science · Post #3217 · 23.05.2023 г., 15:49
#webScraping El #UserAgent, o Agente de Usuario en español, es una cadena de texto que identifica el navegador web o la aplicación que se utiliza para acceder a un sitio web. Esta cadena se envía al servidor web en cada solicitud y puede contener información sobre el sistema operativo, el navegador web, la versión del navegador y los complementos utilizados. La información obtenida también puede utilizarse para optimizar la experiencia del usuario, por ejemplo, sirviendo contenido diseñado para funcionar mejor en un dispositivo móvil en lugar de una computadora portátil. Por otro lado, los webmasters pueden usar la información del user agent para verificar el reconocimiento de bots, para bloquear bots no deseados, o para algo como un análisis cruzado de usuarios o un análisis de la audiencia del sitio web. A continuación les dejamos una listado extenso de users-agents👇 🔗Lista de users-agents ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
Hashtags
@repo_science · Post #3180 · 12.05.2023 г., 19:53
#webScraping#Python#Scrapy 🐍 Scrapy course - Python web scraping for beginners The Scrapy #Beginners Course will teach you everything you need to learn to start scraping websites at scale using #Python Scrapy. Topics - Creating your first #Scrapy spider - #Crawling through websites & scraping data from each page - Cleaning data with Items & Item Pipelines - Saving data to CSV files, #MySQL & #Postgres#databases - Using fake #user-agents & headers to avoid getting blocked - Using #proxies to scale up your web scraping without getting banned - Deploying your #scraper to the cloud & scheduling it to run periodically 🗣️ Joe Kearney. 🔗Link 📢#youtube ⭐️ Resources ⭐️ Course Resources - Scrapy Docs - Course Guide - Course Github - The Python Scrapy Playbook ----- Main channel: @repo_science Coupons: @freecoupons_reposcience -----
@githubtrending · Post #15520 · 24.02.2026 г., 14:30
#python#ai#ai_scraping#automation#crawler#crawling#crawling_python#data#data_extraction#mcp#mcp_server#playwright#python#scraping#selectors#stealth#web_scraper#web_scraping#web_scraping_python#webscraping#xpath Scrapling is a fast Python web scraping tool that fetches pages, bypasses anti-bot blocks like Cloudflare, and adapts to site changes by auto-finding elements. Use simple CSS/XPath selectors, spiders for big crawls with pause/resume, proxy rotation, and CLI—no code needed sometimes. Install via pip; it's memory-light and beats others in speed. You save time fixing broken scrapers, scrape reliably at scale, cut costs with AI tools, and focus on using data for leads, prices, or research. https://github.com/D4Vinci/Scrapling