Python Materials For Beginners
446 subscribers
39 photos
1 video
9 files
150 links
Download Telegram
Трохи про Rotating Proxy.
(Гадаю ця інформація буде корисна при покупці проксі для скрапінгу даних.)

По режиму керування:

1. Per-request rotation
2. Session-based rotation
3. Automated request management

За типом інфраструктури/провайдера:

1. Residential High reliability Real home IPs
2. Datacenter Fast & cost-efficient Server IPs
3. Mobile Carrier IPs Mobile-network routing
4. ISP Datacenter speed Consumer-ISP routing

#proxy

https://www.youtube.com/watch?v=YTQVusxV-Bs
Please open Telegram to view this post
VIEW IN TELEGRAM
👏1
Please open Telegram to view this post
VIEW IN TELEGRAM
👏1
Python Materials For Beginners
Підбірка відео по конкурентності: Асинхронний Пайтон за 5 хвилин / Python - AsyncIO Введення у Асинхронне Програмування - Процеси, Потоки, GIL та Asyncio Основи роботи з Процесами та Потоками у Пайтоні #asyncio
На жаль в багатьох відео пояснення асинхронки у python якесь не дуже (у тому числі у відео що я привів вище). Чомусь багато авторів лізуть під капот діставати генератори, які не дуже й то пояснюють основну суть.
На мою думку варто більше акцентувати свою увагу на розумінні IO-bound та CPU-bound задачах.
Також важливі моменти asyncio.gather та asyncio.wait, asyncio.wait_for які як раз дають змогу
отримувати виграш у часі виконання програми за рахунок IO-bound.

#asyncio
I/O-bound задача (Input/Output bound — задача, обмежена вводом-виводом) — це тип задач у програмуванні, під час виконання яких процесор більшість часу простоює в очікуванні, поки завершиться зовнішня операція.

У таких задачах швидкість виконання програми залежить не від потужності процесора (CPU), а від швидкості зовнішніх систем чи пристроїв.

До I/O-bound можна віднести:
1. Роботу з мережею (у тому числі HTTP-запити та роботу з БД).
2. Роботу з пристроями (наприклад, роботу через serial port).
3. Роботу з файлами.

Операційна система надає спеціальний набір функцій для асинхронної роботи, які зазвичай називають неблокуючими (non-blocking). Python будує над ними свою обгортку яка підтримує синтаксис async/await

#asyncio
Бібліотеки httpx і curl_cffi (на відміну від requests) надають як синхроний так і асинхронний інтерфейси:
import httpx

def main():
with httpx.Client() as client:
response = client.get("https://httpbin.org/get")
print(response.status_code)

main()


import asyncio
import httpx

async def main():
async with httpx.AsyncClient() as client:
response = await client.get("https://httpbin.org/get")
print(response.status_code)

asyncio.run(main())


За виключенням синтаксису async/await і запуску через asyncio.run різниці немає.
І що варто підкреслити не має виграшу у часі виконання.
Обидва приклади відправляють HTTP запит на сервер, а потім чекають від нього відповіді.

#asyncio
Виграшу у часі виконання.

За рахунок неблокуючих операцій ми можемо відправити запит на сервер, але не чекати відповіді - робити іншу задачу.
async with httpx.AsyncClient() as client:    
task = asyncio.create_task(
client.get("https://example.com/")
)

# поки запит обробляється, ми
# не чекаємо відповіді, а робимо іншу задачу
# наприклад інший запит або якісь обчислення

# тут пізніше отримуємо відповідь
response = await task
print(response.status_code)

#asyncio #create_task
Виграш у часі виконання за рахунок одночасного очікування відповідей. asyncio.gather

import time
import asyncio
import httpx

# Ключ від безкоштовного апі https://app.reqres.in
API_KEY = "free_user_****************"

async def main():
async with httpx.AsyncClient() as client:
client.headers["x-api-key"] = API_KEY

start = time.monotonic()

responses = await asyncio.gather(
client.get("https://reqres.in/api/users?delay=1"), # запит 1с
client.get("https://reqres.in/api/users?delay=3"), # запит 3с
client.get("https://reqres.in/api/users?delay=2"), # запит 2с
)

print(f"Elapsed: {time.monotonic() - start:.2f} s")
print("Status codes: ", [r.status_code for r in responses])


if __name__ == "__main__":
asyncio.run(main())

Вивід:
Elapsed: 3.30 s
Status codes: [200, 200, 200]

API app.reqres.in дозволяє задати час відповіді для кожного запиту (1, 3 та 2 с). Це дає можливість побачити перевагу асинхронності, коли запити виконуються групою й відповіді очікуються одночасно.
Якби ми робили запити послідовно, час виконання становив би 1 + 3 + 2 = ~6 с. Проте завдяки асинхронності ми досягли результату ~3,3 с, що співмірне з часом найдовшого запиту.

#asyncio #gather
2