Skip to content

Commit b6894b8

Browse files
chore(deps): lock file maintenance (#1782)
Co-authored-by: Vlada Dusek <v.dusek96@gmail.com>
1 parent 97ade44 commit b6894b8

9 files changed

Lines changed: 1104 additions & 1070 deletions

File tree

src/crawlee/_types.py

Lines changed: 2 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -165,10 +165,10 @@ class EnqueueLinksKwargs(TypedDict):
165165
combination of protocol, domain, and port, ensuring a strict scope for the crawl.
166166
"""
167167

168-
include: NotRequired[list[re.Pattern | Glob]]
168+
include: NotRequired[Sequence[re.Pattern | Glob]]
169169
"""List of regular expressions or globs that URLs must match to be enqueued."""
170170

171-
exclude: NotRequired[list[re.Pattern | Glob]]
171+
exclude: NotRequired[Sequence[re.Pattern | Glob]]
172172
"""List of regular expressions or globs that URLs must not match to be enqueued."""
173173

174174

src/crawlee/crawlers/_abstract_http/_abstract_http_crawler.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -103,7 +103,7 @@ def create_parsed_http_crawler_class(
103103
class _ParsedHttpCrawler(AbstractHttpCrawler):
104104
def __init__(
105105
self,
106-
parser: AbstractHttpParser[TParseResult, TSelectResult] = static_parser,
106+
parser: AbstractHttpParser[TParseResult, TSelectResult] = static_parser, # ty: ignore[invalid-parameter-default]
107107
**kwargs: Unpack[BasicCrawlerOptions[ParsedHttpCrawlingContext[TParseResult]]],
108108
) -> None:
109109
kwargs['_context_pipeline'] = self._create_static_content_crawler_pipeline()

src/crawlee/proxy_configuration.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -182,7 +182,7 @@ async def _pick_url(
182182
if inspect.isawaitable(result):
183183
result = await result
184184

185-
return URL(result) if result is not None else None, None
185+
return URL(str(result)) if result is not None else None, None
186186
except Exception as e:
187187
raise ValueError('The provided "new_url_function" did not return a valid URL') from e
188188

src/crawlee/request_loaders/_request_list.py

Lines changed: 2 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -79,8 +79,9 @@ def __init__(
7979
logger=logger,
8080
)
8181

82+
self._requests: AsyncIterator[str | Request]
8283
if isinstance(requests, AsyncIterable):
83-
self._requests = requests.__aiter__()
84+
self._requests = requests.__aiter__() # ty: ignore[invalid-assignment]
8485
elif requests is None:
8586
self._requests = self._iterate_in_threadpool([])
8687
else:

src/crawlee/storage_clients/_redis/_utils.py

Lines changed: 4 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -1,6 +1,6 @@
11
from collections.abc import Awaitable
22
from pathlib import Path
3-
from typing import TypeVar, overload
3+
from typing import TypeVar, cast, overload
44

55
T = TypeVar('T')
66

@@ -13,7 +13,9 @@ async def await_redis_response(response: T) -> T: ...
1313

1414
async def await_redis_response(response: Awaitable[T] | T) -> T:
1515
"""Solve the problem of ambiguous typing for redis."""
16-
return await response if isinstance(response, Awaitable) else response
16+
if isinstance(response, Awaitable):
17+
return cast('T', await response)
18+
return response
1719

1820

1921
def read_lua_script(script_name: str) -> str:

tests/e2e/project_template/test_static_crawlers_templates.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -67,7 +67,7 @@ async def test_static_crawler_actor_at_apify(
6767
'start_url': default_start_url,
6868
'install_project': False,
6969
},
70-
output_dir=tmp_path,
70+
output_dir=str(tmp_path),
7171
)
7272

7373
patch_crawlee_version_in_project(

tests/unit/request_loaders/test_sitemap_request_loader.py

Lines changed: 6 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -1,6 +1,7 @@
11
import asyncio
22
import base64
33
import gzip
4+
from typing import TYPE_CHECKING
45

56
from yarl import URL
67

@@ -9,6 +10,9 @@
910
from crawlee.request_loaders._sitemap_request_loader import SitemapRequestLoader
1011
from crawlee.storages import KeyValueStore
1112

13+
if TYPE_CHECKING:
14+
from crawlee._types import JsonSerializable
15+
1216
BASIC_SITEMAP = """
1317
<?xml version="1.0" encoding="UTF-8"?>
1418
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
@@ -182,7 +186,8 @@ async def test_transform_request_function(server_url: URL, http_client: HttpClie
182186
sitemap_url = (server_url / 'sitemap.xml').with_query(base64=encode_base64(BASIC_SITEMAP.encode()))
183187

184188
def transform_request(request_options: RequestOptions) -> RequestOptions | RequestTransformAction:
185-
request_options['user_data'] = {'transformed': True}
189+
user_data: dict[str, JsonSerializable] = {'transformed': True}
190+
request_options['user_data'] = user_data
186191
return request_options
187192

188193
sitemap_loader = SitemapRequestLoader(

uv.lock

Lines changed: 506 additions & 457 deletions
Some generated files are not rendered by default. Learn more about customizing how changed files appear on GitHub.

0 commit comments

Comments
 (0)