把需要账号登录态的链路从抓取服务里拆出成独立进程。分界线不是「要不要登录」, 而是抓取无状态、幂等、可多开实例,而交易的写操作不可逆、登录态全局唯一、 订单监控是常驻轮询——同进程时抓取一扩容就会复制出 N 份登录态与 N 个轮询, 同一账号会被并发操作。 - app/shared:配置、错误码、日志、ApiResponse 信封 + Bearer 鉴权 + 异常处理器、 导航请求头构造器 - app/scraping:站点常量、会话、解析器与 10 个抓取接口,:31107,可多开 - app/trading:登录态查询/重载与健康检查,:31108,只能单实例 - 依赖方向锁为 scraping→shared、trading→shared,两侧互不 import; tests/test_architecture.py 用 AST 检查 import 并校验两个 app 的路径不串 - 登录态 UA 在 trading 独立持有:与抓取 UA 值相同但变更理由不同,抓取 UA 为绕 反爬可随时调整,登录 UA 一改可能触发设备校验使已落盘 cookie 失效 - scripts/login.py 与 AuthSession 共用 auth_site.PROFILES 与 is_logged_in,判据只写一遍 - 同一镜像两个启动命令,交易容器覆盖 command 并设 RAKUTEN_HEALTH_PORT 同时带上此前未提交的 ラクマ 分类接口与登录态基础设施。 验证:239 个离线用例全绿;两个入口真实启动,/health 与鉴权正常。 未验证:真实探测登录态(当前开发机无外网,对站点的连接全部超时)。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
37 lines
1.4 KiB
Python
37 lines
1.4 KiB
Python
"""抓取服务健康检查路由"""
|
|
from fastapi import APIRouter, Depends
|
|
|
|
from app.scraping.container import ScrapingContainer
|
|
from app.scraping.models.scrape import HealthData
|
|
from app.shared.api import ApiResponse, get_container
|
|
|
|
router = APIRouter(tags=["health"])
|
|
|
|
|
|
@router.get("/health", response_model=ApiResponse[HealthData])
|
|
async def health(container: ScrapingContainer = Depends(get_container)) -> ApiResponse[HealthData]:
|
|
"""抓取服务健康状态
|
|
|
|
sessions 里给出乐天的 PC / 手机两条抓取通道的 cookie 预热情况,以及
|
|
ラクマ 通道的就绪状态(ラクマ 无需预热,只报是否已初始化);
|
|
browser_fallback_* 反映浏览器兜底当前是否可用(未安装 playwright 时为不可用,
|
|
属于预期降级,不影响主链路)。
|
|
|
|
账号登录态不在这里——它属于交易服务,查它请打交易服务的 /health。
|
|
"""
|
|
return ApiResponse[HealthData](
|
|
success=True,
|
|
msg="success",
|
|
data=HealthData(
|
|
status="ok",
|
|
browser_fallback_enabled=container.browser_fallback.enabled,
|
|
browser_fallback_ready=container.browser_fallback.ready,
|
|
browser_fallback_error=container.browser_fallback.unavailable_reason,
|
|
sessions={
|
|
**container.site_session.profile_status(),
|
|
"rakuma": container.rakuma_session.status(),
|
|
},
|
|
),
|
|
code=0,
|
|
)
|