Scrapy项目里日志在哪里看?

云婷酱_7199

云婷酱_7199

2026-08-18

634人浏览

原创

scrapy默认日志仅输出到终端不生成文件,需配置log_file参数才能持久化保存;通过settings.py设置log_file和log_level可自动写入日志文件,且自定义日志统一进入该文件或终端。

scrapy项目里日志在哪里看? - php中文网

Scrapy项目运行时默认只在终端输出日志,不生成文件,想永久保留或排查问题必须手动配置输出路径,否则关掉终端日志就彻底丢失。

确认日志当前输出位置

运行爬虫时观察终端输出的首行信息,如果看到类似 2026-08-18 10:26:12 [scrapy.utils.log] INFO: Scrapy 2.11.2 started 这样的带时间戳和组件名的行,说明日志正通过标准错误(stderr)实时打印在控制台——这是Scrapy默认行为,【没有设置LOG_FILE时日志不会落盘】

执行 scrapy crawl myspider --nolog 后终端完全静默,证明日志系统已被关闭;反过来,加 --logfile debug.log 就会立刻生成文件——命令行参数优先级高于settings.py,这点必须记住。

让日志自动写入文件

打开项目根目录下的 scrapy.cfg 同级的 settings.py 文件。

在文件末尾新增两行:

LOG_FILE = "scrapy_output.log"

LOG_LEVEL = "INFO"

保存后重新运行 scrapy crawl myspider,当前目录下立即生成 scrapy_output.log。注意:如果该文件已存在,Scrapy默认以追加模式(a)写入,旧日志不会被清空。

这一步漏掉 LOG_LEVEL 会导致文件里只有 WARNING 及以上级别内容,DEBUG 和 INFO 全部过滤掉——因为 settings.py 中未显式声明时,LOG_LEVEL 实际取值取决于 Scrapy 版本内置默认值,不同版本可能不同。

Scrapy 2.18.0
Scrapy 2.18.0

Scrapy 2.18.0 官方源码包下载,适合 Python 网页抓取、选择器解析、Item Pipeline 和异步请求调度项目升级。

下载

在Spider代码里打自定义日志

方法一:直接使用Spider实例自带的logger

在 spider 文件的 parse 方法内写:self.logger.info("页面解析完成,共提取 %d 条数据", len(items))。这种写法会自动带上 spider 名称和模块路径,调试时定位快。

方法二:用 Python 标准 logging 模块

在 spider 文件顶部加 import logging,然后定义 logger = logging.getLogger(__name__),再调用 logger.warning("遇到反爬响应:%s", response.status)。注意:这种方式打出的日志名是模块全路径,比如 myproject.spiders.my_spider,和 self.logger 的命名空间不同。

【两种方式打出的日志都会进入 LOG_FILE(如果已配置)或终端,但不会各自独立成文件】

快速查看最近一次运行的日志

第一步:进入你的 Scrapy 项目根目录(即包含 scrapy.cfg 的那一层)。

第二步:执行 ls -t | head -n 5(macOS/Linux)或 dir /o-d(Windows cmd)列出按修改时间倒序的文件。

第三步:找名字含 .logscrapy 的最新文件,用 tail -n 20 scrapy_output.log(Linux/macOS)或 Get-Content scrapy_output.log -Tail 20(PowerShell)查看末尾20行。

这一步跳过编辑器直接命令行读取,避免误删或卡死大日志文件。如果日志文件超过100MB,tail 依然秒出结果,而用记事本打开可能直接无响应。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
免费爬虫工具有哪些
免费爬虫工具有哪些

免费爬虫工具有Scrapy、Beautiful Soup、ParseHub、Octoparse、Webocton Scriptly、RoboBrowser和Goutte。更多关于免费爬虫工具的问题,详情请看本专题下面的文章。php中文网欢迎大家前来学习。

2023.11.10

3933

9

AI视频生成软件推荐
AI视频生成软件推荐

本专题汇总了当前主流的AI视频生成软件推荐与排行榜单,涵盖seko、AniShort、剧云、Lovart、LiblibAI及立刻mv等热门工具。同时整理了各软件在文生视频、图生视频、时长限制、画质表现及免费额度等方面的差异对比,助您快速选对适合创作需求的AI视频生成工具。

2026.09.16

140

9

ai生成视频的工具免费版合集
ai生成视频的工具免费版合集

本专题汇总了当前免费AI生成视频工具的排行榜与推荐清单,涵盖seko、讯飞智作、AniShort及剧云、Lovart等多模型集成平台。同时整理了各工具的免费额度、输出时长、水印政策及适用场景差异,助您快速选择合适工具开启AI视频创作。

2026.09.16

60

10

Pandas时间序列分析与可视化报表
Pandas时间序列分析与可视化报表

本专题整理Pandas日期转换、时间索引、重采样、滚动窗口、时区处理、plot绘图、Styler表格样式和报表输出方法。

2026.09.16

60

23

Pandas数据筛选索引与清洗处理
Pandas数据筛选索引与清洗处理

本专题整理Pandas中的loc、iloc、条件筛选、query查询、缺失值处理、重复值删除、类型转换和字符串列清洗方法。

2026.09.16

40

25

Pandas数据读取导入与文件导出处理
Pandas数据读取导入与文件导出处理

本专题整理Pandas读取CSV、Excel、JSON、SQL、Parquet等文件的方法,以及to_csv、to_excel、to_sql和to_parquet等常用数据导出流程。

2026.09.16

40

27

GDB怎么设置断点
GDB怎么设置断点

本专题介绍GDB按照函数名、源代码行号和文件位置设置断点的方法,详细说明run、continue、next、step等命令的配合使用,帮助定位程序崩溃、逻辑异常及代码未按预期执行的问题。

2026.09.11

360

28

GDB怎么查看变量值
GDB怎么查看变量值

本专题介绍GDB调试过程中查看变量值的具体方法,涵盖局部变量、函数参数、数组、结构体和指针内容查询,同时整理变量持续显示、格式化输出及无法读取变量时的排查思路。

2026.09.11

120

22

GDB C++程序怎么调试
GDB C++程序怎么调试

本专题围绕GDB调试C++程序的实际过程,详细说明程序编译、调试器启动、命令行参数传入、断点命中和程序继续运行等步骤,并介绍条件断点、临时断点和观察点的设置方法,方便开发者跟踪复杂代码的执行状态。

2026.09.11

120

20

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Scrapy 官方文档与教程
Scrapy 官方文档与教程

共0课时 | 0人学习

Python Scrapy 网络爬虫实战视频教程
Python Scrapy 网络爬虫实战视频教程

共16课时 | 5.9万人学习