如何在Python中计算大文件的MD5哈希而没有内存限制？

如何在Python中计算大文件的MD5哈希而没有内存限制？

Patricia Arquette

Oct 20, 2024 am 11:03 AM

How to Compute MD5 Hashes of Large Files in Python Without Memory Limitations?

在 Python 中计算大文件的 MD5 哈希

虽然使用 Python 的 hashlib 模块计算小文件的 MD5 哈希很简单文件，对于超出可用内存的大文件来说变得不切实际。本文探讨了应对这一挑战的实用解决方案。

为了规避内存限制，需要授予 hashlib 访问文件块的权限，而不是一次性访问整个文件。以下 Python 函数以指定大小的块读取文件并累积部分 MD5 哈希值。通过为 block_size 参数设置合适的大小（默认值：2^20），它可以有效地管理超出 RAM 限制的文件大小。

<code class="python">def md5_for_file(f, block_size=2**20):
    md5 = hashlib.md5()
    while True:
        data = f.read(block_size)
        if not data:
            break
        md5.update(data)
    return md5.digest()</code>

为了确保正确的结果，请使用 'rb' 以二进制模式打开文件是必不可少的。

为了获得更全面的方法，辅助函数可以封装所有必要的步骤：

<code class="python">def generate_file_md5(rootdir, filename, blocksize=2**20):
    m = hashlib.md5()
    with open(os.path.join(rootdir, filename), "rb") as f:
        while True:
            buf = f.read(blocksize)
            if not buf:
                break
            m.update(buf)
    return m.hexdigest()</code>

使用 jacksum 等工具交叉检查结果可确保计算的 MD5 哈希值的准确性.

以上是如何在Python中计算大文件的MD5哈希而没有内存限制？的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

Python的主要目的：灵活性和易用性

Python的主要目的：灵活性和易用性Apr 17, 2025 am 12:14 AM

Python的灵活性体现在多范式支持和动态类型系统，易用性则源于语法简洁和丰富的标准库。1.灵活性：支持面向对象、函数式和过程式编程，动态类型系统提高开发效率。2.易用性：语法接近自然语言，标准库涵盖广泛功能，简化开发过程。

Python：多功能编程的力量

Python：多功能编程的力量Apr 17, 2025 am 12:09 AM

Python因其简洁与强大而备受青睐，适用于从初学者到高级开发者的各种需求。其多功能性体现在：1)易学易用，语法简单；2)丰富的库和框架，如NumPy、Pandas等；3)跨平台支持，可在多种操作系统上运行；4)适合脚本和自动化任务，提升工作效率。

每天2小时学习Python：实用指南

每天2小时学习Python：实用指南Apr 17, 2025 am 12:05 AM

可以，在每天花费两个小时的时间内学会Python。1.制定合理的学习计划，2.选择合适的学习资源，3.通过实践巩固所学知识，这些步骤能帮助你在短时间内掌握Python。

Python与C：开发人员的利弊

Python与C：开发人员的利弊Apr 17, 2025 am 12:04 AM

Python适合快速开发和数据处理，而C 适合高性能和底层控制。1)Python易用，语法简洁，适用于数据科学和Web开发。2)C 性能高，控制精确，常用于游戏和系统编程。

Python：时间投入和学习步伐

Python：时间投入和学习步伐Apr 17, 2025 am 12:03 AM

学习Python所需时间因人而异，主要受之前的编程经验、学习动机、学习资源和方法及学习节奏的影响。设定现实的学习目标并通过实践项目学习效果最佳。

Python：自动化，脚本和任务管理

Python：自动化，脚本和任务管理Apr 16, 2025 am 12:14 AM

Python在自动化、脚本编写和任务管理中表现出色。1)自动化：通过标准库如os、shutil实现文件备份。2)脚本编写：使用psutil库监控系统资源。3)任务管理：利用schedule库调度任务。Python的易用性和丰富库支持使其在这些领域中成为首选工具。

Python和时间：充分利用您的学习时间

Python和时间：充分利用您的学习时间Apr 14, 2025 am 12:02 AM

要在有限的时间内最大化学习Python的效率，可以使用Python的datetime、time和schedule模块。1.datetime模块用于记录和规划学习时间。2.time模块帮助设置学习和休息时间。3.schedule模块自动化安排每周学习任务。

Python：游戏，Guis等

Python：游戏，Guis等Apr 13, 2025 am 12:14 AM

Python在游戏和GUI开发中表现出色。1)游戏开发使用Pygame，提供绘图、音频等功能，适合创建2D游戏。2)GUI开发可选择Tkinter或PyQt，Tkinter简单易用，PyQt功能丰富，适合专业开发。

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序，用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

AI Hentai Generator

AI Hentai Generator

免费生成ai无尽的。

热门文章

R.E.P.O.能量晶体解释及其做什么（黄色晶体）

1 个月前By尊渡假赌尊渡假赌尊渡假赌

R.E.P.O.最佳图形设置

1 个月前By尊渡假赌尊渡假赌尊渡假赌

刺客信条阴影：贝壳谜语解决方案

2 周前ByDDD

R.E.P.O.如果您听不到任何人，如何修复音频

1 个月前By尊渡假赌尊渡假赌尊渡假赌

R.E.P.O.聊天命令以及如何使用它们

1 个月前By尊渡假赌尊渡假赌尊渡假赌

热工具

适用于 Eclipse 的 SAP NetWeaver 服务器适配器

适用于 Eclipse 的 SAP NetWeaver 服务器适配器

将Eclipse与SAP NetWeaver应用服务器集成。

安全考试浏览器

安全考试浏览器

Safe Exam Browser是一个安全的浏览器环境，用于安全地进行在线考试。该软件将任何计算机变成一个安全的工作站。它控制对任何实用工具的访问，并防止学生使用未经授权的资源。

Atom编辑器mac版下载

Atom编辑器mac版下载

最流行的的开源编辑器

Dreamweaver CS6

Dreamweaver CS6

视觉化网页开发工具

Dreamweaver Mac版

Dreamweaver Mac版

视觉化网页开发工具

热门话题

gmail邮箱登陆入口在哪里

7530

15

1379

52

steam的账户名称是什么格式

82

11

win11激活密钥永久

54

19

NYT连接提示和答案

21

76