
本文系统讲解 python 中并发(concurrency)与并行(parallelism)的本质区别,结合线程、进程、协程三大实现机制,通过可运行示例代码与硬件/场景适配逻辑,帮助开发者准确选择适合 i/o 密集型或 cpu 密集型任务的并发方案。
本文系统讲解 python 中并发(concurrency)与并行(parallelism)的本质区别,结合线程、进程、协程三大实现机制,通过可运行示例代码与硬件/场景适配逻辑,帮助开发者准确选择适合 i/o 密集型或 cpu 密集型任务的并发方案。
在 Python 并发编程实践中,一个常见误区是将“多个任务看起来同时运行”等同于“真正同时执行”。实际上,并发(Concurrency)与并行(Parallelism)是两个不同维度的概念:前者强调任务的交替执行与协作调度,后者依赖硬件能力实现物理层面的同时运行。理解这一根本差异,是写出高效、可靠并发程序的前提。
一、核心概念辨析:不是“快慢”,而是“如何执行”
| 特性 | 并发(Concurrency) | 并行(Parallelism) |
|---|---|---|
| 执行本质 | 单线程内快速切换(如协程)、或多线程时间片轮转 | 多个 CPU 核心上真正同时执行(多进程为主) |
| 硬件依赖 | 无需多核,单核即可实现 | 必须有多核 CPU 支持 |
| 适用场景 | I/O 密集型(网络请求、文件读写、数据库查询) | CPU 密集型(数值计算、图像处理、加密解密) |
| Python 实现 |
asyncio(协程)、threading(线程) |
multiprocessing、concurrent.futures.ProcessPoolExecutor
|
? 关键洞察:Python 的全局解释器锁(GIL)会阻止多线程在 CPU 密集型任务中实现真正的并行——即使开了 10 个线程,也仅有一个能执行 Python 字节码。因此,CPU 密集型任务必须用多进程绕过 GIL;I/O 密集型任务则推荐协程(轻量、无 GIL 开销)或线程(简单、生态成熟)。
二、三种主流实现方式对比与代码示例
✅ 1. 并发:asyncio 协程(推荐用于高 I/O 场景)
协程通过事件循环实现单线程内高效任务切换,在等待 I/O 时主动让出控制权,资源占用极低。
import asyncio
import time
async def fetch_data(name: str, delay: float):
print(f"[{name}] 开始请求...")
await asyncio.sleep(delay) # 模拟非阻塞 I/O 等待
print(f"[{name}] 请求完成")
return f"result_{name}"
async def main():
# 并发发起 4 个请求(总耗时 ≈ max(2, 2, 2, 2) = 2s)
tasks = [fetch_data(f"Task-{i}", 2) for i in range(4)]
results = await asyncio.gather(*tasks)
print("全部结果:", results)
start = time.time()
asyncio.run(main())
print(f"总耗时: {time.time() - start:.2f}s") # 输出约 2.00s
✅ 2. 并发:threading(适用于简单 I/O 或需同步原语的场景)
线程在 I/O 等待时自动释放 GIL,因此仍可提升吞吐量,但需注意共享数据的线程安全。
import threading
import time
def download_file(filename: str, duration: int):
print(f"开始下载 {filename}")
time.sleep(duration) # 模拟 I/O 阻塞(此时 GIL 被释放)
print(f"{filename} 下载完成")
# 启动两个线程并发下载
t1 = threading.Thread(target=download_file, args=("file1.pdf", 2))
t2 = threading.Thread(target=download_file, args=("file2.jpg", 1))
t1.start(); t2.start()
t1.join(); t2.join()
print("所有下载完成") # 总耗时 ≈ max(2, 1) = 2s(非 3s)
✅ 3. 并行:multiprocessing(唯一能突破 GIL 的 CPU 密集方案)
每个进程拥有独立内存与 Python 解释器,天然规避 GIL,适合计算密集型任务。
快速生成专业的 Python 脚本和应用代码。一键创建完整项目结构,支持CLI、API、爬虫、Bot、Django等多种项目类型,包含完整的项目结构、配置文件、依赖管理、测试、README和文档。
import multiprocessing as mp
import time
def cpu_heavy_task(n: int) -> int:
# 模拟纯 CPU 计算(不涉及 I/O,GIL 会严重限制线程)
return sum(i * i for i in range(n))
if __name__ == "__main__":
# 并行执行 4 个计算任务(4 核 CPU 下接近 4 倍加速)
with mp.Pool(processes=4) as pool:
start = time.time()
results = pool.map(cpu_heavy_task, [10**6] * 4)
print(f"并行结果: {results[:2]}... (共{len(results)}项)")
print(f"并行总耗时: {time.time() - start:.2f}s") # ≈ 2.1s(非 8s)
三、选型决策树:5 步精准匹配你的任务
判断任务类型:
→ 若大量await、requests.get()、open(...)、数据库查询 → I/O 密集型 → 选asyncio或threading。
→ 若大量数学运算、循环遍历、图像滤波 → CPU 密集型 → 强制选multiprocessing。评估复杂度与维护性:
→ 新项目、高并发 Web 服务 → 优先asyncio(性能+可扩展性最佳)。
→ 遗留代码改造、需复用同步库 →threading更平滑(但注意锁)。检查硬件资源:
→ 单核/容器资源受限 → 避免multiprocessing(进程开销大),专注asyncio。
→ 多核服务器 + 批量计算 →ProcessPoolExecutor是黄金标准。-
警惕 GIL 陷阱:
# ❌ 错误示范:多线程无法加速 CPU 任务 import threading threads = [threading.Thread(target=cpu_heavy_task, args=(10**6,)) for _ in range(4)] # 实际耗时 ≈ 4 × 单次时间(GIL 串行化)
-
生产环境建议:
- 使用
concurrent.futures统一接口(ThreadPoolExecutor/ProcessPoolExecutor),便于后期切换; - I/O 场景务必用
aiohttp替代requests,避免阻塞事件循环; - 进程间通信(IPC)优先用
multiprocessing.Queue或Pipe,避免全局变量。
- 使用
? 总结一句话:并发解决“如何高效等待”,并行解决“如何真正同时计算”。选对工具,比优化代码更重要——因为错误的并发模型,再优美的代码也跑不出性能。 当前(2026年)主流实践已明确:Web 后端用
asyncio + FastAPI,数据科学用multiprocessing + Dask,混合场景用concurrent.futures抽象层统一调度。
Python免费学习笔记(深入):立即使用
在学习笔记中,你将探索 Python 的核心概念和高级技巧!










