readfile()不能用于下载远程文件,因其依赖allow_url_fopen、不校验http状态码、不支持超时/重试/重定向,易静默失败;正确方式是用curl配合curlopt_file流式写入。

直接用 file_get_contents() + file_put_contents() 最快,但大文件会爆内存;真要下大文件或需要控制超时、重定向、Header,必须用 curl 流式写入。
为什么不能只用 readfile() 直接保存?
readfile() 是把远程 URL 当作本地路径传进去——这依赖 allow_url_fopen=On,且不支持自定义超时、重试、HTTP 状态码判断;一旦远程返回 404 或 502,readfile() 会静默失败或吐出错误 HTML 到文件里,你根本不知道下载坏了。
- 它不校验 HTTP 响应状态,
readfile('https://bad.example/404.jpg')会把 404 页面 HTML 写进.jpg文件 - 无法设置连接超时,卡死在慢响应上没 fallback
- 不能自动跟随 302 重定向(除非 PHP 编译时加了
--with-curl且启用了CURLOPT_FOLLOWLOCATION)
curl 下载大文件时必须用 CURLOPT_FILE 而非 CURLOPT_RETURNTRANSFER
用 CURLOPT_RETURNTRANSFER 把整个响应体读进内存再 file_put_contents(),100MB 文件就可能触发 memory_limit 报错;正确做法是让 cURL 直接往打开的文件句柄里写。
- 先
fopen($local_path, 'w'),确保目录可写、父目录存在 -
curl_setopt($ch, CURLOPT_FILE, $fp)—— 这才是流式写入的关键 - 别漏
curl_setopt($ch, CURLOPT_FOLLOWLOCATION, true),否则带跳转的 CDN 链接会失败 - 记得
fclose($fp)和curl_close($ch),否则文件可能不完整、句柄泄漏
示例:
$url = 'https://example.com/large.zip';
$local_path = '/var/www/downloads/large.zip';
// 确保目录存在
$dir = dirname($local_path);
if (!is_dir($dir) && !mkdir($dir, 0755, true)) {
throw new Exception("无法创建目录: $dir");
}
$fp = fopen($local_path, 'w');
if (!$fp) {
throw new Exception("无法打开本地文件: $local_path");
}
$ch = curl_init($url);
curl_setopt($ch, CURLOPT_FILE, $fp);
curl_setopt($ch, CURLOPT_HEADER, 0);
curl_setopt($ch, CURLOPT_FOLLOWLOCATION, true);
curl_setopt($ch, CURLOPT_TIMEOUT, 60);
curl_setopt($ch, CURLOPT_CONNECTTIMEOUT, 10);
curl_setopt($ch, CURLOPT_SSL_VERIFYPEER, false); // 测试环境可关,生产建议开
$result = curl_exec($ch);
$http_code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
fclose($fp);
if ($result === false || $http_code >= 400) {
unlink($local_path); // 下载失败就删残缺文件
throw new Exception("cURL 失败: " . curl_error($ch) . ", HTTP $http_code");
}
中文文件名或带空格的 URL 怎么处理?
PHP 的 curl 和 file_get_contents() 都要求 URL 是合法的 ASCII 字符串。原始 URL 里的中文、空格、括号等必须 urlencode(),但注意:只对路径部分编码,不要对整个 URL 编码(否则 https:// 也会被破坏)。
- 用
parse_url()拆出path和query,分别urlencode() - 更稳妥的做法是用
rawurlencode()替代urlencode(),它对斜杠/不编码,符合 RFC 3986 - 如果远程服务用的是 GB2312 编码(老系统常见),得先
iconv('UTF-8', 'GB2312', $filename)再rawurlencode()
错误示范:file_get_contents('https://site.com/测试.pdf') → 400 Bad Request
正确做法:$path = rawurlencode('测试.pdf'); file_get_contents("https://site.com/$path");
真正麻烦的不是语法,是权限和路径拼接——dirname($local_path) 必须可写,且不能是 ../ 绝对跳转;curl 的 CURLOPT_SSL_VERIFYPEER 在内网自签证书时容易忽略,导致连接直接被拒。这些地方一错,错误信息往往藏在 curl_error() 里,而不是抛异常。
php免费学习视频:立即使用
踏上前端学习之旅,开启通往精通之路!从前端基础到项目实战,循序渐进,一步一个脚印,迈向巅峰!











