.html与.htm功能完全等价,差异仅源于dos时代8.3文件名限制(.htm为.html的3字符缩写);现代系统无技术区别,但url路径严格区分,建议新项目统一使用.html以确保工具链兼容和规范一致。

保存为 .html 和 .htm 两种扩展名的实际区别
浏览器对 .html 和 .htm 一视同仁,两者功能完全等价。历史上 .htm 是 DOS 8.3 文件名限制的遗留(最多 8 字符主名 + 3 字符扩展名),如今纯属习惯问题。Windows 系统默认可能倾向 .htm,但现代开发中统一用 .html 更常见、更清晰。
关键不是选哪个后缀,而是:必须在保存时显式指定扩展名,且不能依赖编辑器自动补全 —— 记事本等工具若选错“保存类型”,会强行加 .txt,导致双击打不开。
用记事本保存 HTML 源码时必设 UTF-8 编码
中文、emoji 或特殊符号一旦乱码,基本就是编码没选对。记事本默认用 ANSI(Windows-1252),对中文极不友好。
- 粘贴 HTML 源码后,点「文件 → 另存为」
- 在保存对话框里,「编码」下拉菜单必须手动选
UTF-8(不是 UTF-8-BOM) - 「保存类型」选
所有文件,否则会变成xxx.html.txt - 文件名栏直接输
index.html,别指望它自动补
VS Code 等编辑器默认就是 UTF-8,但首次保存时仍要确认右下角状态栏显示的是 UTF-8,不是 GBK 或 ISO-8859-1。
另存为「网页,全部」和「网页,仅 HTML」的区别
这是浏览器菜单里的两个选项,行为差异很大:
-
网页,全部:生成一个.html文件 + 同名文件夹(含图片、CSS、JS 等资源),适合离线完整复现页面效果 -
网页,仅 HTML:只保存 HTML 文本,所有<img src="xxx.jpg">路径保持原样,但本地没有对应文件 → 图片 404,样式失效
如果你只是想存结构或调试源码,选「仅 HTML」;如果要发给别人看效果,必须用「全部」并确保文件夹不被单独删除。
命令行保存 HTML 时注意重定向与编码
curl 和 wget 抓下来的内容默认是服务器返回的原始字节流,编码由响应头 Content-Type 决定,但本地保存时不带元信息。
-
curl https://example.com > page.html:简单直接,但若网页声明charset=gbk,用 UTF-8 编辑器打开就会乱码 -
wget -O page.html https://example.com:同上,无编码转换 - 真正稳妥的做法是先看响应头:
curl -I https://example.com | grep charset,再决定是否用iconv转码
动态渲染页(如 React/Vue 应用)用 curl 只能拿到骨架 HTML,真实内容需用 curl 配合 Puppeteer 或直接从开发者工具复制 outerHTML。
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!











