java控制台输入中文乱码的根本原因是system.in字节流未按utf-8正确解码;需统一终端代码页(chcp 65001)、jvm编码(-dfile.encoding=utf-8)并显式指定scanner字符集为utf-8。

Java 控制台输入中文乱码,核心是 Scanner 或 System.in 的字节流未按 UTF-8 正确解码。Windows 终端默认用 GBK 读取键盘输入,而 JVM 若未统一编码,就会把 GBK 字节误当 UTF-8 解,导致 Scanner.nextLine() 返回乱码或异常字符(如“”或空字符串)。
确认终端和 JVM 实际编码
先别急着改配置,运行这段代码看真实环境:
public class CheckEncoding {public static void main(String[] args) {
System.out.println("file.encoding = " + System.getProperty("file.encoding"));
System.out.println("console encoding (by locale) = " + System.console() != null ? "Console exists" : "null");
}
}
同时在 VSCode 终端或 CMD 执行 chcp,确认当前代码页(936=GBK,65001=UTF-8)。两者不一致,输入必然出错。
统一 JVM 运行时编码(必须)
仅靠 -Dfile.encoding=UTF-8 不够——它影响文件 I/O 和字符串处理,但 System.in 的 InputStreamReader 默认仍可能 fallback 到平台编码。正确做法是:
- 调试运行:在
.vscode/launch.json的 configuration 中加入:"vmArgs": "-Dfile.encoding=UTF-8" - Code Runner 运行:修改
settings.json中的code-runner.executorMap,Java 条目改为:"java": "cd $dir && javac -encoding UTF-8 $fileName && java -Dfile.encoding=UTF-8 $fileNameWithoutExt" - 命令行运行:直接加参数:
java -Dfile.encoding=UTF-8 YourClass
显式指定 Scanner 的字符集(推荐)
最稳妥的方式是绕过默认编码推断,手动绑定 UTF-8:
import java.util.Scanner;import java.io.InputStream;
import java.nio.charset.StandardCharsets;
public class InputDemo {
public static void main(String[] args) {
// 关键:显式传入 UTF-8 编码的 InputStream
Scanner scanner = new Scanner(System.in, StandardCharsets.UTF_8);
System.out.print("请输入中文:");
String input = scanner.nextLine();
System.out.println("你输入的是:" + input);
}
}
这样即使终端是 GBK、JVM 未设 -Dfile.encoding,只要终端已执行 chcp 65001 并支持 UTF-8 字体,输入就能正确识别。
终端层面同步启用 UTF-8
VSCode 内置终端需固化 UTF-8 环境,否则每次新开终端都要手动 chcp 65001:
- 在
settings.json中添加:"terminal.integrated.profiles.windows": { "PowerShell": { "args": ["-NoExit", "-Command", "chcp 65001"] } } - 并设默认终端:
"terminal.integrated.defaultProfile.windows": "PowerShell" - 加上中文字体支持:
"terminal.integrated.fontFamily": "'Sarasa Mono SC', 'Microsoft YaHei'"
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南











