OutputStreamWriter 的 write(String, off, len) 先按字符索引截取子串(纯内存拷贝),再经 CharsetEncoder 转为字节序列,最后写入内部缓冲区并委托 OutputStream 输出;编码失败依错误策略处理,IOException 来自底层流。

OutputStreamWriter 的 write(String, off, len) 方法不是直接写入字节,而是先将指定字符串片段按指定字符编码转换为字节序列,再委托给底层 OutputStream 写出。
字符串片段提取与字符缓冲
方法首先从传入的 String 中按 off(起始索引)和 len(字符长度)截取子串,得到一个逻辑上的字符序列。注意:这里的 len 是字符数,不是字节数;Java String 以 UTF-16 编码存储,每个 char 是 16 位,但代理对(surrogate pair)表示的 Unicode 码点(如 emoji 或中文扩展区字符)需两个 char 表示。
- 若子串中包含未配对的高代理或低代理,后续编码阶段可能抛出
MalformedInputException(取决于编码器策略) - 截取操作本身不涉及编码,纯内存拷贝(底层调用
String.value数组的System.arraycopy)
字符到字节的编码转换
截取后的字符序列交由绑定的 CharsetEncoder(如 UTF_8、GBK 对应的编码器)处理。该过程是核心编码步骤:
- 编码器逐字符(或按码点)处理:对 BMP 字符直接映射;对增补字符(U+10000 及以上),先解包为 Unicode 码点,再按目标编码规则生成字节
- 例如:
"€"(U+20AC)在 UTF-8 下编码为0xE2 0x82 0xAC(3 字节);在 GBK 下无法表示,触发替换(如?)或抛异常(取决于CodingErrorAction) - 编码结果暂存于内部
CharBuffer和ByteBuffer,经CharsetEncoder.encode()完成转换
字节写入与缓冲管理
编码生成的字节被写入 OutputStreamWriter 内部的字节缓冲区(通常为 StreamEncoder 持有的 ByteBuffer)。该缓冲区独立于底层 OutputStream:
Java项目代码review工具。分析Git变更+完整调用链路上下文,推断业务需求,进行多维度评分和分类汇总,生成完整PRD文档。包含细粒度Java代码审查清单(Null安全、异常处理、Streams、并发、equals/hashCode、资源管理、API设计、性能、MyBatis/ORM、事务边界、SQL/DD...
立即学习“Java免费学习笔记(深入)”;
- 若缓冲区空间足够,字节被复制进缓冲区,不立即写出
- 若缓冲区满,或显式调用
flush(),缓冲区内容才通过out.write(byte[], 0, len)委托给底层流 - 关闭时自动 flush,确保所有已编码字节落盘
异常与错误处理细节
编码失败时行为取决于构造时指定的 CharsetEncoder 错误策略(默认为 REPLACE):
-
REPLACE:用替换码(如 UTF-8 的0xEF 0xBF 0xBD)代替非法字符 -
REPORT:抛出CharacterCodingException(含具体位置信息) -
IGNORE:跳过无法编码的字符,不写入任何字节
注意:IOException 可能来自底层 OutputStream(如磁盘满、网络断开),与编码无关。

















