Java Stream Collector 高级用法:定制化累加器与收集器实现

java stream collector 高级用法:定制化累加器与收集器实现

本文深入探讨了 Java Stream API 中 Collector 的高级定制化实现,重点讲解了如何灵活选择和设计累加器类型 (A),以及如何使用 Collector.of() 方法构建自定义收集器。通过具体示例,展示了利用基本类型数组、现有可变类型、匿名内部类等作为累加器,有效避免了不必要的类创建,提升了代码的简洁性和灵活性。

理解 Collector 接口及其泛型

java.util.stream.Collector 接口是 Java Stream API 中一个核心组件,用于将流中的元素聚合成一个结果。它定义了三种泛型类型:

T:流中元素的类型。A:累加器(accumulator)的类型,这是一个可变的中间结果类型,用于在收集过程中存储状态。它通常是实现细节,不对外暴露。R:最终结果的类型,即收集操作完成后返回的类型。

要创建一个自定义的 Collector,最常用的方法是使用 Collector.of() 工厂方法,它需要四个核心函数式接口作为参数:

supplier: 一个 Supplier,用于创建新的累加器实例。accumulator: 一个 BiConsumer,用于将流中的单个元素 T 合并到累加器 A 中。combiner: 一个 BinaryOperator,用于将两个累加器 A 合并成一个(在并行流中特别有用)。finisher: 一个 Function,用于将最终的累加器 A 转换成最终结果 R。

一个常见的误解是,累加器类型 A 必须是一个独立的、专门为此目的创建的具名类,并且其方法(如 supply、accumulate、combine、finish)需要直接在 Collector 的实现中引用该类的静态方法或实例方法。实际上,Collector.of() 的函数参数提供了极大的灵活性,允许我们使用各种方式来定义这些行为,而无需强制创建额外的具名类。

灵活选择累加器类型

累加器类型 A 的选择是实现自定义 Collector 的关键。它不一定非得是一个复杂的自定义类,可以是以下几种类型:

立即学习“Java免费学习笔记(深入)”;

1. 使用基本类型数组作为累加器

对于简单的数值累加,一个单元素的基本类型数组(如 int[])是一个非常高效且简洁的累加器。它提供了可变性,并且避免了装箱拆箱的开销。

示例:计算流中整数的和

import java.util.stream.Collector;import java.util.stream.Stream;public class CustomSumCollector {    /**     * 创建一个收集器,用于计算整数流的总和。     * 累加器类型为 int[1],其中数组的第一个元素存储当前和。     *     * @return 收集整数到其总和的收集器。     */    public static Collector sum() {        return Collector.of(            () -> new int[1], // supplier: 创建一个长度为1的int数组作为累加器            (a, i) -> a[0] += i, // accumulator: 将元素i加到数组的第一个元素            (a, b) -> { a[0] += b[0]; return a; }, // combiner: 合并两个累加器            a -> a[0], // finisher: 返回数组的第一个元素作为最终结果            Collector.Characteristics.UNORDERED // 标识收集器不关心元素顺序        );    }    public static void main(String[] args) {        Stream numbers = Stream.of(1, 2, 3, 4, 5);        Integer totalSum = numbers.collect(sum());        System.out.println("Sum using custom collector: " + totalSum); // Output: Sum using custom collector: 15    }}

在这个例子中,int[1] 作为累加器 A,简洁地完成了累加任务。

2. 使用现有可变类型作为累加器

Java 标准库中提供了许多可变的类,它们可以直接用作累加器,特别是当需要考虑线程安全时。

示例:使用 AtomicInteger 计算流中整数的和(并发安全)

import java.util.concurrent.atomic.AtomicInteger;import java.util.stream.Collector;import java.util.stream.Stream;public class ConcurrentSumCollector {    /**     * 创建一个并发安全的收集器,用于计算整数流的总和。     * 累加器类型为 AtomicInteger。     *     * @return 并发收集整数到其总和的收集器。     */    public static Collector concurrentSum() {        return Collector.of(            AtomicInteger::new, // supplier: 创建一个新的 AtomicInteger 实例            AtomicInteger::addAndGet, // accumulator: 将元素i原子地加到 AtomicInteger 中            (a, b) -> { a.addAndGet(b.intValue()); return a; }, // combiner: 合并两个 AtomicInteger            AtomicInteger::intValue, // finisher: 返回 AtomicInteger 的值作为最终结果            Collector.Characteristics.UNORDERED,            Collector.Characteristics.CONCURRENT // 标识收集器支持并发        );    }    public static void main(String[] args) {        Stream numbers = Stream.of(1, 2, 3, 4, 5);        Integer totalSum = numbers.collect(concurrentSum());        System.out.println("Concurrent sum using custom collector: " + totalSum); // Output: Concurrent sum using custom collector: 15    }}

AtomicInteger 天然提供了线程安全的原子操作,非常适合在并行流中使用。

3. 使用匿名内部类或 Ad-hoc 类型作为累加器

当没有合适的现有类型,并且不想创建新的具名类时,可以使用匿名内部类或 Object 的子类(通常通过 new Object() {} 语法)作为累加器。这种方式将累加器的定义局部化在 Collector 的实现内部,增加了封装性

示例:收集 Map.Entry 流中具有最大值的键列表

假设我们有一个 Map.Entry 的流,我们希望找出所有具有最大值的键,并以 List 的形式返回。

方法一:使用 AbstractMap.SimpleEntry 作为累加器

AbstractMap.SimpleEntry 可以作为一个简单的键值对容器,这里我们用它来存储当前找到的最大值 (Integer) 和对应的键列表 (List)。

import java.util.*;import java.util.stream.Collector;import java.util.stream.Stream;public class KeysToMaximumCollector {    /**     * 收集 Map.Entry 流中具有最大值的键列表。     * 累加器类型为 AbstractMap.SimpleEntry<List, Integer>。     *     * @param  键的类型     * @return 收集器,返回具有最大值的键列表。     */    public static  Collector<Map.Entry, ?, List> keysToMaximum() {        return Collector.of(            () -> new AbstractMap.SimpleEntry(new ArrayList(), Integer.MIN_VALUE), // supplier: 初始累加器            (current, next) -> { // accumulator: 处理每个 Map.Entry                int max = current.getValue();                int value = next.getValue();                if (value >= max) {                    if (value > max) { // 找到更大的值,清空旧列表,更新最大值                        current.setValue(value);                        current.getKey().clear();                    }                    current.getKey().add(next.getKey()); // 添加当前键                }            },            (a, b) -> { // combiner: 合并两个累加器                int maxA = a.getValue();                int maxB = b.getValue();                if (maxA < maxB) return b; // B 的最大值更大,返回 B                if (maxA == maxB) a.getKey().addAll(b.getKey()); // 最大值相同,合并键列表                return a; // 否则返回 A            },            Map.Entry::getKey // finisher: 返回累加器中的键列表        );    }    public static void main(String[] args) {        Map map = new HashMap();        map.put("A", 10);        map.put("B", 20);        map.put("C", 15);        map.put("D", 20);        map.put("E", 5);        List keys = map.entrySet().stream().collect(keysToMaximum());        System.out.println("Keys with maximum value: " + keys); // Output: Keys with maximum value: [B, D] (顺序可能不同)    }}

方法二:使用匿名内部类作为累加器

这种方式创建了一个只在 Collector 内部可见的、具有特定字段的匿名对象作为累加器。

import java.util.*;import java.util.stream.Collector;import java.util.stream.Stream;public class KeysToMaximumAdHocCollector {    /**     * 收集 Map.Entry 流中具有最大值的键列表。     * 累加器类型为匿名内部类。     *     * @param  键的类型     * @return 收集器,返回具有最大值的键列表。     */    public static  Collector<Map.Entry, ?, List> keysToMaximum() {        return Collector.of(            () -> new Object() { // supplier: 创建一个匿名内部类实例作为累加器                int max = Integer.MIN_VALUE;                final List keys = new ArrayList();            },            (current, next) -> { // accumulator: 处理每个 Map.Entry                int value = next.getValue();                if (value >= current.max) {                    if (value > current.max) {                        current.max = value;                        current.keys.clear();                    }                    current.keys.add(next.getKey());                }            },            (a, b) -> { // combiner: 合并两个匿名内部类累加器                if (a.max  a.keys // finisher: 返回累加器中的键列表        );    }    public static void main(String[] args) {        Map map = new HashMap();        map.put("A", 10);        map.put("B", 20);        map.put("C", 15);        map.put("D", 20);        map.put("E", 5);        List keys = map.entrySet().stream().collect(keysToMaximum());        System.out.println("Keys with maximum value (ad-hoc): " + keys); // Output: Keys with maximum value (ad-hoc): [B, D] (顺序可能不同)    }}

这两种方法都避免了为累加器单独创建一个具名类,使代码更加紧凑和局部化。

注意事项与总结

累加器类型的选择

简单场景:考虑使用基本类型数组(如 int[])或现有可变容器(如 ArrayList、StringBuilder)作为累加器,它们通常更高效且简洁。并发场景:使用 AtomicInteger、ConcurrentHashMap 等并发工具类作为累加器,并添加 Collector.Characteristics.CONCURRENT 特性。复杂场景或封装需求:当需要封装多个状态时,可以考虑 AbstractMap.SimpleEntry 或匿名内部类。如果逻辑非常复杂,或者该累加器类型需要在多个 Collector 中复用,那么创建一个具名类仍然是更好的选择。

函数式接口的实现

supplier、accumulator、combiner、finisher 可以是方法引用 (ClassName::methodName) 或 Lambda 表达式。它们不要求是累加器类型 A 自身的成员方法,这提供了极大的灵活性。combiner 函数的正确实现对于并行流至关重要。它必须能够正确地将两个部分累加器合并为一个。finisher 函数负责将中间的累加器状态转换为最终结果。如果累加器本身就是最终结果,finisher 可以简单地返回累加器本身(即 Function.identity())。

Collector.Characteristics

UNORDERED:表示收集器不关心流的顺序。CONCURRENT:表示收集器可以支持并行执行,即 accumulator 可以被多个线程调用,并且 combiner 可以被跳过(如果 supplier 返回一个线程安全的可变结果容器)。IDENTITY_FINISH:表示 finisher 函数是一个恒等函数(Function.identity()),即累加器类型 A 和结果类型 R 相同。

通过灵活运用 Collector.of() 方法,并根据实际需求选择合适的累加器类型,开发者可以创建出高效、简洁且功能强大的自定义收集器,从而更好地利用 Java Stream API 的能力。无需为每个自定义收集器都创建独立的累加器类,这大大简化了代码结构和维护成本。

以上就是Java Stream Collector 高级用法:定制化累加器与收集器实现的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/67259.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
Excel中插入文件附件方法
上一篇 2025年11月12日 11:19:06
缺少任务追踪机制会导致什么问题
下一篇 2025年11月12日 11:20:28

相关推荐

  • CorelDRAW X6怎样为矢量图形填充纹理图案_CorelDRAW X6图样填充功能使用教程

    使用交互式填充工具可快速为矢量图形添加预设纹理,如石墙、织物等,并通过控制点调整位置、缩放及颜色参数;2. 通过图样填充功能可自定义双色或全彩图案,选择砖墙、木纹等样式并调节比例贴合设计;3. 叠加黑色矩形并设置透明度与混合模式,可增强纹理的层次感和立体效果。 在CorelDRAW X6中为矢量图形…

    2026年9月21日
    000
  • 《如龙 极3》与峰义孝为主角《如龙3外传》等新情报发表

    《如龙 极3》与峰义孝为主角《如龙3外传》等新情报发表《如龙 极3》与峰义孝为主角《如龙3外传》等新情报发表《如龙 极3》与峰义孝为主角《如龙3外传》等新情报发表《如龙 极3》与峰义孝为主角《如龙3外传》等新情报发表

    世嘉公开《如龙极3/如龙3外传  dark ties》官方中文版预告宣传片,将于2026年2月12日发售 ​​​​,登陆ps5/ps4/switch2/xbox/pc平台,全球同步推出。 ​​​ 在2009年于PS3平台发售的《如龙3》焕然重生,为您打造“极致体验”。鲜活真实的冲绳街景、震撼力升级的…

    2026年9月21日 用户投稿
    000
  • safari浏览器怎么把标签页固定在最左边_safari浏览器标签页固定最左设置

    Safari可通过“固定标签”功能将常用网页保持在标签栏最左并随启动恢复;2. 手动拖动标签至最左可临时调整顺序但不永久保存;3. 结合书签栏添加常用网站并固定标签,可提升访问效率。 如果您希望在使用 Safari 浏览器时将常用网页始终保持在标签栏的最左侧位置,以便快速访问,可以通过以下方法实现标…

    2026年9月21日
    000
  • 如何用Animoto制作AI营销视频?快速生成商业AI视频的教程

    如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程如何用Animoto制作AI营销视频?快速生成商业AI视频的教程

    Animoto通过模板与拖放功能,结合AI生成的文案和配音,帮助用户快速制作品牌统一、节奏合理、带明确CTA的高效营销视频,适用于多平台推广。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ Animoto是一个非常适合快速制作AI营销视频的…

    2026年9月21日 用户投稿
    000
  • 使用本地HTML文件运行JavaScript脚本失败的原因及解决方案

    本文旨在帮助开发者理解在没有Web服务器的情况下,直接通过浏览器打开本地HTML文件时,JavaScript脚本可能无法正常运行的原因,并提供相应的解决方案。文章将深入探讨浏览器安全策略、相对路径问题以及如何正确引入和执行JavaScript脚本,确保你的HTML、CSS和JavaScript代码能…

    2026年9月21日
    000
  • mac怎么使用磁盘工具_mac磁盘工具使用教程

    使用磁盘工具可解决Mac外接存储问题。1. 打开磁盘工具,选择设备后点击“急救”扫描修复错误;2. 通过“抹掉”功能将设备格式化为APFS或Mac OS扩展以提升兼容性;3. 利用“分区”功能划分硬盘为多个宗卷,便于数据管理;4. 创建空白磁盘映像用于备份,或恢复.dmg文件至U盘制作启动盘。 如果…

    2026年9月21日
    100
  • VSCode怎么看效果_VSCode实时预览和调试代码运行效果教程

    VSCode通过实时预览扩展和内置调试器实现代码效果查看。使用Live Server可实时预览前端页面,保存即刷新;Markdown文件支持侧边预览。调试功能需配置launch.json,支持Node.js、Python、浏览器端JavaScript等,通过断点、变量监视、调用堆栈等深入分析代码执行…

    2026年9月21日
    000
  • 抖音青少年模式时间限制?青少年模式40分钟后多久介绍

    短视频平台在青少年群体中日益受到欢迎。作为国内领先的短视频平台,抖音为了保护青少年的身心健康,推出了青少年模式。本文将围绕青少年模式的时间限制展开探讨,分析其对青少年健康成长的意义,并思考如何打造一个绿色的网络环境。 一、抖音青少年模式时间限制的价值 1. 防止沉迷于短视频 通过设置使用时长限制,抖…

    2026年9月21日
    200
  • 使用正则表达式检测字符串中的除零操作

    本文详细介绍了如何使用正则表达式精确检测字符串中潜在的除零操作。针对表达式中可能存在的变量引用(如<>)、数字、多余空格以及禁止包含引号等复杂情况,文章提供了一个高效的正则表达式模式,并深入解析其构成原理。通过具体的Java代码示例,读者将学习如何将此模式应用于实际编程场景,从而有效识别…

    2026年9月21日
    000
  • MySQL常见错误码代表什么_如何快速定位问题?

    MySQL常见错误码代表什么_如何快速定位问题?MySQL常见错误码代表什么_如何快速定位问题?MySQL常见错误码代表什么_如何快速定位问题?MySQL常见错误码代表什么_如何快速定位问题?

    遇到mysql错误码应先明确错误类型再逐步排查。error 1045表示用户名、密码或访问权限问题,需检查拼写、ip限制和远程访问权限;error 2003表示连接失败,需依次检查服务器状态、mysql服务运行情况、防火墙设置及bind-address配置;error 1054表示sql语句中引用了…

    2026年9月21日 用户投稿
    100
  • AI钉钉1.0联动雅里数科 共探“酒旅+AI”的工作新范式

    在数字化浪潮席卷全球的当下,人工智能正以前所未有的速度重塑各行各业,酒旅产业也正在迎来由ai驱动的深刻变革。10月11日,阿里巴巴钉钉再度走进雅里数科集团,开启一场关于“酒旅行业ai原生工作方式”的深度对话。此次交流标志着双方合作迈入全新阶段,致力于共同探索ai原生工作范式,引领酒旅行业迈向智能化发…

    2026年9月21日
    100
  • 如何检测Linux网络接口DMA状态 硬件加速功能验证

    如何检测Linux网络接口DMA状态 硬件加速功能验证如何检测Linux网络接口DMA状态 硬件加速功能验证如何检测Linux网络接口DMA状态 硬件加速功能验证如何检测Linux网络接口DMA状态 硬件加速功能验证

    可通过以下方法检测linux系统中网络接口dma状态和硬件加速是否启用:1.使用 ethtool -i eth0 和 ethtool -k eth0 查看驱动信息及sg、tso、ufo、gso功能是否启用;2.通过 cat /proc/interrupts 和 cat /proc/slabinfo …

    2026年9月21日 用户投稿
    800
  • win11系统占用C盘空间过大怎么办_Win11清理C盘空间方法

    首先使用磁盘清理工具删除系统文件,包括旧更新和临时安装文件;接着启用存储感知功能自动定期清理临时文件与回收站;然后手动清除用户临时文件夹(%temp%)中的缓存数据;最后更改新应用和个人文件的默认保存位置至非C盘分区,以释放并节省C盘空间。 如果您发现Windows 11系统文件占用了C盘大量空间,…

    2026年9月21日
    100
  • 如何从被调用类中获取调用者文件的命名空间

    本文探讨了在PHP中,如何在不通过参数传递的情况下,从一个被调用的工具类中获取到调用该方法的文件的命名空间。通过结合使用`debug_backtrace()`回溯调用栈以定位调用者文件,并利用`token_get_all()`解析文件内容来提取命名空间声明,提供了一种实用的解决方案。文章详细介绍了实…

    2026年9月21日
    000
  • 构建Spring自定义Kafka配置的注解式解决方案

    本文探讨了在Spring Boot应用中通过自定义注解实现Kafka配置自动化时遇到的挑战,特别是由于Bean注册时机不当导致的依赖注入失败。我们将深入分析问题根源,并提供两种核心解决方案:利用META-INF/spring.factories实现标准化的自动配置发现,以及通过ImportBeanD…

    2026年9月21日
    1100
  • 悟空浏览器开发者工具的控制台怎么用_悟空浏览器Console控制台使用入门教程

    首先启用悟空浏览器开发者工具并进入Console标签,可查看错误、警告等日志信息,通过过滤功能定位问题;支持执行JavaScript代码实时调试,监控网络请求失败及全局异常,还可清空或保存日志以便分析。 如果您在使用悟空浏览器进行网页开发或调试时,发现页面元素未按预期工作或脚本报错,则可以借助开发者…

    2026年9月21日
    700
  • 蝴蝶号无人直播中的AI角色控制技巧与注意事项

    蝴蝶号无人直播中的AI角色控制技巧与注意事项蝴蝶号无人直播中的AI角色控制技巧与注意事项蝴蝶号无人直播中的AI角色控制技巧与注意事项蝴蝶号无人直播中的AI角色控制技巧与注意事项

    要让蝴蝶号ai角色在直播中更具真实感和互动性,关键在于注入“人味儿”,打破“机器感”。首先,声音要有温度,选择有情感起伏的音色,并根据不同语境调整语调、语速,适当加入语气词增强亲切感;其次,确保视觉形象与行为模式统一,动作、表情、眼神与语音内容自然同步,强化人设一致性;第三,建立多层次互动逻辑,ai…

    2026年9月21日 用户投稿
    400
  • VSCode整个项目怎么导出_VSCode项目打包与导出为压缩文件的完整教程

    答案:导出VSCode项目可通过手动压缩、终端命令、插件或Git克隆实现,推荐使用终端命令排除node_modules并选择zip格式以兼顾兼容性与效率。 将VSCode整个项目导出,实际上就是将项目文件夹打包成一个压缩文件,方便备份、分享或迁移。下面介绍几种常见的打包导出方法。 解决方案: 手动压…

    2026年9月21日
    000
  • MySQL如何实现数据的实时备份_有哪些高效工具和方法?

    mysql 实时备份主要依赖主从复制、二进制日志(binlog)配合增量备份,以及借助专业工具实现自动化监控与恢复。一、主从复制通过将主库数据变更同步到从库实现“准实时”备份,但存在延迟风险,建议开启 gtid 模式提升一致性;二、结合 binlog 与定时归档实现可回溯的增量备份,配合全量备份可恢…

    2026年9月21日
    000
  • SpringBoot的定时任务

    SpringBoot的定时任务SpringBoot的定时任务SpringBoot的定时任务SpringBoot的定时任务

    大家好,我是你们的老朋友全栈君。我们又见面了。 一、基于注解(@Scheduled)的定时任务 使用SpringBoot的@Scheduled注解来创建定时任务非常简单,只需几行代码就能实现。然而,@Scheduled默认是单线程运行,这意味着当启动多个任务时,一个任务的执行时间可能会影响到下一个任…

    2026年9月21日 用户投稿
    400

发表回复

登录后才能评论
关注微信