Java Stream:高效分组、计数与多级排序实践

java stream:高效分组、计数与多级排序实践

本文深入探讨如何利用Java 11 Stream API对自定义对象流进行高效处理。核心在于解决一次性消费流的限制,通过将对象按指定属性(如`category`)进行分组计数,然后根据计数结果和属性值本身进行多级排序,最终生成一个有序的属性列表。文章提供了详细的代码示例和实现解析,旨在帮助开发者掌握复杂的Stream数据转换技巧。

引言:Stream数据转换的挑战

在Java应用开发中,我们经常需要对数据集合进行复杂的转换和聚合操作。Java Stream API自Java 8引入以来,极大地简化了这些任务。然而,当面临特定挑战时,例如在一个只能被消费一次的Stream上执行多阶段的数据处理,就需要精心设计Stream管道。本文将聚焦于一个常见场景:给定一个包含category属性的自定义对象流,我们需要生成一个按以下规则排序的类别列表:首先根据每个类别的出现频率进行排序(频率高的在前),如果频率相同,则按类别名称的字母顺序排序。

核心问题与解决方案

我们的目标是,在不重复消费原始Stream的前提下,实现一个既能统计类别频率,又能进行多级排序的解决方案。

问题定义:

立即学习“Java免费学习笔记(深入)”;

假设我们有一个MyType类的对象流,其中MyType定义如下:

public class MyType {    private String category;    public MyType(String category) {        this.category = category;    }    public String getCategory() {        return category;    }    // 其他属性、构造函数、getter/setter等...}

给定一个Stream,我们需要返回一个List,其中包含所有唯一的类别,并按照以下规则排序:

主排序规则: 类别出现的次数(频率)降序排列次排序规则: 如果两个类别的出现次数相同,则按类别名称的字母顺序升序排列。

解决方案概述:

解决此问题的关键在于分两步走:

分组与计数: 首先,利用Collectors.groupingBy和Collectors.counting将原始Stream转换为一个Map,其中键是类别名称,值是该类别出现的次数。这一步仅需一次Stream消费。排序与提取: 接着,我们将这个Map的entrySet()转换为一个新的Stream,并对这个Stream进行排序。排序时,我们利用Map.Entry.comparingByValue()进行主排序(按计数),然后使用thenComparing(Map.Entry.comparingByKey())进行次排序(按类别名称)。最后,通过map操作提取排序后的类别名称,并收集到列表中。

实现细节与代码示例

下面是具体的Java 11实现代码:

import java.util.List;import java.util.Map;import java.util.stream.Collectors;import java.util.stream.Stream;public class CategorySorter {    // 假设MyType类已定义如上    public static class MyType {        private String category;        public MyType(String category) {            this.category = category;        }        public String getCategory() {            return category;        }        @Override        public String toString() {            return "MyType{category='" + category + "'}";        }    }    /**     * 根据类别出现频率和类别名称对Stream中的类别进行排序。     *     * @param stream 包含MyType对象的Stream,只能消费一次。     * @return 排序后的类别名称列表。     */    public static List getSortedCategories(Stream stream) {        // 1. 分组并计数:将Stream转换为Map        //    键是类别名称,值是该类别的出现次数。        Map categoryCounts = stream.collect(            Collectors.groupingBy(                MyType::getCategory, // 按MyType对象的category属性分组                Collectors.counting() // 统计每个分组中的元素数量            )        );        // 2. 对Map的Entry进行排序并提取类别名称        return categoryCounts.entrySet().stream() // 将Map的Entry集合转换为Stream            .sorted(                // 主排序:按值(计数)降序排列                // 注意:comparingByValue()默认是升序,这里需要反转                Map.Entry.comparingByValue().reversed()                // 次排序:如果值(计数)相同,则按键(类别名称)升序排列                .thenComparing(Map.Entry.comparingByKey())            )            .map(Map.Entry::getKey) // 提取排序后的Entry的键(即类别名称)            .toList(); // 将结果收集到List中 (Java 16+ 或使用Collectors.toList() for Java 11)    }    public static void main(String[] args) {        // 示例输入        List inputData = List.of(            new MyType("category1"),            new MyType("categoryB"),            new MyType("categoryA"),            new MyType("category1"),            new MyType("categoryB"),            new MyType("category1"),            new MyType("categoryA")        );        // 创建一个Stream,注意Stream只能消费一次        Stream myTypeStream = inputData.stream();        // 调用方法获取排序后的类别列表        List sortedCategories = getSortedCategories(myTypeStream);        // 打印结果        System.out.println("原始数据类别列表 (未排序):");        inputData.stream().map(MyType::getCategory).forEach(System.out::println);        System.out.println("\n排序后的类别列表:");        System.out.println(sortedCategories); // 预期输出: [category1, categoryA, categoryB]    }}

代码解析:

stream.collect(Collectors.groupingBy(MyType::getCategory, Collectors.counting()))

闪念贝壳 闪念贝壳

闪念贝壳是一款AI 驱动的智能语音笔记,随时随地用语音记录你的每一个想法。

闪念贝壳 218 查看详情 闪念贝壳 这是整个解决方案的第一步,也是最关键的一步。它将原始Stream转换成一个Map。Collectors.groupingBy(MyType::getCategory):这是一个下游收集器,它根据MyType对象的category属性对元素进行分组。所有具有相同category值的对象会被分到同一个组。Collectors.counting():这是groupingBy的第二个参数,作为每个分组的“下游”收集器。它会统计每个分组中的元素数量,即每个类别的出现频率。这一步完成后,我们得到了一个包含每个类别及其出现次数的映射,例如{category1=3, categoryB=2, categoryA=2}。

categoryCounts.entrySet().stream()

我们现在需要对上一步生成的Map的键值对(Map.Entry)进行排序。entrySet()方法返回Map中所有键值对的Set视图,我们可以将其转换为一个Stream<Map.Entry>。

.sorted(Map.Entry.comparingByValue().reversed().thenComparing(Map.Entry.comparingByKey()))

这是实现多级排序的核心。Map.Entry.comparingByValue():这是一个静态方法,返回一个Comparator,用于按Map.Entry的值(即类别计数Long)进行自然顺序(升序)比较。.reversed():因为我们需要按计数降序排列(频率高的在前),所以我们调用reversed()来反转比较器的顺序。.thenComparing(Map.Entry.comparingByKey()):这是一个链式比较器。当主比较器(按计数)认为两个Entry相等时(即它们的计数相同),thenComparing会使用提供的次比较器(按键,即类别名称String)进行比较。comparingByKey()默认是按键的自然顺序(字母顺序)升序排列,这正是我们所需要的。

.map(Map.Entry::getKey)

排序完成后,我们不再需要Map.Entry的整个结构,只需要其中的键(类别名称)。map操作将每个Map.Entry转换为其对应的String类型的键。

.toList()

这是Java 16及更高版本中Stream接口的一个便捷方法,用于将Stream中的所有元素收集到一个新的List中。如果使用Java 11,需要替换为Collectors.toList()。

运行示例与结果

对于以下输入数据:

{    object1 :{category:"category1"},    object2 :{category:"categoryB"},    object3 :{category:"categoryA"},    object4 :{category:"category1"},    object5 :{category:"categoryB"},    object6 :{category:"category1"},    object7 :{category:"categoryA"}}

各类别出现频率如下:

category1: 3次categoryA: 2次categoryB: 2次

根据排序规则:

category1频率最高(3次),排第一。categoryA和categoryB频率相同(2次)。根据字母顺序,categoryA (A < B) 排在categoryB之前。

因此,最终输出的列表将是:

List = {category1, categoryA, categoryB}

这与我们的代码运行结果一致。

注意事项与总结

Stream的一次性消费: 始终牢记Stream是单次消费的。一旦调用了终端操作(如collect、forEach、toList等),该Stream就不能再被使用。本教程中的方法通过将原始Stream首先转换为一个中间数据结构(Map),然后对这个中间结构进行Stream操作,巧妙地规避了这一限制。Java版本兼容性: 示例中使用了Stream.toList(),这是Java 16引入的。对于Java 11等早期版本,应使用collect(Collectors.toList())。性能考量: 这种方法在处理大量数据时是高效的。groupingBy和counting操作通常在O(N)时间复杂度内完成(N为Stream中的元素数量),而对Map Entry的排序则取决于Map中唯一类别的数量M,通常为O(M log M)。可读性与维护性: Java Stream API提供了一种声明式编程风格,使得代码意图清晰,易于理解和维护。通过链式调用,可以将复杂的数据转换逻辑表达得简洁而富有表现力。

通过本文的学习,您应该能够熟练运用Java Stream API进行复杂的数据聚合、多级排序等操作,从而更高效地处理各种数据转换需求。

以上就是Java Stream:高效分组、计数与多级排序实践的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/978354.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
iPhone 16 Pro系列首发翻车:用户实测触摸屏失灵
上一篇 2025年12月1日 20:21:25
汽车电脑检测仪价格 | 汽车故障诊断仪选购指南
下一篇 2025年12月1日 20:21:27

相关推荐

  • MAC系统怎么开启防火墙_MAC开启防火墙教程

    1、建议在Mac系统中开启防火墙以提升网络安全,可通过“系统设置”中的“网络-防火墙”选项启用;2、高级用户可使用终端命令sudo /usr/libexec/ApplicationFirewall/socketfilterfw –setglobalstate on开启服务;3、启用后可在…

    2026年9月24日
    100
  • 如何在mysql中升级高可用集群

    先确认版本兼容性、应用依赖及备份完整性,再按架构选择升级路径。对Group Replication或InnoDB Cluster采用滚动升级,先升从节点最后升主节点;MHA/Orchestrator架构先升备库再切换主库;PXC需停集群全量升级。替换二进制后启动实例并运行mysql_upgrade,…

    2026年9月24日
    000
  • laravel怎么配置Octane并选择Swoole或RoadRunner_laravel Octane Swoole/RoadRunner配置方法

    Laravel Octane通过Swoole或RoadRunner提升应用性能,需安装扩展包并发布配置文件;选择Swoole需安装PHP扩展并设置driver为’swoole’,启动服务时可加–watch实现热重载;选择RoadRunner则自动安装二进制文件,配…

    2026年9月24日
    100
  • Java Map.entrySet遍历性能优化

    使用增强for循环遍历Map.entrySet()更高效,避免显式声明Iterator;提前缓存key和value减少重复调用;优先选用HashMap提升性能;大数据量可考虑parallelStream并行处理,但需权衡开销。 在Java中,Map.entrySet() 是遍历键值对最常用的方式之一…

    2026年9月24日
    100
  • 如何查找大文件 find命令按大小搜索技巧

    如何查找大文件 find命令按大小搜索技巧如何查找大文件 find命令按大小搜索技巧如何查找大文件 find命令按大小搜索技巧如何查找大文件 find命令按大小搜索技巧

    要在linux中查找大文件,首先使用find命令配合-size参数定位指定大小以上的文件,例如:find /path/to/search -type f -size +5m。其次结合-exec和du、sort等命令可对结果排序并显示详细信息。最后也可用du与sort组合快速列出最大文件,或安装ncd…

    2026年9月24日 用户投稿
    1600
  • 绝美后背! 日本妹子cos《寂静岭f》深水雏子

    绝美后背! 日本妹子cos《寂静岭f》深水雏子绝美后背! 日本妹子cos《寂静岭f》深水雏子绝美后背! 日本妹子cos《寂静岭f》深水雏子绝美后背! 日本妹子cos《寂静岭f》深水雏子

    《寂静岭f》女主角深水雏子近日在社交平台上引发热议,看似是普通的日本高中女生,实则性格果决、战斗力爆表。手持铁管正面硬刚女鬼的场面令人印象深刻,干脆利落的战斗风格让她迅速被玩家封神,成为《寂静岭》系列中最具冲击力的新角色之一。拥有30万粉丝的人气coser月海つくね(@XaiabP)也忍不住致敬这位…

    2026年9月24日 用户投稿
    100
  • 减少PHP与MySQL数据库通信的延迟

    减少php与mysql数据库通信的延迟可以通过以下策略:1. 优化数据库查询,使用索引提升查询速度;2. 减少数据库连接次数,使用连接池管理连接;3. 查询优化,使用explain分析查询计划;4. 使用缓存,如redis,减少数据库查询次数。这些方法能显著提升应用性能,但需权衡利弊,确保系统稳定性…

    2026年9月24日
    000
  • 讯维解决KVM鼠标不同步

    讯维解决KVM鼠标不同步讯维解决KVM鼠标不同步讯维解决KVM鼠标不同步讯维解决KVM鼠标不同步

    使用网络kvm时,常遇到本地鼠标与远程界面光标位置不一致的问题,即鼠标不同步现象,严重影响操作流畅性。可通过优化鼠标同步设置、更新驱动程序或选用兼容性更强的设备来有效改善。 1、配置运行Windows 2000操作系统的服务器环境 2、调整鼠标相关参数 3、点击开始菜单,进入控制面板,选择“鼠标”进…

    2026年9月24日 用户投稿
    900
  • 对于2K分辨率游戏玩家而言,中端显卡是否已能完全满足未来两三年的需求?

    中端显卡在2025年仍可满足2K游戏需求,关键在于选择12GB以上显存并支持DLSS 4或FSR 3.1技术的型号,如RTX 5060 Ti 16GB、RX 7700 XT或RX 6750 GRE 12GB,配合超分技术可在多数主流游戏中实现高帧率流畅体验。 对于2K分辨率的游戏玩家,中端显卡在20…

    2026年9月24日
    800
  • Java泛型擦除机制对对象类型的影响

    泛型擦除使Java在编译后移除类型信息,导致运行时无法判断具体泛型类型,影响类型检查、反射获取及继承多态,需通过桥接方法等机制保证一致性。 Java的泛型擦除机制在编译期会移除泛型类型信息,导致运行时无法获取具体的泛型参数类型。这一机制直接影响了对象类型的判断、反射操作以及继承中的类型处理。 泛型擦…

    2026年9月24日
    300
  • mac怎么分屏_mac分屏操作方法

    通过快捷键、拖拽或调整比例可高效使用Mac分屏功能。首先点击并按住绿色按钮选择窗口配对,或拖动窗口至屏幕边缘自动进入分屏;随后可调节分割线更改窗口比例;退出时点击顶部绿色按钮即可恢复普通模式。 如果您希望在使用 Mac 时提高多任务处理效率,可以通过分屏功能同时查看和操作两个应用程序。该功能允许用户…

    2026年9月24日
    300
  • 如何分析Linux进程内存 pmap内存映射检查方法

    如何分析Linux进程内存 pmap内存映射检查方法如何分析Linux进程内存 pmap内存映射检查方法如何分析Linux进程内存 pmap内存映射检查方法如何分析Linux进程内存 pmap内存映射检查方法

    要分析linux进程的内存,特别是利用pmap工具,核心操作是获取目标进程pid后执行pmap -x 。1. 获取pid可通过ps aux | grep your_process_name;2. 执行pmap -x 命令查看扩展格式信息,包括address、kbytes、rss、dirty、mode…

    2026年9月24日 用户投稿
    200
  • 如何实现Linux与Windows双系统引导管理?

    答案是先安装Windows再安装Linux,使用GRUB引导;需注意引导模式(UEFI/Legacy)与分区策略(ESP、/、swap、/home),并可通过Live USB修复GRUB。 实现Linux与Windows双系统引导管理,核心在于一个可靠的引导加载器,通常是Linux在安装时提供的GR…

    2026年9月24日
    300
  • PHP实时输出如何防止XSS攻击_PHP实时输出安全防范XSS攻击

    防止XSS攻击需坚持三重防护:首先对用户输入进行严格验证与白名单过滤,使用filter_var等函数校验数据格式;其次根据输出上下文进行恰当转义——HTML正文和属性用htmlspecialchars(),JavaScript变量用json_encode(),URL参数用urlencode();最后…

    2026年9月24日
    100
  • 2025年生成漫画图片的AI工具Top10盘点

    2025年生成漫画图片的AI工具Top10盘点2025年生成漫画图片的AI工具Top10盘点2025年生成漫画图片的AI工具Top10盘点2025年生成漫画图片的AI工具Top10盘点

    2025年AI漫画工具已深度融入创作全流程,十大工具各具特色:ComiGenius Pro 3.0强于叙事连贯与情绪表达,MangaFlow AI专精日漫风格,PanelCraft AI优化分镜布局,StorySketcher 2025实现故事可视化,Artisan Studio X支持多风格模拟,…

    2026年9月24日 用户投稿
    600
  • Java Optional.orElse与orElseGet区别

    orElse总是执行默认值计算,而orElseGet仅在Optional为空时调用Supplier获取,默认值构造 costly 时应优先使用orElseGet以避免性能浪费。 在 Java 8 引入的 Optional 类中,orElse 和 orElseGet 都用于在 Optional 值为空…

    2026年9月24日
    000
  • VSCode如何优化多语言混编 VSCode复合工程项目的管理技巧

    #%#$#%@%@%$#%$#%#%#$%@_e2fc++805085e25c9761616c00e065bfe8处理多语言混编和复杂项目的核心策略是使用多根工作区(multi-root workspace),通过创建.code-workspace文件将不同语言或模块的目录统一管理,实现跨项目文件浏…

    2026年9月24日
    000
  • Java中接口常量和类常量的使用区别

    接口常量默认public static final,用于行为契约但易导致职责模糊;类常量可用不同访问修饰符,更适合封装和维护。现代Java推荐使用专用常量类、枚举、私有静态常量或配置文件管理常量,以提升代码清晰度与可维护性。 Java中接口常量和类常量,核心区别在于它们的定义位置和隐式属性。接口常量…

    2026年9月24日
    000
  • AI PC的概念是炒作还是未来趋势?

    AI PC正通过专用芯片、本地化智能和新交互模式重塑个人电脑。专用NPU算力突破50TOPS,使设备可高效运行图像识别、语音分析等AI任务,实现快速安全的本地处理;高通在骁龙X Elite上运行130亿参数大模型,微软Windows 11原生支持本地AI,让文档润色、图像修复等操作可在无网环境下完成…

    2026年9月24日
    200
  • 文字生成图片的AI工具2025十大好用推荐

    2025年热门AI文生图工具包括DALL-E 3、Midjourney、Stable Diffusion XL等,具备高图像质量、快速生成、强语义理解与精细风格控制,适用于不同用户需求,未来趋势指向更高清、更智能、更集成的创作生态。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使…

    2026年9月24日
    200

发表回复

登录后才能评论
关注微信