Java集合框架中元素去重方法

在Java集合框架中,重复元素最常用的方法是使用Set接口的特性,因为Set集合不允许存储重复元素。只要元素equals()hashCode()如果方法正确实现,插入时会自动去重。

使用Hashset去重(适用于无序场景)

将List或其它集合转换为Hashset,可以快速去除重复元素。

  • 适用于对顺序无要求的重场景
  • 基于Hashmap的底层,性能高
  • 注:确保元素类正确重写:equals()hashCode()

示例代码:

List<String> list = Arrays.asList("a", "b", "a", "c"); Set<String> set = new HashSet<>(list); // 结果:[a, b, c](顺序不保证)

使用LinkedHashset去重(保持插入顺序)

要保留元素首次出现的顺序,应使用LinkedHashset。

  • 同时维护插入顺序
  • 性能略低于Hashset,但顺序可控

示例代码:

List<String> list = Arrays.asList("a", "b", "a", "c"); Set<String> set = new LinkedHashSet<>(list); // 结果:[a, b, c](顺序与插入一致)

使用Stream.distinct()(函数编程)

Java 8及以上版本支持Stream链式操作去重。

  • 语法简洁,适用于流式处理
  • distinct()依赖equals和hashcodee
  • 可与其他中间操作组合使用

示例代码:

List<String> distinctList = list.stream() .distinct() .collect(Collectors.toList());

定制对象应注意注意事项

对于自定义类(如Person)、Student),必须重写equals()hashCode()方法,否则去重会失效。

  • IDE通常可以自动生成这两种方法
  • 建议生成基于关键业务字段的(如id)、name等))
  • 如果使用Lombok,可以使用@Data自动包含注释

例如:

@Data class Person { private String id; private String name; } // 使用@Data后,Lombok生成了equals和hashCode

基本上就是这样。根据是否需要保持顺序、JDK版本和数据类型,选择合适的方法。核心点是理解Set的去重机制依赖于对象的equals和hashcode。