Java中List去重和Stream去重的示例分析

這篇文章主要介紹了Java中List去重和Stream去重的示例分析,具有一定借鑒價值,感興趣的朋友可以參考下,希望大家閱讀完這篇文章之后大有收獲,下面讓小編帶著大家一起了解一下。

成都創新互聯公司-專業網站定制、快速模板網站建設、高性價比正安網站開發、企業建站全套包干低至880元,成熟完善的模板庫,直接使用。一站式正安網站制作公司更省心,省錢,快速模板網站建設找我們,業務覆蓋正安地區。費用合理售后完善,十余年實體公司更值得信賴。

問題

當下互聯網技術成熟,越來越多的趨向去中心化、分布式、流計算,使得很多以前在數據庫側做的事情放到了Java端。今天有人問道,如果數據庫字段沒有索引,那么應該如何根據該字段去重?大家都一致認為用Java來做,但怎么做呢?

解答

忽然想起以前寫過list去重的文章,找出來一看。做法就是將list中對象的hashcode和equals方法重寫,然后丟到HashSet里,然后取出來。這是最初剛學Java的時候像被字典一樣背寫出來的答案。就比如面試,面過號稱做了3年Java的人,問Set和HashMap的區別可以背出來,問如何實現就不知道了。也就是說,初學者只背特性。但真正在項目中使用的時候你需要確保一下是不是真的這樣。因為背書沒用,只能相信結果。你需要知道HashSet如何幫我做到去重了。換個思路,不用HashSet可以去重嗎?最簡單,最直接的辦法不就是每次都拿著和歷史數據比較,都不相同則插入隊尾。而HashSet只是加速了這個過程而已。

首先,給出我們要排序的對象User

@Data
@Builder
@AllArgsConstructor
public class User {
 private Integer id;
 private String name;
}
List<User> users = Lists.newArrayList(
    new User(1, "a"),
    new User(1, "b"),
    new User(2, "b"),
    new User(1, "a"));

目標是取出id不重復的user,為了防止扯皮,給個規則,只要任意取出id唯一的數據即可,不用拘泥id相同時算哪個。

用最直觀的辦法

這個辦法就是用一個空list存放遍歷后的數據。

@Test
public void dis1() {
  List<User> result = new LinkedList<>();
  for (User user : users) {
   boolean b = result.stream().anyMatch(u -> u.getId().equals(user.getId()));
   if (!b) {
    result.add(user);
   }
  }
  System.out.println(result);
}

用HashSet

背過特性的都知道HashSet可以去重,那么是如何去重的呢? 再深入一點的背過根據hashcode和equals方法。那么如何根據這兩個做到的呢?沒有看過源碼的人是無法繼續的,面試也就到此結束了。

事實上,HashSet是由HashMap來實現的(沒有看過源碼的時候曾經一直直觀的以為HashMap的key是HashSet來實現的,恰恰相反)。這里不展開敘述,只要看HashSet的構造方法和add方法就能理解了。

public HashSet() {
  map = new HashMap<>();
}
/**
* 顯然,存在則返回false,不存在的返回true
*/
public boolean add(E e) {
  return map.put(e, PRESENT)==null;
}

那么,由此也可以看出HashSet的去重復就是根據HashMap實現的,而HashMap的實現又完全依賴于hashcode和equals方法。這下就徹底打通了,想用HashSet就必須看好自己的這兩個方法。

在本題目中,要根據id去重,那么,我們的比較依據就是id了。修改如下:

@Override
public boolean equals(Object o) {
  if (this == o) {
   return true;
  }
  if (o == null || getClass() != o.getClass()) {
   return false;
  }
  User user = (User) o;
  return Objects.equals(id, user.id);
}
@Override
public int hashCode() {
  return Objects.hash(id);
}
//hashcode
result = 31 * result + (element == null ? 0 : element.hashCode());

其中, Objects調用Arrays的hashcode,內容如上述所示。乘以31等于x<<5-x。

最終實現如下:

@Test
public void dis2() {
  Set<User> result = new HashSet<>(users);
  System.out.println(result);
}

使用Java的Stream去重

回到最初的問題,之所以提這個問題是因為想要將數據庫側去重拿到Java端,那么數據量可能比較大,比如10w條。對于大數據,采用Stream相關函數是最簡單的了。正好Stream也提供了distinct函數。那么應該怎么用呢?

users.parallelStream().distinct().forEach(System.out::println);

沒看到用lambda當作參數,也就是沒有提供自定義條件。幸好Javadoc標注了去重標準:

Returns a stream consisting of the distinct elements
(according to {@link Object#equals(Object)}) of this stream.

我們知道,也必須背過這樣一個準則:equals返回true的時候,hashcode的返回值必須相同. 這個在背的時候略微有些邏輯混亂,但只要了解了HashMap的實現方式就不會覺得拗口了。HashMap先根據hashcode方法定位,再比較equals方法。

所以,要使用distinct來實現去重,必須重寫hashcode和equals方法,除非你使用默認的。

那么,究竟為啥要這么做?點進去看一眼實現。

<P_IN> Node<T> reduce(PipelineHelper<T> helper, Spliterator<P_IN> spliterator) {
  // If the stream is SORTED then it should also be ORDERED so the following will also
  // preserve the sort order
  TerminalOp<T, LinkedHashSet<T>> reduceOp
      = ReduceOps.<T, LinkedHashSet<T>>makeRef(LinkedHashSet::new, LinkedHashSet::add,                           LinkedHashSet::addAll);
  return Nodes.node(reduceOp.evaluateParallel(helper, spliterator));
}

內部是用reduce實現的啊,想到reduce,瞬間想到一種自己實現distinctBykey的方法。我只要用reduce,計算部分就是把Stream的元素拿出來和我自己內置的一個HashMap比較,有則跳過,沒有則放進去。其實,思路還是最開始的那個最直白的方法。

@Test
public void dis3() {
  users.parallelStream().filter(distinctByKey(User::getId))
    .forEach(System.out::println);
}
public static <T> Predicate<T> distinctByKey(Function<? super T, ?> keyExtractor) {
  Set<Object> seen = ConcurrentHashMap.newKeySet();
  return t -> seen.add(keyExtractor.apply(t));
}

當然,如果是并行stream,則取出來的不一定是第一個,而是隨機的。

上述方法是至今發現最好的,無侵入性的。但如果非要用distinct。只能像HashSet那個方法一樣重寫hashcode和equals。

小結

會不會用這些東西,你只能去自己練習過,不然到了真正要用的時候很難一下子就拿出來,不然就冒險用。而若真的想大膽使用,了解規則和實現原理也是必須的。比如,LinkedHashSet和HashSet的實現有何不同。

附上賊簡單的LinkedHashSet源碼:

public class LinkedHashSet<E>
  extends HashSet<E>
  implements Set<E>, Cloneable, java.io.Serializable {
  private static final long serialVersionUID = -2851667679971038690L;
  public LinkedHashSet(int initialCapacity, float loadFactor) {
    super(initialCapacity, loadFactor, true);
  }
  public LinkedHashSet(int initialCapacity) {
    super(initialCapacity, .75f, true);
  }
  public LinkedHashSet() {
    super(16, .75f, true);
  }
  public LinkedHashSet(Collection<? extends E> c) {
    super(Math.max(2*c.size(), 11), .75f, true);
    addAll(c);
  }
  @Override
  public Spliterator<E> spliterator() {
    return Spliterators.spliterator(this, Spliterator.DISTINCT | Spliterator.ORDERED);
  }
}

Java中List去重和Stream去重的示例分析

Java中List去重和Stream去重的示例分析

補充:

Java中List集合去除重復數據的方法

1. 循環list中的所有元素然后刪除重復

public  static  List removeDuplicate(List list) {    
 for ( int i =  0 ; i < list.size() -  1 ; i ++ ) {    
   for ( int j = list.size() -  1 ; j > i; j -- ) {    
      if (list.get(j).equals(list.get(i))) {    
       list.remove(j);    
      }    
    }    
   }    
  return list;    
}

2. 通過HashSet踢除重復元素

public static List removeDuplicate(List list) {  
HashSet h = new HashSet(list);  
list.clear();  
list.addAll(h);  
return list;  
}

3. 刪除ArrayList中重復元素,保持順序

// 刪除ArrayList中重復元素,保持順序   
 public static void removeDuplicateWithOrder(List list) {  
  Set set = new HashSet();  
   List newList = new ArrayList();  
  for (Iterator iter = list.iterator(); iter.hasNext();) {  
     Object element = iter.next();  
     if (set.add(element))  
      newList.add(element);  
   }   
   list.clear();  
   list.addAll(newList);  
  System.out.println( " remove duplicate " + list);  
 }

4.把list里的對象遍歷一遍,用list.contain(),如果不存在就放入到另外一個list集合中

public static List removeDuplicate(List list){ 
    List listTemp = new ArrayList(); 
    for(int i=0;i<list.size();i++){ 
      if(!listTemp.contains(list.get(i))){ 
        listTemp.add(list.get(i)); 
      } 
    } 
    return listTemp; 
  }

感謝你能夠認真閱讀完這篇文章,希望小編分享的“Java中List去重和Stream去重的示例分析”這篇文章對大家有幫助,同時也希望大家多多支持創新互聯,關注創新互聯行業資訊頻道,更多相關知識等著你來學習!

網站名稱:Java中List去重和Stream去重的示例分析
當前路徑:http://m.kartarina.com/article30/jchdso.html

成都網站建設公司_創新互聯,為您提供網站排名商城網站網站維護標簽優化定制開發做網站

廣告

聲明:本網站發布的內容(圖片、視頻和文字)以用戶投稿、用戶轉載內容為主,如果涉及侵權請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網站立場,如需處理請聯系客服。電話:028-86922220;郵箱:631063699@qq.com。內容未經允許不得轉載,或轉載時需注明來源: 創新互聯

營銷型網站建設
主站蜘蛛池模板: 免费无码又爽又刺激网站直播 | 亚欧无码精品无码有性视频| 人妻丰满熟妇av无码区不卡| 亚洲aⅴ天堂av天堂无码麻豆| 中文字幕人妻无码专区| 亚洲综合无码无在线观看| 亚洲国产精品成人精品无码区 | 无码专区永久免费AV网站| 国产成人无码AV一区二区在线观看| av无码免费一区二区三区| 狠狠躁天天躁无码中文字幕| 在线观看成人无码中文av天堂| 亚洲中文字幕无码久久综合网| 精品无码中文视频在线观看| 精品无码人妻一区二区三区品 | 人妻无码中文字幕| 亚洲中文字幕无码久久| 国产色爽免费无码视频| 亚洲精品无码成人片在线观看| 亚洲熟妇无码一区二区三区导航| 久久精品中文字幕无码| 寂寞少妇做spa按摩无码| 国产精品亚洲专区无码不卡| 色综合无码AV网站| 无码办公室丝袜OL中文字幕| 无码人妻一区二区三区免费手机| 日韩精品专区AV无码| 日韩网红少妇无码视频香港| 无码国产午夜福利片在线观看| 久久精品成人无码观看56| 久久久久无码国产精品一区| 国产精品无码AV一区二区三区| 在线播放无码后入内射少妇| 免费无码H肉动漫在线观看麻豆| 国产网红主播无码精品| 中文无码成人免费视频在线观看| 韩国19禁无遮挡啪啪无码网站| 国产成人无码一区二区在线观看| 亚洲精品成人无码中文毛片不卡| 高潮潮喷奶水飞溅视频无码| 亚洲av无码成人黄网站在线观看 |