Stream的collect方法是怎么保证线程安全的

写这篇文章是因为前段时间有个同事用parallelStream处理集合的时候发现数据丢了。因为是线上问题所以和他一起看了一下。

出问题的代码大致如下:

List<Foobar> result = new ArrayList<>();
fooList.parallelStream().forEach(bar -> {
    Foobar foobar = new Foobar(bar);
    result.add(foobar);
});


最后results少了数据,得到了一个非预期的结果。

当然能写出这样的代码很不应该,很显然这是一个因为线程安全引发的问题,因为我们知道ArrayList不是一个线程安全的容器,这与parallelStream是不是线程安全无关,它本身就是一个用多线程去帮助我们处理集合的工具,底层依赖Fork/Join框架。

上面的写法就和自己用多个线程往一个ArrayList插数据一样愚蠢,没有本质上的区别。

那么,当我们在使用parallelStream的时候,我们当然可以使用一个线程安全的容器来收集结果,但Java官方文档中更建议我们去使用collect方法,即:

List<Foobar> result = fooList.parallelStream().map(bar -> new Foobar(bar)).collect(Collectors.toList());

我们来看collect这个方法,

<R, A> R collect(Collector<? super T, A, R> collector);

需要传入Collector接口的实现。Collectors类中有大量的静态方法返回这样的实现类的对象,这里我们看toList方法,

public static <T>
Collector<T, ?, List<T>> toList() {
    return new CollectorImpl<>((Supplier<List<T>>) ArrayList::new, List::add,
                               (left, right) -> { left.addAll(right); return left; },
                               CH_ID);
}

Fork/Join的思想是分治,先拆分任务,再合并结果,每个任务都用单独的线程去处理。所以虽然它同样使用ArrayList,但是我们看到他会为每个线程都创建一个ArrayList对象,最后用addAll方法把它们合并起来,每个线程操作的是自己的集合对象,自然不会有线程安全问题。

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值