Python in worker has different version 3.6 than that in driver 3.7, PySpark cannot run with ……

背景
运行pyspark代码报错

Caused by: org.apache.spark.api.python.PythonException: Traceback (most recent call last):
  File "/usr/local/lib/python3.7/site-packages/pyspark/python/lib/pyspark.zip/pyspark/worker.py", line 262, in main
    ("%d.%d" % sys.version_info[:2], version))
Exception: Python in worker has different version 3.6 than that in driver 3.7, PySpark cannot run with different minor versions.Please check environment variables PYSPARK_PYTHON and PYSPARK_DRIVER_PYTHON are correctly set.

	at org.apache.spark.api.python.BasePythonRunner$ReaderIterator.handlePythonException(PythonRunner.scala:452)
	at org.apache.spark.api.python.PythonRunner$$anon$1.read(PythonRunner.scala:588)
	at org.apache.spark.api.python.PythonRunner$$anon$1.read(PythonRunner.scala:571)
	at org.apache.spark.api.python.BasePythonRunner$ReaderIterator.hasNext(PythonRunner.scala:406)
	at org.apache.spark.InterruptibleIterator.hasNext(InterruptibleIterator.scala:37)
	at scala.collection.Iterator$GroupedIterator.fill(Iterator.scala:1124)
	at scala.collection.Iterator$GroupedIterator.hasNext(Iterator.scala:1130)
	at scala.collection.Iterator$$anon$11.hasNext(Iterator.scala:409)
	at org.apache.spark.shuffle.sort.BypassMergeSortShuffleWriter.write(BypassMergeSortShuffleWriter.java:125)
	at org.apache.spark.scheduler.ShuffleMapTask.runTask(ShuffleMapTask.scala:99)
	at org.apache.spark.scheduler.ShuffleMapTask.runTask(ShuffleMapTask.scala:55)
	at org.apache.spark.scheduler.Task.run(Task.scala:121)
	at org.apache.spark.executor.Executor$TaskRunner$$anonfun$10.apply(Executor.scala:402)
	at org.apache.spark.util.Utils$.tryWithSafeFinally(Utils.scala:1360)
	at org.apache.spark.executor.Executor$TaskRunner.run(Executor.scala:408)
	at java.util.concurrent.ThreadPoolExecutor.runWorker(ThreadPoolExecutor.java:1149)
	at java.util.concurrent.ThreadPoolExecutor$Worker.run(ThreadPoolExecutor.java:624)
	... 1 more

在这里插入图片描述原因:
pyspark的python环境与driver也就是主节点的python环境版本不一致

修改:
python 代码中添加环境变量

import os
os.environ['PYSPARK_PYTHON']='/usr/local/bin/python3.7'

完美解决!
  • 5
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 2
    评论
在 Qt5 中,如果你在一个线程中创建了一个 QWidget 或其它继承自 QObject 的对象,并且尝试将其添加为另一个线程中的 QWidget 的子控件,就会出现 "cannot create children for a parent that is in a different thread" 的错误。这是因为 Qt5 中的对象树结构是线程特定的,一个对象只能属于一个线程。 为了解决这个问题,可以使用 Qt5 提供的信号和槽机制来在不同的线程之间进行通信。例如,你可以在一个线程中创建一个 QObject 对象,并使用 moveToThread() 方法将其移动到另一个线程中。然后,你可以在该对象中定义一个信号,并在另一个线程中连接该信号到一个槽函数,从而实现在不同线程中的通信。这样,你就可以避免在不同线程中创建或访问同一个 QWidget 的问题。 下面是一个示例代码: ```cpp // 在主线程中创建一个 QWidget QWidget *mainWidget = new QWidget; // 在另一个线程中创建一个 QObject 对象 QObject *workerObject = new QObject; // 将 workerObject 移动到另一个线程中 QThread *workerThread = new QThread; workerObject->moveToThread(workerThread); // 在 workerObject 中定义一个信号 signals: void dataReady(int value); // 在 mainWidget 中连接信号和槽函数 QObject::connect(workerObject, SIGNAL(dataReady(int)), mainWidget, SLOT(updateValue(int))); // 在 workerThread 中启动线程,并触发信号 workerThread->start(); emit workerObject->dataReady(42); ``` 在上面的代码中,我们在主线程中创建了一个 QWidget,并在另一个线程中创建了一个 QObject 对象,然后将其移动到了另一个线程中。我们在 workerObject 中定义了一个 dataReady() 信号,并在 mainWidget 中连接了这个信号到一个槽函数 updateValue()。最后,我们在 workerThread 中启动了线程,并触发了 dataReady() 信号。当信号被触发时,它会在 mainWidget 中调用 updateValue() 槽函数,从而更新界面。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值