AnalysisException: Path does not exist: dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;(分析异常:路径不存在:dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;)
本文介绍了分析异常:路径不存在:dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;的处理方法,对大家解决问题具有一定的参考价值,需要的朋友们下面随着小编来一起学习吧!
问题描述
我将以下代码打包到一个WHL文件中:
from pkg_resources import resource_filename
def path_to_model(anomaly_dir_name: str, data_path: str):
filepath = resource_filename(anomaly_dir_name, data_path)
return filepath
def read_data(spark) -> DataFrame:
return (spark.read.parquet(str(path_to_model("sampleFolder", "data"))))
我确认WHL文件正确地包含了sampleFold/data/目录下的拼图文件。当我在本地运行此程序时,它可以工作,但当我将此WHL文件上载到dBFS并运行时,我收到以下错误:
AnalysisException: Path does not exist: dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;
我确认此目录实际上并不存在:dBFS:/Databricks/python
知道这个错误可能是什么吗?
谢谢。
推荐答案
默认情况下,数据库上的Spark处理dBFS上的文件,直到您显式更改架构。在您的例子中,path_to_model函数返回字符串/databricks/python/lib/python3.7/site-packages/sampleFolder/data,因为它没有显式模式,所以Spark使用dbfs模式。但该文件在本地节点上,而不是在dBFS上-这就是Spark找不到它的原因。
dbutils.fs.cp命令来完成。将代码更改为:
def read_data(spark) -> DataFrame:
data_path = str(path_to_model("sampleFolder", "data"))
tmp_path = "/tmp/my_sample_data"
dbutils.fs.cp("file:" + data_path, tmp_path, True)
return (spark.read.parquet(tmp_path))
这篇关于分析异常:路径不存在:dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;的文章就介绍到这了,希望我们推荐的答案对大家有所帮助,也希望大家多多支持编程学习网!
织梦狗教程
本文标题为:分析异常:路径不存在:dbfs:/databricks/python/lib/python3.7/site-packages/sampleFolder/data;
基础教程推荐
猜你喜欢
- kivy 应用程序中的一个简单网页作为小部件 2022-01-01
- 比较两个文本文件以找出差异并将它们输出到新的文本文件 2022-01-01
- 究竟什么是“容器"?在蟒蛇?(以及所有的 python 容器类型是什么?) 2022-01-01
- Kivy 使用 opencv.调整图像大小 2022-01-01
- 对多索引数据帧的列进行排序 2022-01-01
- Python,确定字符串是否应转换为 Int 或 Float 2022-01-01
- matplotlib 设置 yaxis 标签大小 2022-01-01
- Python 中是否有任何支持将长字符串转储为块文字或折叠块的 yaml 库? 2022-01-01
- 在 Python 中将货币解析为数字 2022-01-01
- 在 Django Admin 中使用内联 OneToOneField 2022-01-01
