我正在Databricks notebook上编写pyspark脚本来插入/更新/查询cassandra表,但是我找不到从表中删除行的方法,我尝试了sparksql: spark.sql("DELETEfrom users_by_email where email_address IN ('abc@test.com')") 我也不认为使用dataframe删除数据是可能的。
fileconfig['TransformQuery'] is not None: df = lspark.sql',lit(recordactiveind))applytransform模块返回一个py4j.java_gateway.JavaObject而不是常规的pyspark.sql.dataframe.DataFrameobject:
我想更新一个以orc格式的hive表,我可以从我的ambari hive视图中进行更新,但是无法从sacla运行相同的update语句(星火壳)。objHiveContext.sql("select * from table_name ")能够看到数据,但当我运行时
ObjHiveContext.sql(“table_name set column_name=‘the’")无法运行,出现了一些可注意的异常(更新附近的无效语法等),因为我可以从Ambari视图进行更新<