Options
- Mark as New
- Bookmark
- Subscribe
- Mute
- Subscribe to RSS Feed
- Permalink
- Report Inappropriate Content
09-26-2024 09:12 AM
df1 has 1500 rows and df2 has 9 million rows, try broadcast join on df1
df= spark.sql("""SELECT /*+ BROADCAST(df1) */
df1.*, df2.* FROM df1 JOIN df2 ON ST_Intersects(df1.geometry, df2.geometry) """)
~