convert
Convert SQL queries to PySpark code, handle batch file and directory conversions, and extract SQL from PDFs for PySpark processing.
Instructions
Convert SQL to PySpark code or process SQL files in batch.
Modes:
sql
Convert a single SQL query to PySpark code.
Parameters: sql_query (required), table_info, dialect,
optimization_level, include_glue_template, style
(production | notebook), target (spark | glue)
batch_files
Process multiple SQL files into PySpark.
Parameters: file_paths (required list), output_dir, job_name
batch_dir
Process all SQL files in a directory.
Parameters: directory_path (required), output_dir, recursive,
job_name
from_pdf
Extract SQL from a PDF file and convert to PySpark.
Parameters: pdf_path (required)
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| mode | Yes | ||
| style | No | production | |
| target | No | spark | |
| dialect | No | ||
| job_name | No | ||
| pdf_path | No | ||
| recursive | No | ||
| sql_query | No | ||
| file_paths | No | ||
| output_dir | No | ||
| table_info | No | ||
| directory_path | No | ||
| optimization_level | No | standard | |
| include_glue_template | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||