| pandas | Data manipulation | Dataframes, groupby, merge, pivot, filtering, reshaping, time series |
| NumPy | Numerical computing | Arrays, linear algebra, random sampling, mathematical operations |
| SciPy | Scientific computing | Statistical tests (t-test, chi-square, ANOVA), distributions, optimization, signal processing |
| StatsModels | Statistical analysis | Regression (OLS, logistic, Poisson), time series (ARIMA, SARIMAX), hypothesis testing |
| scikit-learn | Machine learning | Classification, regression, clustering, dimensionality reduction, preprocessing, model evaluation |
| matplotlib | Static visualization | Publication-quality charts, custom layouts, export to image |
| plotly | Interactive visualization | Interactive charts, 3D plots, dashboards, hover tooltips |
| seaborn | Statistical visualization | Heatmaps, pair plots, distribution plots, regression plots |
| bokeh | Interactive visualization | Browser-based interactive charts, streaming data |
| transformers | NLP / Deep learning | Hugging Face models for text classification, summarization, translation, sentiment analysis |
| TabPFN | AutoML | In-context learning for tabular prediction and classification without training |
| BeautifulSoup | Web scraping | HTML/XML parsing, data extraction from web pages |
| SQLAlchemy | Database | ORM, database connectivity, query building |
| DuckDB | In-browser SQL | Fast analytical queries on dataframes and files, process multi-GB datasets |
| huggingface-hub | Model hub | Access and download models from the Hugging Face Hub |
| Pyodide | Python runtime | Python execution in the browser via WebAssembly |
| dbt | Data transformation | SQL-based data transformation pipelines |
| Apache Arrow | Data processing | Columnar in-memory data format for fast analytics |