登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
15857+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
Parquet
,共找到
7
条记录
默认排序
最新上传
最多下载
Ray数据处理平台
ray-data
Orchestra-Research/AI-Research-SKILLs
76
Ray Data 提供可扩展的分布式数据处理,支持 CPU/GPU 流式执行,兼容 Parquet、CSV、JSON、图像等多模态,集成 PyTorch、TensorFlow、Ray Train,适合批量推理、ETL 与大规模预处理。
查看详情
Vaex 大规模数据处理
vaex
K-Dense-AI/claude-scientific-skills
397
Vaex 是一款高性能 Python 库,利用延迟计算和磁盘外表格,能在内存不足时处理数十亿行数据,适合做大数据统计、可视化、格式转换及机器学习流程。
查看详情
Arize数据集管理与查询
arize-dataset
github/awesome-copilot
331
该技能提供了一套完整的Arize数据集管理能力,支持数据集的创建、版本化、查询和导出。用户可以通过`ax` CLI执行数据集的CRUD操作、追加示例记录,并以JSON、CSV等格式导出数据。特别适用于需要为模型开发和测试准备测试数据、生成评估样本或获取黄金数据集的场景。
查看详情
内存外海量数据分析
vaex
K-Dense-AI/scientific-agent-skills
209
Vaex是一个高性能的Python库,专为内存外(out-of-core)计算设计,能够处理和可视化超出系统内存限制的超大型表格数据集。它支持高效进行大规模数据筛选、统计聚合、可视化和构建机器学习模型,特别适用于单机环境下的TB级数据分析。
查看详情
Snowflake数据加载与ETL流程
snowflake-core-workflow-a
jeremylongshore/claude-code-plugins-plus-skills
302
本流程提供完整的Snowflake核心数据加载方案,涵盖了从S3/GCS等云存储到Snowflake表的全部数据管道构建。它详细介绍了阶段(Stage)的创建、文件格式定义、批量加载(COPY INTO)以及利用Snowpipe实现连续、实时的数据摄取,是构建ELT数据仓库管线的核心步骤。
查看详情
使用DuckDB查询OneLake数据
using-duckdb
data-goblin/power-bi-agentic-development
117
本技能详细介绍了如何在本地或Fabric Notebook环境中,使用DuckDB连接OneLake(一体化数据湖),查询存储的Delta Lake表和原始文件(如Parquet, CSV, JSON)。它支持本地CLI和Notebook两种模式,适用于数据探索、质量验证、模式发现等场景,功能为只读查询。
查看详情
临床数据文本去标识化
deidentify-a-dataset
maziyarpanahi/openmed
362
该工具用于对本地的结构化数据集(如CSV, JSONL, Parquet)中的自由文本列进行去标识化处理。它利用OpenMed模型移除个人健康信息(PHI),生成一个完全脱敏的数据集和一个不含PHI的聚合摘要,从而实现数据的安全共享和分析,同时确保源数据的隐私不泄露。
查看详情
1
语言
简体中文
English