登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
15857+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
CoreWeave
,共找到
12
条记录
默认排序
最新上传
最多下载
CoreWeave GPU部署CI/CD集成
coreweave-ci-integration
jeremylongshore/claude-code-plugins-plus-skills
358
用于自动化CoreWeave GPU云工作负载的完整部署生命周期。该流程集成了单元测试、容器镜像构建(推送到GHCR)和到CoreWeave Kubernetes集群的滚动部署。适用于需要稳定、高性能部署的GPU依赖型机器学习推理模型。核心功能包括验证GPU资源请求和使用标准的Kubernetes API进行部署管理。
查看详情
CoreWeave GPU集群故障排查
coreweave-common-errors
jeremylongshore/claude-code-plugins-plus-skills
123
本指南旨在为用户提供一套完整的CoreWeave基础设施故障排除流程。它专门用于诊断和修复在使用Kubernetes部署AI/ML工作负载时遇到的核心问题,包括GPU资源调度、Pod状态异常、CUDA内存不足以及网络通信超时等。
查看详情
CoreWeave本地开发部署流程
coreweave-local-dev-loop
jeremylongshore/claude-code-plugins-plus-skills
455
本指南旨在为CoreWeave GPU部署提供完整的本地开发工作流。它涵盖了从本地构建Docker容器、使用kubectl进行YAML清单的预验证(dry-run),到最终部署AI推理服务所需的完整流程和最佳实践。
查看详情
CoreWeave GPU迁移与升级
coreweave-upgrade-migration
jeremylongshore/claude-code-plugins-plus-skills
157
该工具用于管理和自动化CoreWeave云基础设施的升级与迁移过程。它支持执行GPU型号升级(如A100到H100)、CUDA版本兼容性检查,并利用Kubernetes API审计部署、检测过时实例,确保集群平稳过渡。
查看详情
CoreWeave诊断信息收集包
coreweave-debug-bundle
jeremylongshore/claude-code-plugins-plus-skills
271
本工具用于收集CoreWeave集群的全面诊断信息,包括GPU节点状态、Kubernetes Pod日志、集群事件和资源分配情况。它将所有关键的系统诊断数据打包成一个归档文件,极大地简化了提交技术支持工单的流程,便于快速定位容器化环境下的故障根源。
查看详情
CoreWeave企业级RBAC权限管理
coreweave-enterprise-rbac
jeremylongshore/claude-code-plugins-plus-skills
280
本技能用于配置CoreWeave平台上的企业级RBAC(基于角色访问控制)和命名空间隔离策略。它指导用户如何为多团队的GPU工作负载设置严格的资源配额和权限边界,有效防止资源争抢(noisy-neighbor),实现资源隔离,并满足企业级的安全和合规性要求。
查看详情
CoreWeave多环境部署配置
coreweave-multi-env-setup
jeremylongshore/claude-code-plugins-plus-skills
252
本技能旨在指导用户在CoreWeave云平台上配置和管理多环境(开发、预发布、生产)的GPU基础设施。它通过隔离Kubernetes命名空间,为每个环境设置独立的GPU配额、扩缩容策略和访问控制,确保AI/ML工作负载的资源安全与稳定性,支持从开发到生产的完整推广流程。
查看详情
CoreWeave GPU工作负载监控
coreweave-observability
jeremylongshore/claude-code-plugins-plus-skills
450
用于为在Kubernetes上运行的CoreWeave GPU工作负载提供全面的可观测性监控。它实时跟踪GPU利用率、内存使用、推理延迟和作业完成率等关键指标。帮助用户建立监控看板和告警规则,主动发现资源浪费或系统故障,确保AI/ML应用的稳定和可靠运行。
查看详情
CoreWeave GPU性能调优指南
coreweave-performance-tuning
jeremylongshore/claude-code-plugins-plus-skills
495
本指南提供了在CoreWeave平台上优化GPU推理性能的专家策略。内容涵盖了根据不同工作负载(如LLM推理、图像生成、模型训练)选择最佳GPU、使用vLLM实现连续批处理优化,以及基于指标的HPA自动扩缩容配置。帮助用户最大化GPU利用率,降低推理延迟,提升AI模型部署效率。
查看详情
CoreWeave生产部署检查清单
coreweave-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
232
这份清单用于指导将GPU工作负载(如推理服务或模型训练)从开发环境迁移到CoreWeave生产环境的全部关键步骤。它系统地覆盖了自动伸缩、资源配置、安全策略、持久化存储、性能监控和故障回滚等MLOps及DevOps最佳实践。
查看详情
核心云资源配额与限流管理
coreweave-rate-limits
jeremylongshore/claude-code-plugins-plus-skills
438
本技能用于管理CoreWeave云服务的GPU配额和速率限制。它提供了使用`kubectl`检查资源配额的方法,并演示了使用Python `asyncio`实现推理请求队列,确保在高并发环境下资源分配的稳定性和效率。
查看详情
CoreWeave GPU工作负载安全配置
coreweave-security-basics
jeremylongshore/claude-code-plugins-plus-skills
200
本技能旨在指导用户如何在CoreWeave平台上安全部署GPU工作负载。涵盖了从API密钥管理、RBAC权限控制到网络策略(NetworkPolicy)的全面安全最佳实践。帮助用户有效隔离命名空间、保护模型权重和敏感训练数据,确保云原生环境的高安全性。
查看详情
1
语言
简体中文
English