登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
16569+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
Kubernetes
,共找到
167
条记录
默认排序
最新上传
最多下载
CoreWeave诊断信息收集包
coreweave-debug-bundle
jeremylongshore/claude-code-plugins-plus-skills
271
本工具用于收集CoreWeave集群的全面诊断信息,包括GPU节点状态、Kubernetes Pod日志、集群事件和资源分配情况。它将所有关键的系统诊断数据打包成一个归档文件,极大地简化了提交技术支持工单的流程,便于快速定位容器化环境下的故障根源。
查看详情
CoreWeave GPU推理服务部署
coreweave-deploy-integration
jeremylongshore/claude-code-plugins-plus-skills
146
本技能旨在指导用户在CoreWeave Kubernetes集群上部署和管理GPU加速的AI推理服务。内容涵盖了从Docker容器化、配置GPU资源限制(如A100/H100),到设置健康检查和执行滚动更新的全流程最佳实践,适用于大规模多模型推理和云端AI工作负载管理。
查看详情
CoreWeave企业级RBAC权限管理
coreweave-enterprise-rbac
jeremylongshore/claude-code-plugins-plus-skills
280
本技能用于配置CoreWeave平台上的企业级RBAC(基于角色访问控制)和命名空间隔离策略。它指导用户如何为多团队的GPU工作负载设置严格的资源配额和权限边界,有效防止资源争抢(noisy-neighbor),实现资源隔离,并满足企业级的安全和合规性要求。
查看详情
CoreWeave GPU工作负载部署
coreweave-hello-world
jeremylongshore/claude-code-plugins-plus-skills
436
本指南提供在CoreWeave平台上使用Kubernetes(kubectl)部署GPU工作负载的教程。内容包括部署vLLM服务进行大型语言模型(LLM)推理测试,以及运行CUDA批量作业进行性能基准测试。适用于首次部署GPU任务或验证集群访问的场景。
查看详情
CoreWeave故障排查手册
coreweave-incident-runbook
jeremylongshore/claude-code-plugins-plus-skills
430
这是一份用于CoreWeave平台的关键生产环境故障排除手册。它提供了应对GPU工作负载故障、推理服务宕机或Kubernetes资源问题的结构化步骤,指导用户检查Pod状态、节点健康和模型加载错误,以实现快速恢复服务。
查看详情
CoreWeave K8s环境设置与认证
coreweave-install-auth
jeremylongshore/claude-code-plugins-plus-skills
349
本指南提供了一套完整的CoreWeave Kubernetes服务(CKS)配置流程。内容包括如何下载kubeconfig文件、设置API令牌以及使用`kubectl`命令验证GPU资源访问。适用于所有需要在裸金属GPU集群上部署AI/ML工作负载的用户。
查看详情
云端机器学习工作负载迁移指南
coreweave-migration-deep-dive
jeremylongshore/claude-code-plugins-plus-skills
205
本技能包详细指导用户如何将机器学习工作负载(包括推理服务和训练管道)从AWS/GCP/Azure等大型云平台迁移到CoreWeave GPU云。内容涵盖成本对比、容器化步骤、Kubernetes配置适配和分阶段部署,帮助用户确保迁移过程平稳、高效且具成本效益。
查看详情
CoreWeave多环境部署配置
coreweave-multi-env-setup
jeremylongshore/claude-code-plugins-plus-skills
252
本技能旨在指导用户在CoreWeave云平台上配置和管理多环境(开发、预发布、生产)的GPU基础设施。它通过隔离Kubernetes命名空间,为每个环境设置独立的GPU配额、扩缩容策略和访问控制,确保AI/ML工作负载的资源安全与稳定性,支持从开发到生产的完整推广流程。
查看详情
CoreWeave GPU工作负载监控
coreweave-observability
jeremylongshore/claude-code-plugins-plus-skills
450
用于为在Kubernetes上运行的CoreWeave GPU工作负载提供全面的可观测性监控。它实时跟踪GPU利用率、内存使用、推理延迟和作业完成率等关键指标。帮助用户建立监控看板和告警规则,主动发现资源浪费或系统故障,确保AI/ML应用的稳定和可靠运行。
查看详情
CoreWeave GPU云参考架构
coreweave-reference-architecture
jeremylongshore/claude-code-plugins-plus-skills
347
本参考架构提供了一套在CoreWeave GPU云上部署机器学习模型的完整蓝图。它详细描述了多模型服务(如vLLM, TGI)的Kubernetes部署结构、共享持久化存储(PVC)以及基于KServe/Knative的自动扩缩容机制。适用于设计鲁棒的MLOps流程、规划高性能多模型推理服务,或建立标准的GPU云部署规范。
查看详情
CoreWeave GPU工作负载模式
coreweave-sdk-patterns
jeremylongshore/claude-code-plugins-plus-skills
395
该SDK提供了一系列生产级的Python模式,用于在CoreWeave平台上管理GPU计算任务。它帮助用户定义GPU资源规格、设置节点亲和性,并生成完整的Kubernetes部署模板。适用于构建稳定可靠的AI推理客户端、管理GPU基础设施或自动化复杂的AI工作流。
查看详情
CoreWeave GPU工作负载安全配置
coreweave-security-basics
jeremylongshore/claude-code-plugins-plus-skills
200
本技能旨在指导用户如何在CoreWeave平台上安全部署GPU工作负载。涵盖了从API密钥管理、RBAC权限控制到网络策略(NetworkPolicy)的全面安全最佳实践。帮助用户有效隔离命名空间、保护模型权重和敏感训练数据,确保云原生环境的高安全性。
查看详情
上一页
1
2
3
...
8
9
10
11
12
13
14
下一页
语言
简体中文
English