登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
16644+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
集群配置
,共找到
47
条记录
默认排序
最新上传
最多下载
CAST AI性能调优指南
castai-performance-tuning
jeremylongshore/claude-code-plugins-plus-skills
145
本技能提供了一套全面的指导,用于优化CAST AI的核心性能指标。内容涵盖节点预配速度、自动扩缩容的响应速度,以及多集群仪表板的API调用效率。通过配置资源预留(Headroom)、选择最佳实例族群和调优清理机制,帮助用户提升系统的可用性和成本效益。
查看详情
Kubernetes上部署CAST AI
castai-install-auth
jeremylongshore/claude-code-plugins-plus-skills
496
本技能提供了一份完整的指南,用于将任何Kubernetes集群(如EKS, GKE, AKS)连接到CAST AI。它涵盖了从API密钥的生成,到使用Helm图表安装CAST AI代理,再到通过Terraform配置提供商的整个流程,旨在实现成本优化、自动伸缩和安全监控。
查看详情
CAST AI多集群参考架构
castai-reference-architecture
jeremylongshore/claude-code-plugins-plus-skills
479
本指南提供了一套完整的CAST AI多集群部署参考架构,用于管理开发、预发布和生产环境的CAST AI服务。它详细介绍了使用Terraform进行基础设施资源配置的最佳实践,尤其侧重于成本优化策略,包括自动伸缩、使用竞价实例和环境特定的资源策略,帮助团队建立标准化的、高可靠且成本可控的部署流程。
查看详情
CAST AI自动扩缩容配置
castai-core-workflow-a
jeremylongshore/claude-code-plugins-plus-skills
492
本工作流指导用户配置CAST AI的自动扩缩容策略,实现Kubernetes集群的最佳成本管理和资源利用。内容涵盖启用竞价实例(Spot Instances)、设置节点下沉/驱逐规则、定义集群限制,并通过Terraform创建特定工作负载的节点模板,确保资源分配的稳定性和成本效益。
查看详情
CAST AI K8s成本优化
castai-cost-tuning
jeremylongshore/claude-code-plugins-plus-skills
236
本技能提供了一套完整的指南和脚本,用于利用CAST AI技术最大化Kubernetes集群的成本节约。用户可以学习配置竞价实例、执行工作负载资源右缩减,并在非生产环境设置集群休眠,从而显著降低云基础设施的运行成本。
查看详情
CAST AI生产环境检查清单
castai-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
434
这是一份用于在生产级Kubernetes集群上部署和验证CAST AI成本优化及自动伸缩功能的完整检查清单。它涵盖了从环境先决条件、初始监控配置(阶段1),到高级自动伸缩开启(阶段2)、安全加固(RBAC、密钥管理)以及最终的上线验证步骤,确保系统平稳过渡到生产环境。
查看详情
CAST AI Webhook事件与通知配置
castai-webhooks-events
jeremylongshore/claude-code-plugins-plus-skills
243
本指南详细介绍了如何配置CAST AI的Webhook通知和审计日志。用户可以设置实时警报,用于监控关键集群事件,如节点扩展、成本超限或安全发现。通过集成Slack、PagerDuty等服务,实现对基础设施操作的全面监控和自动化响应。
查看详情
CoreWeave分布式GPU训练工作流
coreweave-core-workflow-b
jeremylongshore/claude-code-plugins-plus-skills
142
本指南详细介绍了如何在CoreWeave平台上运行大规模的分布式GPU训练任务。它涵盖了单节点多GPU配置和多节点训练,支持PyTorch DDP,是进行大型语言模型(LLM)微调或需要高性能计算集群的深度学习模型训练的推荐工作流。
查看详情
CoreWeave GPU推理服务部署
coreweave-deploy-integration
jeremylongshore/claude-code-plugins-plus-skills
146
本技能旨在指导用户在CoreWeave Kubernetes集群上部署和管理GPU加速的AI推理服务。内容涵盖了从Docker容器化、配置GPU资源限制(如A100/H100),到设置健康检查和执行滚动更新的全流程最佳实践,适用于大规模多模型推理和云端AI工作负载管理。
查看详情
CoreWeave K8s环境设置与认证
coreweave-install-auth
jeremylongshore/claude-code-plugins-plus-skills
349
本指南提供了一套完整的CoreWeave Kubernetes服务(CKS)配置流程。内容包括如何下载kubeconfig文件、设置API令牌以及使用`kubectl`命令验证GPU资源访问。适用于所有需要在裸金属GPU集群上部署AI/ML工作负载的用户。
查看详情
Fly.io核心:数据库、存储与网络配置
flyio-core-workflow-b
jeremylongshore/claude-code-plugins-plus-skills
497
该技能指导用户在Fly.io上部署核心的生产级基础设施。内容涵盖创建和接入Postgres数据库集群,配置持久化Fly Volumes进行数据存储,以及设置私有内部网络(6PN),确保应用服务间具备高安全性的通信环境。适用于构建需要稳定数据库和持久化存储的复杂应用。
查看详情
Snowflake并发与限流管理
snowflake-rate-limits
jeremylongshore/claude-code-plugins-plus-skills
117
本指南详细介绍了Snowflake的性能和并发管理方法,帮助用户优化数据仓库的资源配置。内容涵盖仓库的正确尺寸调整、多集群设置、查询排队检测以及应用程序级别的速率限制,旨在解决并发限制和性能瓶颈,提升复杂数据分析的吞吐量。
查看详情
上一页
1
2
3
4
下一页
语言
简体中文
English