登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
15857+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
GPU
,共找到
8
条记录
默认排序
最新上传
最多下载
Vast.ai GPU监控与成本追踪
vastai-observability
jeremylongshore/claude-code-plugins-plus-skills
241
本技能提供Vast.ai GPU实例的全面监控方案,可采集GPU利用率、实例运行状态、温度和成本累积等关键指标。适用于搭建监控仪表板、配置告警机制(如GPU空闲、过热、预算超支)以及自动化云资源使用跟踪,确保资源健康和成本可控。
查看详情
CoreWeave GPU推理服务部署
coreweave-deploy-integration
jeremylongshore/claude-code-plugins-plus-skills
146
本技能旨在指导用户在CoreWeave Kubernetes集群上部署和管理GPU加速的AI推理服务。内容涵盖了从Docker容器化、配置GPU资源限制(如A100/H100),到设置健康检查和执行滚动更新的全流程最佳实践,适用于大规模多模型推理和云端AI工作负载管理。
查看详情
CoreWeave故障排查手册
coreweave-incident-runbook
jeremylongshore/claude-code-plugins-plus-skills
430
这是一份用于CoreWeave平台的关键生产环境故障排除手册。它提供了应对GPU工作负载故障、推理服务宕机或Kubernetes资源问题的结构化步骤,指导用户检查Pod状态、节点健康和模型加载错误,以实现快速恢复服务。
查看详情
CoreWeave GPU工作负载事件监控
coreweave-webhooks-events
jeremylongshore/claude-code-plugins-plus-skills
416
该工具通过Webhook机制,实时监控CoreWeave集群的GPU工作负载状态和生命周期事件。它追踪Pod就绪状态、任务完成、存储挂载和节点健康状况,是构建大规模GPU推理和训练任务的自动化扩展、告警及恢复流程的核心组件。
查看详情
启智平台GPU任务管理工具
qzcli
wanshuiyin/Auto-claude-code-research-in-sleep
250
qzcli是一个类kubectl/docker的命令行工具,专门用于在启智平台上管理和调度GPU计算任务。它可以用于登录集群、检查节点可用性、发现工作空间,并提交复杂的GPU、CPU或批处理作业。
查看详情
I3D图形学会议投稿策略指南
acm-siggraph-symposium-on-interactive-3d-graphics-and-games
brycewang-stanford/Awesome-Journal-Skills
354
本指南旨在帮助作者为ACM I3D图形学研讨会定位研究论文。内容涵盖实时渲染、交互式3D系统和GPU算法等核心主题,指导作者如何构建研究框架、补充证据,并与相关学术会议进行对比,以提高投稿成功率。
查看详情
MLSys会议投稿全流程规划
mlsys-workflow
brycewang-stanford/Awesome-Journal-Skills
441
这是一个用于管理机器学习系统会议(MLSys)投稿全生命周期的项目指南。它涵盖了完整的科研项目周期,从选题、论文撰写,到处理审稿意见、提交实验成果,直至最终的会议发表。内容强调了时间节点的倒推规划、关键资源(如GPU时间)的管理,以及如何预先应对各种项目失败模式和决策分支。
查看详情
并行性能论文可复现性指南
ppopp-reproducibility
brycewang-stanford/Awesome-Journal-Skills
250
本文档详细阐述了如何确保并行计算性能论文具有科学的可复现性。由于并行结果极度依赖于硬件架构、拓扑结构和运行时环境,因此必须全面记录所有细节,包括CPU/GPU规格、互连技术、线程亲和性策略、随机种子和编译器标志。核心在于证明性能的‘增长趋势’是稳健的,而非依赖于特定机器的绝对数据。
查看详情
1
语言
简体中文
English