登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
15857+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
Vast.ai
,共找到
5
条记录
默认排序
最新上传
最多下载
Vast.ai分布式训练与成本管理
vastai-core-workflow-b
jeremylongshore/claude-code-plugins-plus-skills
439
这是一个高级工作流,用于在Vast.ai上编排复杂的、多节点的GPU集群。它专为大规模分布式机器学习训练设计,能自动处理Spot机中断和使用检查点进行作业恢复。同时,该工作流提供全面的成本分析功能,帮助用户跟踪账单历史,优化GPU支出,并安全地销毁集群以停止计费。
查看详情
AI深度学习GPU性能优化
vastai-performance-tuning
jeremylongshore/claude-code-plugins-plus-skills
77
这是一份关于深度学习工作流和云GPU平台性能优化的综合指南。内容涵盖了如何通过性能/金钱比选择最佳实例、减少启动延迟、精细调优数据管道(如DataLoader和pin_memory),以及使用PyTorch和Bash脚本实现多GPU分布式训练,以最大化计算资源的利用率和训练效率。
查看详情
实验结果监控与分析
monitor-experiment
wanshuiyin/Auto-claude-code-research-in-sleep
202
提供了一个全面的多平台实验监控流程。该技能用于跟踪和收集跨越SSH、vast.ai、Modal等多个环境的长时运行实验状态。它不仅能获取终端日志和结构化结果,还能通过Weights & Biases (W&B) API拉取详细的训练曲线和性能指标,辅助进行实验结果的对比和深度分析。
查看详情
运行和部署机器学习实验
run-experiment
wanshuiyin/Auto-claude-code-research-in-sleep
375
用于管理和运行完整的机器学习实验流程。该工具支持在本地GPU、远程服务器、Vast.ai和Modal等多种云端环境中部署和执行训练任务。它涵盖了环境检测、代码同步、依赖管理和实验结果日志记录等关键步骤,确保了ML实验过程的可靠性、可扩展性和可重复性。
查看详情
云端GPU算力资源调度
vast-gpu
wanshuiyin/Auto-claude-code-research-in-sleep
490
该技能自动化管理云端GPU算力资源,用于AI和机器学习任务。它能分析您的模型需求和训练任务,自动计算所需的VRAM、GPU数量和预计运行时间,从而在vast.ai上匹配出最具成本效益和性能的最佳GPU实例,管理整个计算生命周期。
查看详情
1
语言
简体中文
English