登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
16594+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
实验
,共找到
597
条记录
默认排序
最新上传
最多下载
SwanLab 实验跟踪
experiment-tracking-swanlab
Orchestra-Research/AI-Research-SKILLs
419
介绍如何使用 SwanLab 进行开源机器学习实验跟踪,提供本地或自托管的仪表盘、丰富的媒体日志,并与 PyTorch、Transformers、Lightning、Fastai 等框架集成,便于对比各次训练。
查看详情
消融实验规划器
ablation-planner
wanshuiyin/Auto-claude-code-research-in-sleep
203
为机器学习论文提交设计系统的消融实验方案。帮助隔离组件贡献、测试超参数并回答审稿人问题。Codex 负责规划实验,CC 负责实施,确保提交前进行严格验证。
查看详情
实验桥接工作流
experiment-bridge
wanshuiyin/Auto-claude-code-research-in-sleep
480
该技能衔接实验计划与实际执行:读取实验计划,实现训练与评估代码,执行跨模型代码审查,自动部署到GPU环境并收集初始实验结果,为后续自动审阅流程准备好数据。
查看详情
ML实验跟踪与监控
hugging-face-trackio
sickn33/antigravity-awesome-skills
102
Trackio是一个用于记录、可视化和分析机器学习训练实验的工具。它提供Python API用于训练过程中的实时指标记录和异常告警,并提供命令行接口(CLI)用于查询历史数据。用户可以使用它来持续监控训练状态、诊断模型问题(如损失发散),是构建自动化ML工作流的关键组件。
查看详情
结果证据与主张判断门
result-to-claim
wanshuiyin/Auto-claude-code-research-in-sleep
250
本工具是在实验流程结束后使用的关键判断门。它系统性地评估原始实验数据和指标与既定研究主张之间的关系,旨在判断结果是否充分支持、是否矛盾或缺乏关键证据。它帮助研究团队决定下一步的行动方向,例如调整假设、补充数据或确认结论。
查看详情
Modal云GPU:机器学习计算
serverless-modal
wanshuiyin/Auto-claude-code-research-in-sleep
323
这是一个基于Modal的无服务器GPU计算平台,专用于运行复杂的机器学习工作负载,包括模型训练、微调和推理。它提供零配置环境,无需设置SSH或Docker,支持自动扩缩容和按需计费,非常适合进行代码调试和中小型实验。
查看详情
网络服务实验室配置与测试
network-101
zebbern/claude-code-guide
237
指导在 Windows 或 Linux 上部署 HTTP/HTTPS、SNMP、SMB 服务,执行端口配置、枚举、日志分析等渗透测试实验室实战内容。
查看详情
假设驱动的调试与根因分析
hypothesis-testing
rohitg00/skillkit
291
本技能指导用户应用科学方法进行软件调试。它摒弃盲目尝试,通过观察症状、提出可证伪假设、预测结果、设计实验和分析结果五个步骤,系统地定位故障源头,从而高效、准确地找出技术问题的根本原因。
查看详情
统计显著性与A/B测试分析
statistical-analyst
alirezarezvani/claude-skills
318
该工具是专业的统计分析助手,专注于A/B测试和假设检验。它可以帮助用户计算实验所需的样本量,执行Z检验、T检验和卡方检验等专业统计分析,并核心区分“统计显著性”与“实际意义”,确保基于严谨的统计证据做出产品和商业决策。
查看详情
Arize实验评估与管理
arize-experiment
github/awesome-copilot
404
本技能提供了一套完整的Arize实验管理工具,用于AI模型性能的评估、比较和分析。用户可以使用它来创建、列出、获取和导出实验结果,支持进行模型基准测试和A/B测试,确保模型在特定数据集上的准确性。
查看详情
Arize LLM评估与监控
arize-evaluator
github/awesome-copilot
93
本技能用于在Arize平台上设置和运行LLM判官评估。用户可以定义评估器(包括提示词模板、分类选项和模型),并将评估器应用于项目或实验数据。支持对幻觉、忠实度、正确性等关键指标进行打分,并实现持续监控,确保LLM性能的完整追溯。
查看详情
从零到一产品发布
gtm-0-to-1-launch
github/awesome-copilot
383
覆盖直达客户、诊断卡顿层面和两周实验节奏的产品从构想到首批用户的完整发布框架,帮助团队确认价值、优化体验、集中资源。
查看详情
上一页
1
2
3
...
6
7
8
9
10
11
12
...
48
49
50
下一页
语言
简体中文
English