登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
18950+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
Lighteval
,共找到
5
条记录
默认排序
最新上传
最多下载
Hugging Face模型评估管理
hugging-face-evaluation
sickn33/antigravity-awesome-skills
426
用于为Hugging Face模型卡片添加和管理结构化的评估结果。支持从README内容提取现有评估表格,导入外部基准分数,并使用vLLM等高性能后端运行自定义模型评估,确保模型元数据符合排行榜和行业标准。
查看详情
本地大型语言模型评估工具
hugging-face-community-evals
sickn33/antigravity-awesome-skills
51
本技能用于在本地硬件上运行Hugging Face Hub模型的综合评估。它支持多种评估框架,包括`inspect-ai`和`lighteval`,并提供灵活的后端选择(如`vllm`, Transformers, 或`accelerate`),以优化性能和兼容性。适用于本地GPU基准测试、烟雾测试和后端选择,但不负责远程任务调度或结果发布。
查看详情
Hugging Face社区评估
hugging-face-community-evals
sickn33/agentic-awesome-skills
90
使用inspect-ai和lighteval在本地硬件上对Hugging Face Hub模型进行评估。支持后端选择、本地GPU评估,并在vLLM、Transformers和accelerate之间进行选择。
查看详情
Hugging Face 模型评估管理
hugging-face-evaluation
sickn33/agentic-awesome-skills
90
此技能用于在 Hugging Face 模型卡片中添加和管理结构化评估结果。支持从 README 内容中提取评估表格,通过 Artificial Analysis API 导入基准分数,并使用 vLLM 或 lighteval 后端运行自定义模型评估。确保与 model-index 元数据格式兼容,适用于模型发布准备。
查看详情
Hugging Face 本地模型评估
huggingface-community-evals
sickn33/agentic-awesome-skills
152
本技能指导用户在本地硬件上对 Hugging Face Hub 模型进行评估。涵盖使用 inspect-ai 和 lighteval 框架配合本地推理后端(如 vllm、Transformers 或 accelerate)。包括任务选择、烟雾测试及不同模型规模的硬件建议。不包含远程编排或发布结果到社区工作流。
查看详情
1
语言
简体中文
English