登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
18950+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
排名
,共找到
6
条记录
默认排序
最新上传
最多下载
评估和排名智能体结果
eval
alirezarezvani/claude-skills
155
用于评估和对一个智能体工作流(AgentHub)中多个智能体的输出结果进行排名。它支持基于指标的评估(如运行特定命令衡量性能),以及高级LLM判官模式。该模式根据正确性、简洁性和整体质量等多维度进行定性比较,帮助用户确定最佳的最终提交结果。
查看详情
多模型共识决策流程
llm-council
sickn33/antigravity-awesome-skills
111
本技能实现了LLM委员会(Council)机制,用于对复杂难题进行多角度深度分析。核心流程包括:多个LLM并行独立回答、模型之间相互排名,以及由指定主席LLM进行最终综合提炼。它能确保输出结果权威、全面,适用于需要多方视角达成共识的场景。
查看详情
生成式引擎优化专家
tlc-generative-engine-optimization
tech-leads-club/agent-skills
73
本技能专注于生成式引擎优化(GEO),旨在确保特定网页的内容结构、元数据和可信度达到AI答案引擎(如Google AI Overviews、ChatGPT、Bing Copilot)的最佳标准。它侧重于技术实现层面,如结构化数据(JSON-LD)、语义化HTML和元数据优化,以提高内容的可发现性、可理解性和可引用性,而非传统的关键词排名。
查看详情
批量内容质量评估套件
eval-suite
indranilbanerjee/digital-marketing-pro
186
该套件用于对多个内容资产(如内容库、营销素材或交付件)执行批量、全面的质量评估。它超越了单件评估,生成了整体的质量排名、多维度分析(如品牌声调、事实核查)、普遍性问题报告以及优先修订清单。适用于内容审计、上线前检查和大型营销活动审查。
查看详情
推荐系统成果物打包与复现
recsys-artifact-evaluation
brycewang-stanford/Awesome-Journal-Skills
288
本指南指导研究人员如何为推荐系统论文准备和构建可复现的证据包。它详细说明了如何打包数据集、模型检查点、划分脚本和倾向性日志等成果物,确保论文中的所有排名和评估指标都能在匿名、可验证的仓库中实现端到端的复现。
查看详情
LLM委员会审议
llm-council
sickn33/agentic-awesome-skills
73
运行Fireworks托管的开放权重模型委员会,比较响应并综合最终答案。本技能实现Karpathy的LLM委员会概念,包括并行模型响应、排名和主席综合。
查看详情
1
语言
简体中文
English