登录
下载
Skill UI
浏览并发现
15558+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
LLM
,共找到
397
条记录
默认排序
最新上传
最多下载
成本感知LLM管道优化
cost-aware-llm-pipeline
affaan-m/ECC
100
该模式提供了一套构建成本优化LLM应用管道的完整方案。它结合了基于任务复杂度的模型路由、不可变成本追踪、有限重试逻辑和提示缓存等技术,帮助开发者在保证输出质量的同时,有效地控制和管理LLM API的支出,适用于处理高并发、多变复杂度的生产级任务系统。
查看详情
LLM成本基准测试
cost-benchmark
ruvnet/ruflo
387
该技能用于运行结构化和对抗性语料库的全面基准测试。它测量了增强器(booster)模型与主流LLM基线(如Gemini、Anthropic)的性能和成本效率。结果以可验证的JSON报告持久化,是发布和审计模型性能声明的关键环节。
查看详情
零成本代码结构转换
cost-booster-edit
ruvnet/ruflo
285
这是一个高性能的代码结构转换工具,用于执行简单的、确定性的代码重构(如移除控制台日志、var转const)。它利用WASM核心进行结构性修改,速度极快,且无需调用任何昂贵的大模型API。非常适用于CI/CD流程、自动化批量重构和对成本敏感的开发工作流,尤其强调确定性和速度。
查看详情
成本优化任务路由报告
cost-booster-route
ruvnet/ruflo
55
该工具用于任务成本优化,通过路由系统将任务分流到不同的处理层级。它特别识别出可使用“Agent Booster”(一级)的简单转换任务,这些任务的成本为零。通过报告能节省的成本,帮助用户在批量处理前预估和控制AI支出。
查看详情
AI成本优化与资源分析
cost-optimize
ruvnet/ruflo
240
该工具能深入分析AI模型的Token使用模式、模型匹配度、缓存利用率和代理冗余等,识别出潜在的资源浪费。它提供可操作的、按优先级排序的优化建议,并估算出具体的成本节约额,帮助用户显著降低AI运营成本。
查看详情
基准测试性能漂移分析
cost-trend
ruvnet/ruflo
121
该技能用于分析存储的历史基准测试运行数据。它能追踪并报告关键性能指标(如胜率、平均延迟、P99延迟和LLM成本)随时间变化的趋势。这对于发现标准烟雾测试可能遗漏的性能衰退或回归至关重要,确保系统在每次发布或数据集扩展时保持稳定性。
查看详情
自动化AI数据采集代理
data-scraper-agent
affaan-m/ECC
500
该代理旨在为任何公开数据源(如招聘板、价格、新闻等)构建一个全自动、AI驱动的数据采集系统。它能定时抓取数据,利用免费的大语言模型(如Gemini Flash)进行数据富集和分析,并将结果结构化地存储到Notion、Sheets或Supabase等数据库中。适用于需要持续监控和跟踪网络数据的场景。
查看详情
设备端大型语言模型集成指南
foundation-models-on-device
affaan-m/ECC
313
本指南详细介绍了如何在设备端集成大型语言模型(LLM)。它涵盖了文本生成、使用@Generable进行结构化数据提取、实现自定义工具调用以及流式响应等高级模式。核心优势在于保证用户隐私和离线可用性,所有计算都在本地完成。
查看详情
GAIA智能体基准对比与差距分析
gaia-architecture-comparison
ruvnet/ruflo
463
本技能详细对比了GAIA智能体评估框架(如ruflo和HAL),旨在帮助开发者和研究人员识别大型语言模型(LLM)智能体在性能测试中的能力差距。它涵盖了从真实代码执行沙箱到全功能网页浏览等关键技术点,为提升智能体基准测试的准确性和鲁棒性提供路线图。
查看详情
GAIA基准失败调试工具
gaia-debugging
ruvnet/ruflo
94
本技能提供了一个系统化的工作流,用于诊断GAIA基准运行中的模型失败。用户可以分析任务运行痕迹,分类失败模式(如工具缺失、推理错误),找出根本原因,并应用针对性修复,从而系统性地提升AI智能体的性能和测试模型的可靠性。
查看详情
LLM预执行事实核查机制
gateguard
affaan-m/ECC
224
GateGuard是一个强制性的预执行钩子,用于极大增强大型语言模型(LLM)生成代码和操作的可靠性与安全性。它不依赖模型的自我评估,而是强制模型在进行任何代码写入或执行Shell命令前,必须进行详细、可验证的调查。这些调查包括列出所有依赖文件、检查数据结构和编写回滚方案,从而有效防止模型盲目猜测和产生错误。
查看详情
GEPA基因组审计与检查工具
harness-gepa
ruvnet/ruflo
159
该工具用于深入审计和检查GEPA(基因演化提示适配)基因组,通过调用底层库实现复杂的AI系统验证。它支持加载和验证基因组结构,渲染出完整的系统提示词,或对运行记录中的失败模式进行分类和诊断。适用于AI开发流程中的持续集成和故障排除。
查看详情
上一页
1
2
3
...
27
28
29
30
31
32
33
34
下一页
语言
简体中文
English