登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
15857+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
LLM
,共找到
189
条记录
默认排序
最新上传
最多下载
RAG向量及嵌入弱点评估
assessing-vector-and-embedding-weaknesses
mukul975/Anthropic-Cybersecurity-Skills
198
该技能用于对检索增强生成(RAG)系统和向量数据库进行安全审计。它重点检测嵌入模型是否易发生反演、是否存在跨租户数据泄露,以及知识库是否容易被污染,是满足OWASP LLM08:2025等安全标准的关键工具。
查看详情
检测间接提示注入载荷
detecting-indirect-prompt-injection
mukul975/Anthropic-Cybersecurity-Skills
477
本技能用于检测和防御间接提示注入攻击。当LLM代理处理来自外部的不可信内容(如网页、PDF、图片)时,攻击者可能将隐藏指令嵌入其中。本工具通过内容提取、去混淆处理和多模型扫描,在数据进入LLM之前进行安全净化,防止恶意指令劫持代理行为。
查看详情
基于Garak的LLM红队安全测试
red-teaming-llms-with-garak
mukul975/Anthropic-Cybersecurity-Skills
201
NVIDIA garak是一款开源的LLM漏洞扫描工具,用于全面的红队测试和安全评估。它通过向大型语言模型(支持OpenAI API、Hugging Face等)发送数千个对抗性提示词,系统性地检测关键漏洞。这些漏洞包括提示注入、越狱、数据泄露和毒性内容等。可用于建立部署前后的安全基线,验证安全卫士的有效性,或为AI风险评估提供定量证据。
查看详情
本地GGUF大型语言模型部署
huggingface-local-models
sickn33/antigravity-awesome-skills
406
本技能提供了一套完整的指南,用于利用 llama.cpp 框架和 GGUF 格式在本地部署大型语言模型(LLMs)。它涵盖了在 Hugging Face Hub 搜索模型、选择最佳量化配置,以及运行支持 CPU、Mac Metal、CUDA 和 ROCm 等多种硬件后端的本地推理服务器。支持实现兼容 OpenAI 格式的 API 接口,适用于需要离线、私密部署的大模型推理场景。
查看详情
Neon AI 网关:统一大模型调用
neon-ai-gateway
sickn33/antigravity-awesome-skills
230
Neon AI 网关提供单一的API和凭证,即可接入包括OpenAI、Anthropic、Google Gemini在内的多种前沿和开源大模型。它极大地简化了AI集成过程,消除了为每个模型提供商设置独立账户和密钥的复杂性。开发者只需更改模型名称即可无缝切换模型,并且为开发和CI环境提供了关键的分支级隔离。
查看详情
使用TRL训练和微调大型语言模型
trl-training
sickn33/antigravity-awesome-skills
316
使用此技能,您可以使用TRL库对基础大型语言模型进行高级训练和微调。它支持包括SFT、DPO、GRPO等在内的多种前沿模型对齐和优化技术。适用于需要根据特定任务需求,利用偏好数据和奖励模型定制化模型的场景。
查看详情
运行DeepSWE编程代理基准测试
run-deep-swe
sickn33/antigravity-awesome-skills
335
用于对大型语言模型(LLM)进行全面的编码代理能力评估。它通过DeepSWE基准测试,使用OpenRouter和mini-swe-agent,对113个任务进行评测,生成可复现的性能得分和评估报告。适用于模型能力对比、开发评估和学术研究。
查看详情
自然语言浏览器意图执行
browser-intent
ruvnet/ruflo
64
这是一个基于自然语言的浏览器自动化工具。它允许用户用日常语言描述目标操作(如“点击登录按钮”、“填写搜索框内容”),无需编写复杂的CSS选择器。通过结合大型语言模型(LLM)能力,可以驱动浏览器执行多步骤的复杂交互,特别适用于元素选择难以定位或结构不稳定的网页。
查看详情
LLM提示词格式化与上下文检索
chat-format
ruvnet/ruflo
488
本工具用于为不同的大型语言模型(如GPT、Claude、Gemini等)格式化聊天提示词。它支持构建强大的检索增强生成(RAG)流程,通过HNSW技术进行高效的上下文检索。用户可完成提示词格式化、文档索引、上下文路由和状态检查等全链路操作。
查看详情
上下文预算与LLM优化
context-budget
affaan-m/ECC
64
本工具用于审计Claude Code会话中所有组件(如代理、技能、规则和MCP服务器)的Token消耗。它能分析上下文开销,识别冗余或臃肿的组件,并生成详细的上下文预算报告。帮助用户管理Token使用量,确保模型运行效率和性能。
查看详情
LLM成本基准测试
cost-benchmark
ruvnet/ruflo
387
该技能用于运行结构化和对抗性语料库的全面基准测试。它测量了增强器(booster)模型与主流LLM基线(如Gemini、Anthropic)的性能和成本效率。结果以可验证的JSON报告持久化,是发布和审计模型性能声明的关键环节。
查看详情
GAIA智能体基准对比与差距分析
gaia-architecture-comparison
ruvnet/ruflo
463
本技能详细对比了GAIA智能体评估框架(如ruflo和HAL),旨在帮助开发者和研究人员识别大型语言模型(LLM)智能体在性能测试中的能力差距。它涵盖了从真实代码执行沙箱到全功能网页浏览等关键技术点,为提升智能体基准测试的准确性和鲁棒性提供路线图。
查看详情
上一页
1
2
3
...
11
12
13
14
15
16
下一页
语言
简体中文
English