登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
16598+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
告警
,共找到
105
条记录
默认排序
最新上传
最多下载
ClickHouse生产环境就绪检查清单
clickhouse-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
72
本清单提供了一套全面的ClickHouse生产环境就绪检查流程。它覆盖了从表结构设计(MergeTree、分区)、服务器配置调优、数据备份策略、监控告警设置(延迟、内存),到安全加固和应用集成等所有关键环节,确保系统上线前达到最佳的稳定性和可靠性。
查看详情
ClickUp API 可观测性监控
clickup-observability
jeremylongshore/claude-code-plugins-plus-skills
278
该技能提供全面的ClickUp API可观测性监控能力。它通过代码插桩机制,捕获请求速率、延迟(P95)、错误计数和速率限制使用情况等核心指标。支持将数据发送到Prometheus进行指标收集,使用OpenTelemetry进行分布式追踪,并实现结构化日志记录。可用于构建健壮的仪表板,并设置API性能告警规则。
查看详情
Cohere API 可观测性监控
cohere-observability
jeremylongshore/claude-code-plugins-plus-skills
342
本技能提供了一套生产级的可观测性解决方案,用于监控 Cohere API v2 的运行状态。它集成了 Prometheus 指标、OpenTelemetry 追踪和告警规则,可全面追踪调用延迟、Token消耗、错误率和成本等关键运营指标,确保AI应用系统的可靠运行和性能监控。
查看详情
CoreWeave GPU工作负载监控
coreweave-observability
jeremylongshore/claude-code-plugins-plus-skills
450
用于为在Kubernetes上运行的CoreWeave GPU工作负载提供全面的可观测性监控。它实时跟踪GPU利用率、内存使用、推理延迟和作业完成率等关键指标。帮助用户建立监控看板和告警规则,主动发现资源浪费或系统故障,确保AI/ML应用的稳定和可靠运行。
查看详情
CoreWeave GPU工作负载事件监控
coreweave-webhooks-events
jeremylongshore/claude-code-plugins-plus-skills
416
该工具通过Webhook机制,实时监控CoreWeave集群的GPU工作负载状态和生命周期事件。它追踪Pod就绪状态、任务完成、存储挂载和节点健康状况,是构建大规模GPU推理和训练任务的自动化扩展、告警及恢复流程的核心组件。
查看详情
Grammarly API可观测性监控
grammarly-observability
jeremylongshore/claude-code-plugins-plus-skills
430
本技能用于为Grammarly API集成实现全面的可观测性监控系统。它跟踪关键性能指标,包括文本检查延迟、API错误率、建议接受率和令牌消耗。通过设置指标和告警规则,可以实时发现服务性能的退化,从而确保用户在写作和编辑流程中获得稳定、高质量的体验。
查看详情
Hootsuite生产部署检查清单
hootsuite-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
474
本清单用于指导Hootsuite等社交媒体发布系统的生产环境部署和上线前的全面检查。它涵盖了API密钥管理、速率限制处理、熔断器和重试机制等关键系统架构点,并强调了时间区域验证、错误处理以及监控告警的设置。使用此清单确保自动化发布流程的稳定性和可靠性,避免上线后的发布中断或数据丢失。
查看详情
HubSpot API可观测性监控
hubspot-observability
jeremylongshore/claude-code-plugins-plus-skills
106
本技能提供了一套完整的HubSpot API可观测性监控方案。内容涵盖了使用Prometheus指标、OpenTelemetry追踪、结构化日志记录和告警配置等最佳实践。它帮助开发者实时监控CRM集成的健康状态,精确追踪API调用延迟、错误率和速率限制,确保关键业务流程的稳定性和可追溯性。
查看详情
MindTickle生产环境集成检查清单
mindtickle-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
284
本清单是一份用于确保MindTickle生产环境集成可靠性、安全性及高可用性的技术指南。内容涵盖多租户隔离、SCIM用户同步、API限速处理、错误恢复机制和监控告警等关键环节,旨在防止数据泄漏和系统功能异常。
查看详情
Navan API 可观测性监控
navan-observability
jeremylongshore/claude-code-plugins-plus-skills
457
该技能提供了一套完整的解决方案,用于在生产环境中为Navan API集成建立全面的可观测性。它指导用户实现结构化日志记录、请求延迟追踪、错误类型分类(认证、限速、服务器错误),并涵盖了OAuth令牌的生命周期管理。内容包含在Datadog、Prometheus等主流监控平台上的告警配置和仪表板构建指南。
查看详情
Notion API 监控与可观测性
notion-observability
jeremylongshore/claude-code-plugins-plus-skills
410
这是一个用于Notion API调用的全功能可观测性封装工具。它能够自动追踪请求速率、延迟(平均值、p95)、错误次数和速率限制状态。本技能是构建可靠监控仪表板、配置告警以及确保Notion集成在生产环境中健康的必备组件。支持结构化日志记录和Prometheus指标。
查看详情
编程式OCI可观测性配置
oraclecloud-observability
jeremylongshore/claude-code-plugins-plus-skills
360
本技能指导用户使用Python SDK,通过代码实现对甲骨文云基础设施(OCI)的完整可观测性配置。涵盖了程序化查询监控指标、创建告警规则、发布自定义指标以及搜索日志等关键流程。帮助用户摆脱对控制台界面的依赖,实现全流程、代码驱动的系统监控和告警管理。
查看详情
上一页
1
2
3
4
5
6
7
8
9
下一页
语言
简体中文
English