登录
软件下载
帮助文档
新闻资讯
Skill UI
浏览并发现
18950+
精选技能
全部
编程开发
人工智能
设计创意
产品商业
数据科学
市场营销
职场通用
效率工具
硬件工程
语言学习
搜索
文本分块
,共找到
14
条记录
默认排序
最新上传
最多下载
Azure语音转文本API
azure-speech-to-text-rest-py
sickn33/antigravity-awesome-skills
60
这是一个使用Python和REST API实现的Azure语音转文本功能。它允许用户通过HTTP请求,对时长不超过60秒的音频文件进行语音识别转录。该工具无需依赖官方SDK,适用于需要快速集成语音识别功能的开发场景,并支持分块传输以降低延迟。
查看详情
嵌入模型选择与优化指南
embedding-strategies
sickn33/antigravity-awesome-skills
167
本指南详细介绍了为构建向量搜索和RAG应用选择和优化嵌入模型的全套策略。内容涵盖了主流模型对比、文本分块(chunking)技术、维度降低方法,并提供了基于OpenAI和本地Sentence Transformer的Python实战代码,帮助用户构建高质量的向量化存储系统。
查看详情
火爬数据处理与知识库构建
firecrawl-data-handling
jeremylongshore/claude-code-plugins-plus-skills
248
这是一个全面的数据管道,用于处理、验证和优化来自Firecrawl爬取的网页内容。它支持Markdown清洗、使用Zod进行结构化数据提取、内容去重和为LLM/RAG系统定制的文本分块(Chunking)。旨在确保爬取的数据是标准化、干净、结构化的,可直接用于构建知识库或进行下游AI应用。
查看详情
LangChain RAG管道构建与实践
langchain-data-handling
jeremylongshore/claude-code-plugins-plus-skills
315
本教程详细指导如何使用LangChain构建完整的检索增强生成(RAG)管道。它覆盖了从数据加载(支持PDF、CSV、TXT等)到文本分块、生成嵌入向量,再到将向量存储在各种向量数据库(如FAISS, Pinecone)中的全流程。最终实现一个具备准确上下文理解和问答能力的智能检索系统。
查看详情
Grammarly API生产环境检查
grammarly-prod-checklist
jeremylongshore/claude-code-plugins-plus-skills
383
本清单为开发者提供了将Grammarly API部署到生产环境的完整指导。它涵盖了从安全凭证管理、速率限制处理、文本分块、错误容错设计(如熔断器、重试机制)到全面的监控和报警设置等关键环节,确保API集成稳定可靠,保障内容质量。
查看详情
Grammarly SDK集成最佳实践
grammarly-sdk-patterns
jeremylongshore/claude-code-plugins-plus-skills
178
本指南提供了一套生产级的Grammarly API集成模式,适用于TypeScript和Python环境。它涵盖了完整的客户端实现、Token管理(OAuth流程)以及处理超长文档的文本分块机制,确保了集成的高稳定性和可扩展性。适用于构建可靠的Grammarly增强功能。
查看详情
Grammarly文档数据处理管线
grammarly-data-handling
jeremylongshore/claude-code-plugins-plus-skills
334
这是一个用于处理大型文档的完整数据管道,专为与Grammarly API交互设计。它解决了大文件API限制的问题,通过智能文本分块(Chunking)将文本分割为可处理的小块,然后对每一块进行评分,最后汇总所有关键指标(如正确性、清晰度、语气等),生成全面的报告。
查看详情
ADHD友好型内容结构化格式
hyperfocus
jeremylongshore/claude-code-plugins-plus-skills
302
本功能旨在优化AI模型的输出格式,提升文本的认知可读性。它通过分块、视觉层级划分、前置关键点等认知科学方法,为ADHD或注意力不集中用户重构内容。提供三种模式(clean, flow, zen),确保复杂信息结构清晰、易于理解和消化。
查看详情
LangChain RAG:向量搜索与优化
langchain-embeddings-search
jeremylongshore/claude-code-plugins-plus-skills
230
本指南旨在掌握使用LangChain构建稳健的检索增强生成(RAG)流程。内容深入探讨了向量搜索的常见陷阱,包括不同向量数据库的相似度分数语义差异(L2与Cosine)、嵌入维度匹配问题,以及针对代码和Markdown的文本分块最佳实践。学习如何选择、配置和优化FAISS、Pinecone、Chroma等多种向量存储,确保RAG系统的高召回率。
查看详情
Azure语音转文本REST API
azure-speech-to-text-rest-py
sickn33/agentic-awesome-skills
142
基于Python的Azure语音转文本REST API技能,支持对短音频文件(最长60秒)进行简单语音识别,无需使用Speech SDK。涵盖设置、认证、请求格式和分块传输,实现高效转录。
查看详情
离线电报聊天导出需求挖掘器
chatexport-need-miner
sickn33/agentic-awesome-skills
251
本技能用于挖掘离线 Telegram 桌面聊天导出文件中的未满足市场需求和产品机会。采用分块流式处理防止大文件内存溢出,确保引用原文的准确性。通过跨聊天多重性法则过滤噪音,支持英文和俄语文本分析,全程离线执行,无网络请求。
查看详情
大模型文本分块与数据准备
chunking
xberg-io/xberg
401
本技能涵盖将提取的文本分块,适用于大模型上下文窗口或 RAG 数据摄入。包括配置分块大小、重叠度,以及选择 Markdown、YAML 或语义分块器。支持通过命令行、配置文件或 Python API 进行设置,并提供基于 Token 的 sizing 以适应特定模型。
查看详情
1
2
下一页
语言
简体中文
English