全部工具
共收录 538 个AI工具
Voicebox是一款开源的本地优先AI语音工作室,集语音克隆、语音合成、语音听写和AI代理语音于一体。提供7个TTS引擎支持23种语言,可从几秒钟的音频样本中克隆任意声音。支持全局热键语音听写功能,可将语音输入到任意文本输入框中。集成MCP协议支持,可为AI代理赋予自定义声音。内置本地LLM用于文本润色和个人配置文件管理。完全本地运行,无需云服务,是ElevenLabs和WisprFlow的开源替代方案。提供桌面应用和API接口,支持跨平台使用。
Kokoro TTS 是由 hexgrad 开发的开源文本转语音模型,仅 82M 参数即可实现高质量语音合成。支持中文、英文、日文、韩文等多种语言,可在 CPU 上实时运行,无需 GPU 即可获得自然流畅的语音输出。模型体积小巧、部署简单,适合需要本地化 TTS 方案的开发者和企业,是目前开源社区中性价比最高的轻量级语音合成方案之一。
Fish Speech 是 Fish Audio 开发的开源语音合成与声音克隆框架,支持中英日韩等多语言实时语音生成。仅需 10-30 秒参考音频即可克隆任意音色,推理延迟低至 150ms,支持流式输出。基于 VITS2 架构和大语言模型技术,提供 WebUI 和 API 两种使用方式,适合需要声音定制和实时语音交互的应用场景。
ChatTTS 是由 2noise 开发的开源对话式语音合成模型,专为日常对话场景优化。支持中英双语,能生成包含笑声、停顿、语气词等自然对话元素的语音,让合成语音更接近真人对话效果。采用 10 万小时以上数据训练,提供精细的韵律控制能力,适合聊天机器人、语音助手等需要自然对话语音的应用场景。
RAGFlow 是由 InfiniFlow 开发的开源 RAG(检索增强生成)引擎,专注于深度文档理解和精准问答。支持 PDF、Word、PPT、Excel 等多种文档格式的智能解析,内置 OCR 和版面识别能力,能准确提取表格、图片中的信息。提供可视化知识库管理和对话界面,支持与主流大模型集成,适合企业级文档问答和知识管理系统。
Firecrawl 是由 Mendable 开发的开源网页抓取与爬虫 API,能将任意网页转换为干净的 Markdown 或结构化数据,专为 LLM 应用设计。支持 JavaScript 渲染页面、自动处理反爬机制、批量抓取和站点地图解析。提供云端 API 和自托管两种部署方式,内置缓存和速率控制,是构建 AI 应用数据管道的理想工具。
Deep Research 是一款开源的 AI 深度研究代理,能自主进行多步骤网络搜索和信息整合,生成全面的研究报告。基于大语言模型驱动,支持递归式搜索、信息验证和多源交叉引用,模拟人类研究员的调研过程。支持自定义研究深度和输出格式,可对接多种搜索引擎和 LLM,适合需要深入调研的学术和商业场景。
TrendRadar 是一款开源的趋势监控与信息聚合工具,帮助用户追踪特定领域的热点动态。支持自定义监控关键词和数据源,自动抓取并分析社交媒体、新闻网站和论坛的内容变化。提供趋势可视化和异常检测能力,可配置通知提醒,适合需要持续关注行业动态的从业者和研究者。
Screenpipe 是一款开源的屏幕与音频持续捕获工具,7x24 小时记录屏幕内容和麦克风音频,并将所有信息本地索引化。所有数据存储在本地,保障隐私安全。支持 OCR 文字识别、音频转录和语义搜索,可通过 API 与 AI 应用集成。提供跨平台桌面应用,适合需要回溯屏幕信息、构建个人知识库的用户。
Graphiti 是由 Zep 开发的开源知识图谱框架,专为 AI Agent 设计的时间感知型图记忆系统。基于 Neo4j 图数据库构建,能自动从对话和数据中抽取实体关系,构建动态演化的知识图谱。支持时间戳管理和历史版本追踪,让 AI Agent 拥有持久化的结构化记忆能力,适合需要复杂关系推理的 AI 应用场景。
Krita AI Diffusion是一款将Stable Diffusion深度集成到Krita开源绘画软件中的AI插件,让数字艺术家能够在熟悉的绘画环境中直接使用AI生成和编辑图像。支持文生图、图生图、局部重绘、画面扩展及ControlNet控制等功能,用户可以通过简单的涂鸦或文字提示快速生成高质量图像。该插件完全免费开源,支持本地部署,保护用户隐私,特别适合概念设计师、插画师和数字艺术家在创作流程中融入AI能力,大幅提升创作效率。
LTX-Video是由Lightricks开发的高效AI视频生成模型,基于DiT(Diffusion Transformer)架构,支持文本生成视频和图像生成视频。该模型以生成速度快、画质出色著称,能够在消费级硬件上运行,生成高分辨率、时间连贯的视频内容。LTX-Video开源可商用,支持多种视频风格和场景生成,适合内容创作者、短视频制作者和AI研究人员使用,是当前开源视频生成领域的领先方案之一。