全部工具
共收录 538 个AI工具
Crush是Charmbracelet团队打造的开源终端AI编程助手,使用Go语言编写,提供精美的TUI终端界面。支持Anthropic、OpenAI、Google Gemini等20+模型提供商,可在对话中途无缝切换模型而不丢失上下文。集成LSP语言服务器和MCP扩展协议,支持macOS、Linux、Windows等多平台,是终端原生的AI编码解决方案。
Archon是首个面向AI编程智能体的开源工作流引擎,将开发流程编码为YAML定义的确定性工作流,类似于Dockerfile之于基础设施、GitHub Actions之于CI/CD。内置17种工作流模板(Issue转PR、代码审查、冲突解决等),支持CLI、Web UI、Slack、Telegram、Discord等多平台接入,通过Git Worktree实现隔离并行执行。
Dyad是一款本地运行的开源AI应用构建器,定位为Lovable、v0、Replit等云端工具的替代方案。完全在本地执行,不向外部服务器发送代码或数据,用户自带OpenAI、Anthropic等API密钥,自主控制成本和供应商选择。支持Mac和Windows平台,无需注册即可使用,适合注重隐私和本地控制的开发者快速构建应用。
PDFMathTranslate是一款专为科学论文设计的开源PDF翻译工具,最大特色是在翻译过程中完整保留数学公式、图表、目录和注释的原始排版。支持Google翻译、DeepL、OpenAI、Ollama等多种翻译后端,提供CLI命令行、Gradio网页GUI、Docker部署、Zotero插件和MCP集成等多种使用方式,支持中英日韩俄等多语言互译。
PageIndex是Vectify AI推出的开源无向量RAG检索框架,创新性地摒弃传统向量数据库和分块策略,改为为文档构建层级树索引(类似目录结构),通过LLM推理导航树节点实现上下文感知检索。在FinanceBench上达到98.7%准确率,显著超越传统向量检索方案,结果可追溯到具体页面和章节,适合金融、法律等对检索精度要求极高的场景。
Prompt Optimizer是一款开源的AI提示词优化工具,帮助用户编写更高质量的AI提示词以获得更好的输出结果。支持Web应用、桌面应用、Chrome扩展和Docker部署四种使用方式,兼容多种主流AI模型。提供提示词手动编写、模板导入、本地导入及提示词花园等多种来源,支持提示词优化、测试、评估和保存为可复用资产。内置多模型对比功能,可同时调用不同AI模型进行优化效果对比。支持Vercel和Cloudflare一键部署,提供MCP服务器集成能力,适合个人开发者和团队协作使用。
Onlook是一款面向AI时代设计师的开源可视化代码编辑器,将设计工具与代码开发深度融合。基于Next.js和TailwindCSS构建,支持在浏览器中直接可视化编辑React应用的DOM元素,实时同步代码变更。提供AI辅助设计能力,可通过自然语言描述生成和修改界面组件。支持实时预览和代码编辑双向联动,设计师可直接操作界面元素调整样式,同时开发者可查看和编辑底层代码。适用于快速原型设计、UI迭代和设计系统构建,降低设计师与开发者之间的协作成本。
OpenDataLoader PDF是一款开源的PDF解析器,专为AI数据提取和PDF无障碍化自动化设计。支持将PDF文件转换为Markdown、JSON(含坐标信息)、HTML等多种结构化格式,提供确定性本地模式和AI混合模式两种解析方式。在基准测试中以0.907的综合准确率排名第一,表格提取准确率达0.928。内置OCR支持80余种语言,可处理扫描件和低质量PDF。支持复杂表格、LaTeX公式、图表等元素解析,提供Python、Node.js、Java多语言SDK。与PDF Association合作,符合Well-Tagged PDF规范,支持PDF/UA无障碍标准导出。
HunyuanVideo是腾讯推出的大规模视频生成基础模型框架,拥有超过130亿参数,是目前最大的开源视频生成模型之一。采用创新的双流转单流Transformer架构和多模态大语言模型(MLLM)作为文本编码器,在文本对齐、运动质量和视觉质量方面表现优异。在专业人工评估中超越Runway Gen-3、Luma 1.6等主流商业模型。配备自研3D VAE视频压缩器,支持原始分辨率和帧率的视频训练。提供Prompt Rewrite功能自动优化用户提示词,支持普通和大师两种重写模式。已衍生出图生视频、数字人动画、自定义视频等多个下游模型。
MoneyPrinterTurbo是一款开源的AI短视频自动生成工具,只需提供视频主题或关键词,即可全自动完成视频文案撰写、素材匹配、字幕生成和背景音乐配置,最终合成为高清短视频。支持Web界面和API两种使用方式,提供多个大语言模型接入选项。内置丰富的视频素材库和背景音乐资源,支持自定义字幕样式和视频参数。采用模块化设计,各环节可独立配置和替换。适合短视频批量生产场景,大幅降低视频制作的人力和时间成本。提供详细的中文文档和社区支持,对中文用户友好。
Duix Avatar是一款真正开源的AI数字人工具包,支持离线视频生成和数字人克隆。通过AI算法精准克隆真人外貌和声音,支持文本和语音驱动虚拟形象生成视频。完全离线运行,无需联网即可使用,保护用户隐私。采用AI生成技术替代传统昂贵的3D数字人方案,将制作成本从数十万美元降至约1000美元。已在超过1万家企业中应用,生成超过50万个个性化头像。支持Windows系统本地部署,提供实时交互能力,可用于数字人直播、虚拟客服、在线教育等场景。
VibeVoice是微软开源的前沿语音AI项目,包含文本转语音(TTS)和语音识别(ASR)两大核心模块。TTS模块提供实时流式语音合成和高质量离线合成两种模式,支持多种语言和音色。ASR模块可一次性处理60分钟长音频,生成包含说话人、时间戳和内容的结构化转录结果,支持50余种语言。提供0.5B轻量级实时TTS模型,支持多语言和多种风格音色。集成Hugging Face Transformers,可无缝接入现有项目。支持vLLM推理加速,提供微调代码用于自定义训练。