全部工具
共收录 537 个AI工具
ChatGPT-Next-Web是一款开源的ChatGPT网页客户端,支持一键部署到Vercel等平台。提供精美的聊天界面,兼容OpenAI、Claude、Gemini等多家AI模型API,支持多会话管理、Prompt模板、Markdown渲染等丰富功能。自定义API Key即可使用,无需服务器,部署成本极低。支持多语言界面和暗色主题,是个人和团队搭建私有AI对话服务的理想选择,GitHub星标超过70K。
GPT4All是一款开源的本地AI聊天助手,可在普通个人电脑上运行大语言模型,无需GPU和联网。支持Windows、macOS、Linux系统,提供简洁的图形界面,下载安装即可使用。内置多种优化后的开源模型,针对CPU推理做了深度优化,8GB内存即可流畅运行。支持本地文档问答、代码生成等功能,所有对话数据完全留在本地,注重隐私保护。适合希望离线使用AI的普通用户和注重数据安全的企业场景。
Open Interpreter是一款开源的AI代码执行工具,让大语言模型能够在本地环境中运行代码、操作文件和执行系统命令。它提供类似ChatGPT Code Interpreter的体验,但运行在用户本地机器上,支持Python、JavaScript、Shell等多种语言,可以操控文件系统、安装软件包、进行数据分析等,是将AI能力与本地计算环境结合的强大工具。
gpt-engineer是一款开源的AI代码生成工具,专注于通过自然语言描述生成完整的代码项目。用户只需描述想要构建的软件,AI就能分析需求、规划架构并生成多文件的完整项目代码。它支持多种编程语言和框架,适合快速原型开发和项目脚手架搭建,是AI辅助软件开发的代表性工具之一。
Stable Diffusion WebUI是由AUTOMATIC1111开发的Stable Diffusion图形化操作界面,是目前最流行的AI绘画本地部署工具之一。它将Stable Diffusion模型的强大能力封装为易用的Web界面,支持文生图、图生图、图像修复、模型管理等丰富功能。支持LoRA、ControlNet等扩展插件,社区生态活跃,拥有大量模型和教程资源。适合希望在本地运行AI绘画的创作者和开发者。
ComfyUI是一款基于节点工作流的Stable Diffusion图形界面工具,通过拖拽连接节点的方式构建图像生成流程。相比传统WebUI,ComfyUI提供了更灵活、更精细的工作流控制能力,支持复杂的多模型串联和条件控制。用户可以可视化地构建从提示词处理、模型加载、采样到图像输出的完整流程。支持SDXL、Flux等最新模型,工作流可保存复用,适合需要精细控制生成过程的高级用户。
Open-Sora是由HPC-AI Tech开发的开源AI视频生成模型,致力于通过开源方式复现OpenAI Sora级别的视频生成能力。该项目基于扩散Transformer架构,支持文本到视频和图像到视频的生成,能够创建长达数十秒的高质量视频内容。Open-Sora采用高效的训练策略和创新的架构设计,在保持生成质量的同时大幅降低了训练成本。项目持续迭代更新,支持多种分辨率和宽高比的视频生成,是目前开源视频生成领域最受关注的项目之一,为研究者和开发者提供了探索AI视频生成的完整工具链。
Whisper是OpenAI开源的通用语音识别模型,能够将语音音频自动转录为文字文本,支持多达99种语言的识别。该模型在68万小时的多语言音频数据上训练,具备出色的鲁棒性和泛化能力,能够处理各种真实场景下的语音输入。Whisper采用编码器-解码器Transformer架构,支持语音识别、语音翻译、语言识别等多种任务。模型提供从tiny到large的多个规模版本,适应不同的精度和速度需求。作为目前最强大的开源语音识别模型之一,Whisper被广泛应用于字幕生成、会议记录、语音助手等场景。
Dify是开源的LLMOps平台,提供可视化的AI应用开发环境,支持RAG知识库、Agent工作流、Prompt编排等核心能力。开发者可通过拖拽式界面快速构建基于大语言模型的对话应用、智能助手和自动化工作流,无需深入了解底层技术细节。Dify支持接入OpenAI、Claude、本地模型等多种LLM后端,内置向量数据库管理和文档检索功能,提供完整的API接口便于集成到现有业务系统。平台还包含应用监控、日志分析和A/B测试等运维工具,帮助企业实现AI应用的全生命周期管理。Dify采用Apache 2.0许可证,支持Docker一键部署,是目前最受欢迎的开源LLM应用开发平台之一。