如何阅读本图谱
资料时间:2026年9月19日。依据厂商公布的功能,并非对所有产品进行过实际测试。F 为功能匹配度(50%),C 为可控性(25%),W 为工作流衔接(25%),各项1至5分。加权结果取到半星。五星代表该任务的优先候选,不代表通用冠军。本图谱未测量输出质量、速度及每项合格结果的成本。无法导出时可覆盖总评分:Udio 在对外交付音乐方面记为1/5。
医疗、法律、人事、财务、建筑及工业应用需要专业验收与适当的人工责任机制。
选择任务
通用 AI 助手与大语言模型
可将 ChatGPT 和 Claude 同时列入候选;已有 Google 工作流时考虑 Gemini。给各候选相同任务、来源、矛盾信息和文件要求。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| ChatGPT | 5.0 | 5 / 4 / 5 |
| Claude | 5.0 | 5 / 4 / 5 |
| Gemini / Gemini API | 4.5 | 5 / 4 / 4 |
| Mistral Vibe | 4.0 | 4 / 4 / 4 |
| Grok | 4.0 | 4 / 3 / 4 |
| DeepSeek API | 4.0 | 4 / 4 / 3 |
| Qwen | 4.0 | 4 / 4 / 3 |
网络研究与来源核查
Perplexity 用于开放网络,Gemini Notebook 用于限定资料库。逐项核对十条陈述的原始出处。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Perplexity | 4.5 | 5 / 4 / 4 |
| Gemini Notebook / NotebookLM | 5.0 | 5 / 5 / 4 |
| ChatGPT | 4.0 | 4 / 4 / 4 |
科研与文献综述
Elicit 用于结构化提取,Consensus 用于查找研究。记录遗漏文献、错误数字和缺乏依据的结论。
↑ 返回类别总览编程与代码仓库
Codex 和 Claude Code 适合项目任务;Cursor 是编辑器,Copilot 适合 GitHub 工作流。用隐藏的回归测试验收修改。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| OpenAI Codex | 5.0 | 5 / 5 / 5 |
| Claude Code | 5.0 | 5 / 5 / 5 |
| Cursor | 5.0 | 5 / 5 / 5 |
| GitHub Copilot | 5.0 | 5 / 4 / 5 |
网站、应用与原型
v0 侧重界面;Lovable 或 Replit 提供集成式应用起点。上线前测试身份验证、访问权限和支付逻辑。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| v0 | 5.0 | 5 / 5 / 5 |
| Lovable | 4.5 | 5 / 4 / 4 |
| Replit Agent | 5.0 | 5 / 4 / 5 |
图像生成与视觉概念
按风格、参考图和控制能力比较候选工具。使用同一简报,统计失败、返工与合格输出。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Midjourney | 4.5 | 5 / 4 / 3 |
| FLUX / Black Forest Labs | 5.0 | 5 / 5 / 5 |
| Adobe Firefly | 5.0 | 5 / 5 / 5 |
| ChatGPT | 4.0 | 4 / 4 / 4 |
| Ideogram | 5.0 | 5 / 5 / 4 |
| Google Imagen | 4.5 | 5 / 4 / 4 |
设计、广告与演示
Canva、Gamma 和 Firefly 解决不同任务。用相同内容比较编辑、品牌一致性和导出。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Canva AI | 5.0 | 5 / 5 / 5 |
| Gamma | 4.5 | 5 / 4 / 4 |
| Adobe Firefly | 4.5 | 4 / 5 / 5 |
电影感视频与生成场景
比较连续性、运动和模型控制能力。Sora 仅作为退役产品记录,不用于新集成选型。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Higgsfield | 5.0 | 5 / 5 / 4 |
| Runway | 5.0 | 5 / 5 / 5 |
| Google Veo | 4.5 | 5 / 4 / 4 |
| Dreamina Seedance | 5.0 | 5 / 5 / 4 |
| Kling AI | 4.0 | 4 / 4 / 3 |
| Luma | 4.0 | 4 / 4 / 4 |
| Sora | 1.0 | 1 / 1 / 1 |
数字人与培训视频
用同一脚本比较 HeyGen 和 Synthesia。检查发音、口型、授权同意及编辑能力。
↑ 返回类别总览视频剪辑与成片
DaVinci Resolve、Premiere、CapCut 和 Descript 面向不同流程。完成同一成片并记录人工修正工作。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| DaVinci Resolve | 5.0 | 5 / 5 / 5 |
| Adobe Premiere | 5.0 | 5 / 5 / 5 |
| CapCut | 4.5 | 5 / 4 / 4 |
| Descript | 4.5 | 5 / 4 / 4 |
短视频、字幕与再利用
用同一视频比较 OpusClip、CapCut 和 Descript。检查上下文、切点、字幕与竖屏裁切。
↑ 返回类别总览视频修复与放大
用相同素材比较 Topaz 和 DaVinci。检查细节、闪烁和伪影,不只看分辨率。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Topaz Video | 5.0 | 5 / 5 / 4 |
| DaVinci Resolve | 4.5 | 4 / 4 / 5 |
歌曲、说唱与人声音乐
比较 Suno、Eleven Music 和 Lyria 的歌词、人声及结构。Udio 的导出限制影响对外交付。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Suno | 5.0 | 5 / 5 / 5 |
| Eleven Music | 4.0 | 4 / 4 / 4 |
| Google Lyria | 4.5 | 5 / 4 / 4 |
| Udio | 1.0 | 3 / 3 / 1 |
配乐、器乐与声音设计
SOUNDRAW、AIVA、Stable Audio 和 Eleven Music 对应不同需求。检查时长、循环、许可和导出。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| SOUNDRAW | 5.0 | 5 / 5 / 4 |
| AIVA | 5.0 | 5 / 5 / 4 |
| Stable Audio | 4.0 | 4 / 5 / 3 |
| Eleven Music | 4.0 | 4 / 4 / 4 |
配音与合成声音
ElevenLabs 用于声音;需要视频时考虑 HeyGen。测试姓名、停顿、发音和声音使用权。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| ElevenLabs Text to Speech | 5.0 | 5 / 5 / 5 |
| HeyGen | 4.0 | 4 / 4 / 4 |
视频翻译与译配
用同一片段比较 HeyGen 和 Rask。由熟悉目标语言的人核查含义、声音和同步。
↑ 返回类别总览文字翻译与国际内容
用自有术语表比较 DeepL 和 Claude。由目标语言读者检查术语、语气和遗漏。
↑ 返回类别总览会议、转录与任务
比较 Fathom、Fireflies 和 Otter。核查姓名、决策、负责人,并取得必要同意。
↑ 返回类别总览办公、邮件与内部知识
根据已有 Microsoft 365、Google Workspace 或 Notion 环境选择。测试权限、来源和过期信息。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Microsoft 365 Copilot | 5.0 | 5 / 4 / 5 |
| Gemini in Google Workspace | 5.0 | 5 / 4 / 5 |
| Notion AI | 5.0 | 5 / 5 / 4 |
数据分析、表格与报告
用已知参考结果比较 ChatGPT、Julius 和 Copilot。核查计算、缺失值及可重复性。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| ChatGPT | 5.0 | 5 / 4 / 5 |
| Julius AI | 4.0 | 4 / 4 / 4 |
| Microsoft 365 Copilot | 5.0 | 5 / 4 / 5 |
自动化与跨系统智能体
n8n、Make 和 Zapier 的适用性取决于流程及环境。测试重复任务、错误、重试和人工审批。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| n8n | 5.0 | 5 / 5 / 5 |
| Make | 5.0 | 5 / 5 / 5 |
| Zapier Agents | 5.0 | 5 / 4 / 5 |
客服与对话智能体
在获准使用的案例中比较 Fin、Voiceflow 和 Copilot Studio。包含无法回答的问题及转人工流程。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Fin / Intercom | 5.0 | 5 / 4 / 5 |
| Voiceflow | 5.0 | 5 / 5 / 5 |
| Microsoft Copilot Studio | 5.0 | 5 / 5 / 5 |
销售、CRM 与客户流程
HubSpot 和 Salesforce 应匹配现有 CRM。测试权限、记录更新及是否编造承诺。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| HubSpot Agent Hub | 5.0 | 5 / 4 / 5 |
| Salesforce Agentforce | 5.0 | 5 / 5 / 5 |
营销内容与 SEO/GEO
Jasper、Surfer 和 Claude 分工不同。核查来源、品牌及实用性,不承诺搜索排名。
↑ 返回类别总览电商与商品图片
用同一商品比较 Photoroom 和 Canva。保持真实外形、颜色和细节,并检查导出。
↑ 返回类别总览3D、游戏素材与动画
用相同参考比较 Meshy 和 Tripo。检查几何、纹理、格式及目标引擎适配。
↑ 返回类别总览本地 AI 与自有模型环境
LM Studio 和 Ollama 可用于本地环境。核查许可、硬件、质量和外部连接。
↑ 返回类别总览OCR、发票与文档流程
按文档类型比较 Document AI 和 Textract。测量字段准确率,并将不确定项交人工复核。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Google Document AI | 5.0 | 5 / 5 / 5 |
| Amazon Textract | 5.0 | 5 / 4 / 5 |
学习、培训与知识传授
Khanmigo 用于学习辅助,Gemini Notebook 用于自有资料。用已知练习检查解释及局限。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Khanmigo | 4.5 | 5 / 4 / 4 |
| Gemini Notebook / NotebookLM | 5.0 | 5 / 5 / 4 |
专业法律工作
Harvey 需要专业场景和适当权限。由专业人员核查引文和结论,不能替代法律咨询。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Harvey | 4.0 | 4 / 4 / 4 |
安全与媒体真实性
Security Copilot 和 Resemble AI 处理不同问题。用已知案例测量误报及漏报。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Microsoft Security Copilot | 4.5 | 4 / 4 / 5 |
| Resemble AI | 4.0 | 4 / 4 / 4 |
工业、仿真与物理 AI
Omniverse 是仿真基础设施,不是聊天助手。验证物理任务以及从仿真到现实的差异。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| NVIDIA Omniverse | 4.5 | 4 / 5 / 4 |
播客与音频修复
用同一录音比较 Adobe Podcast 和 Descript。试听伪影、清晰度和原声保留情况。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Adobe Podcast | 4.5 | 5 / 4 / 4 |
| Descript | 5.0 | 5 / 5 / 5 |
建筑、地产与规划
Forma 辅助规划,Firefly 辅助可视化。将示意图与经专业验收的图纸和计算区分开。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Autodesk Forma | 4.5 | 5 / 4 / 4 |
| Adobe Firefly | 3.5 | 3 / 4 / 4 |
医疗文档
Dragon Copilot 是专业工具。由获授权的专业人员核对记录、遗漏和数据访问。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Microsoft Dragon Copilot | 4.0 | 4 / 4 / 4 |
人力资源与招聘
Workday 和 SAP 应匹配现有流程。核查权限、偏差及重要决定的人工审批。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Workday AI | 5.0 | 5 / 4 / 5 |
| SAP Joule Assistants | 5.0 | 5 / 4 / 5 |
财务、采购与 ERP
SAP 和 Workday 取决于模块及角色;Textract 用于文档提取。测试审批规则和错误记账。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| SAP Joule Assistants | 5.0 | 5 / 4 / 5 |
| Workday AI | 5.0 | 5 / 4 / 5 |
| Amazon Textract | 3.5 | 3 / 4 / 4 |
企业搜索与内部知识
Glean、Notion 和 Copilot 取决于现有知识来源。用十个问题测试允许、受限及过期资料。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Glean | 5.0 | 5 / 4 / 5 |
| Notion AI | 5.0 | 5 / 4 / 5 |
| Microsoft 365 Copilot | 5.0 | 5 / 4 / 5 |
商品搜索、检索与推荐
Algolia 是搜索平台,Cohere Rerank 用于结果重排。评估五十个查询及其前五项结果。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Algolia AI Search | 5.0 | 5 / 5 / 5 |
| Cohere Rerank | 4.5 | 5 / 4 / 4 |
预测与自建机器学习
Databricks 和 DataRobot 需要数据及运维。使用按时间分离的测试数据,与简单基线比较。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Databricks AI | 5.0 | 5 / 5 / 5 |
| DataRobot | 4.5 | 5 / 4 / 4 |
科学、气候与生物模型
AlphaFold 和 WeatherNext 的目标不同。使用独立参考验证结构预测或天气预报。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| AlphaFold | 4.5 | 5 / 4 / 4 |
| WeatherNext | 4.0 | 5 / 3 / 3 |
机器人、物流与视觉检测
Gemini Robotics、Omniverse 和 Roboflow 是不同组件。用真实硬件测试未知案例、故障和恢复。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Gemini Robotics | 4.0 | 4 / 4 / 3 |
| NVIDIA Omniverse | 5.0 | 5 / 5 / 4 |
| Roboflow | 5.0 | 5 / 5 / 4 |
电话与交互式语音智能体
比较 ElevenLabs Agents 和 Voiceflow 的完整流程。包含打断、口音及转人工情况。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| ElevenLabs Agents | 4.5 | 5 / 4 / 4 |
| Voiceflow | 5.0 | 5 / 5 / 4 |
智能体测试、监控与运维
LangSmith 提供跟踪记录,Databricks 提供数据平台。注入错误来源、超时和未授权操作进行测试。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| LangSmith | 5.0 | 5 / 5 / 5 |
| Databricks AI | 4.5 | 4 / 5 / 5 |
旅行、签证与多语言服务
用 Document AI、DeepL 和 n8n 连接提取、翻译及流程。测试矛盾数据,另行核对最新官方要求。
| 产品 / 厂商来源 | 编辑评估 / 5 | F / C / W |
|---|---|---|
| Google Document AI | 5.0 | 5 / 5 / 4 |
| DeepL | 4.5 | 5 / 4 / 4 |
| n8n | 5.0 | 5 / 5 / 5 |
完整原始资料
简明总览包含全部类别和评分。德文原始文档另列各产品用途、局限和成本因素。决定前请向厂商核查最新价格、许可、访问条件及地区可用性。
实际模型测试:客户询问(PDF,德文)
独立完成的模型测试:十条合成询问、三个模型、三十次运行。不是客户案例,也不证明图谱中所有产品的表现。
实际模型测试:客户询问(PDF,德文)