DeepFloodbeta

主流 AI 工具对比

工具 定位 核心亮点 适合谁
ChatGPT(o3 / o4-mini) 通用多模态与推理 新一代推理与工具调用(浏览、代码、文件/图像分析)更强,Plus/Team/Enterprise 可用。 (OpenAI) 需要综合问答、分析与自动化的个人/团队
Claude 3.7 Sonnet 通用对话与长文写作/编码 “混合推理”与可控思考时长,前端与编码能力增强。 (Anthropic) 追求稳健写作、推理与代码质量
Google Gemini 2.0 通用多模态与代理 原生多模态(含语音/图像/音频输出)、面向“代理”能力;2.0 Flash 面向大众开放试用;开发者模型命名/稳定通道明确。 (blog.google)
Microsoft Copilot(Microsoft 365) 办公全家桶 AI 深度融入 Word/Excel/Outlook/Teams;2025 年持续迭代功能路线;微软推出 365 Premium(个人)整合更高用量与功能。 (learn.microsoft.com)
Perplexity(含 Comet 浏览器) 搜索型问答与研究 新的 Comet AI 浏览器全面免费开放,主打带 AI 的“边逛边做”式检索与总结。 (The Verge)
工具 定位 核心亮点 适合谁
GitHub Copilot 写码/改码/代码代理 引入 Agent Mode 可跨文件实现改动与修复;Copilot Spaces 提供基于仓库上下文的工作区;Workspace 增强“自动校验”等。 (The Verge) GitHub 生态内的个人与团队开发
工具 类型 核心亮点 适合谁
Midjourney v6.1 文生图 画质/结构一致性提升、文本绘制更准、2×升尺度等;v6.1 为默认模型。 (Midjourney) 设计/电商/社媒图像
Stable Diffusion 3(系列) 文生图(开放/可本地) 文本拼写与多主体场景提升;生态广、可自托管与二次开发。 (Stability AI) 需要可控/本地化与定制的团队
Runway Gen-3 Alpha 文生视频 相比 Gen-2 在保真度、运动与一致性大幅提升,面向“世界模型”。 (runwayml.com) 宣传片/创意短视频
Pika 文生视频 “从想法到视频”的一体化平台(网页端)。 (Pika)
Suno v3 文生音乐 音质/风格控制较前代提升,面向快速出歌与 Demo。 (Suno)
Udio 文生音乐 便捷创作完整曲目(含人声),社区创作与分享。 (Udio)
工具 类型 核心亮点 适合谁
Llama 3.1(8B/70B/405B) 开源通用 多尺寸选择与强多语支持,生态成熟(GitHub/HF)。 (GitHub) 想在本地/私有云部署的大中型团队
Mistral Large 2 闭源 API/开源生态友好 代码、数学与推理显著提升,函数调用/多语更强。 (Mistral AI)
Qwen 2.5 / 2.5-Omni 开源/多模态 推出端到端多模态 Omni(文本/图像/音频/视频到文本/语音),中英场景表现强。 (阿里巴巴集团)
12
  • cy 收藏

  • 用 ChatGPT

  • 很详细,感谢分享。

  • 这些模型...像是去年这个时候总结的

  • 感谢分享

  • 那么这个表格是用什么AI工具生成的 xhj011
    哦不用问了,utm上是chatgpt

  • 感谢总结,不过看起来信息有点陈旧了

  • 详细的整理

  • 感谢分享

12