| 工具 | 定位 | 核心亮点 | 适合谁 |
|---|---|---|---|
| ChatGPT(o3 / o4-mini) | 通用多模态与推理 | 新一代推理与工具调用(浏览、代码、文件/图像分析)更强,Plus/Team/Enterprise 可用。 (OpenAI) | 需要综合问答、分析与自动化的个人/团队 |
| Claude 3.7 Sonnet | 通用对话与长文写作/编码 | “混合推理”与可控思考时长,前端与编码能力增强。 (Anthropic) | 追求稳健写作、推理与代码质量 |
| Google Gemini 2.0 | 通用多模态与代理 | 原生多模态(含语音/图像/音频输出)、面向“代理”能力;2.0 Flash 面向大众开放试用;开发者模型命名/稳定通道明确。 (blog.google) | |
| Microsoft Copilot(Microsoft 365) | 办公全家桶 AI | 深度融入 Word/Excel/Outlook/Teams;2025 年持续迭代功能路线;微软推出 365 Premium(个人)整合更高用量与功能。 (learn.microsoft.com) | |
| Perplexity(含 Comet 浏览器) | 搜索型问答与研究 | 新的 Comet AI 浏览器全面免费开放,主打带 AI 的“边逛边做”式检索与总结。 (The Verge) |
| 工具 | 定位 | 核心亮点 | 适合谁 |
|---|---|---|---|
| GitHub Copilot | 写码/改码/代码代理 | 引入 Agent Mode 可跨文件实现改动与修复;Copilot Spaces 提供基于仓库上下文的工作区;Workspace 增强“自动校验”等。 (The Verge) | GitHub 生态内的个人与团队开发 |
| 工具 | 类型 | 核心亮点 | 适合谁 |
|---|---|---|---|
| Midjourney v6.1 | 文生图 | 画质/结构一致性提升、文本绘制更准、2×升尺度等;v6.1 为默认模型。 (Midjourney) | 设计/电商/社媒图像 |
| Stable Diffusion 3(系列) | 文生图(开放/可本地) | 文本拼写与多主体场景提升;生态广、可自托管与二次开发。 (Stability AI) | 需要可控/本地化与定制的团队 |
| Runway Gen-3 Alpha | 文生视频 | 相比 Gen-2 在保真度、运动与一致性大幅提升,面向“世界模型”。 (runwayml.com) | 宣传片/创意短视频 |
| Pika | 文生视频 | “从想法到视频”的一体化平台(网页端)。 (Pika) | |
| Suno v3 | 文生音乐 | 音质/风格控制较前代提升,面向快速出歌与 Demo。 (Suno) | |
| Udio | 文生音乐 | 便捷创作完整曲目(含人声),社区创作与分享。 (Udio) |
| 工具 | 类型 | 核心亮点 | 适合谁 |
|---|---|---|---|
| Llama 3.1(8B/70B/405B) | 开源通用 | 多尺寸选择与强多语支持,生态成熟(GitHub/HF)。 (GitHub) | 想在本地/私有云部署的大中型团队 |
| Mistral Large 2 | 闭源 API/开源生态友好 | 代码、数学与推理显著提升,函数调用/多语更强。 (Mistral AI) | |
| Qwen 2.5 / 2.5-Omni | 开源/多模态 | 推出端到端多模态 Omni(文本/图像/音频/视频到文本/语音),中英场景表现强。 (阿里巴巴集团) |
cy 收藏
用 ChatGPT
很详细,感谢分享。
这些模型...像是去年这个时候总结的
感谢分享
那么这个表格是用什么AI工具生成的
哦不用问了,utm上是chatgpt
感谢总结,不过看起来信息有点陈旧了
详细的整理
@gpkptr #6 gpt
感谢分享