人工智能常用工具(四)
第4章 工具详解与使用指南(1/3)· 对话类
摘要:本章系统讲解对话类 AI 工具(大语言模型)的选型与实操。内容覆盖国际三强(Claude、Gemini)与国内六款(豆包、DeepSeek、Kimi、文心一言、通义千问、元宝)的定位、核心功能、版本状态与使用方法;并针对 Claude、Gemini、豆包、DeepSeek 四款主力工具各给出 2 个完整实操示例(含 Prompt 与预期输出)。文末提供「怎么选、怎么用、自测题」三部分小结,帮助零基础读者快速上手并跑通真实场景。
学习目标
学完本章,你应该能够:
- 认识对话类 AI 工具的全貌:清楚 Claude、Gemini 两大国际工具,以及豆包、DeepSeek、Kimi、文心一言、通义千问、元宝六款国内工具各自的定位。
- 独立完成注册与上手:能自己注册并打开任意一款工具的网页 / App,发出第一段对话。
- 写对 Prompt(提示词):掌握「角色 + 任务 + 格式 + 约束」的基本写法,让 AI 给你的回答更像样。
- 区分工具长短板:知道写文案、写代码、读长文档、做研究分别该优先用哪一款。
- 动手跑通 4 个主力的实操示例:Claude、Gemini、豆包、DeepSeek 各 2 个完整示例,包含输入 Prompt 与预期输出。—
正文讲解
对话类工具(也叫「大语言模型 / LLM」)是当下 AI 的入口级应用:你用自然语言提问,它用自然语言回答。它不搞花哨界面,核心就是「一个对话框」。下面按「国际双雄 → 国内六款」逐一讲解,每款都遵循统一双结构:一、工具介绍 + 二、使用方法。
本部分对应大纲「4.1 通用对话与大语言模型(对话类)」。
面向零基础用户,所有操作均可一步步跟着做。内容严格基于 2026 年 8 月 版本信息整理,各工具当前版本如下:
| 工具名称 | 当前版本(2026-08) |
|---|---|
| Claude | Opus 5 / Sonnet 5 / Haiku 4.5 / Fable 5 |
| Gemini | 3 |
| 豆包 | 2.1 |
| DeepSeek | V4 |
| Kimi | K3 |
| 文心一言 | 5.1 |
| 通义千问 | Qwen3.8 |
| 腾讯元宝 | 混元 |
| 一、工具介绍 |
- 核心功能:长文本处理、逻辑推理、代码工程、安全性强;支持「扩展思考 / 自适应思考(Extended Thinking)」、计算机使用(Computer Use)、最长 100 万 token 上下文窗口(Opus 5 / Sonnet 5 / Fable 5)。
- 适用场景:超长文档分析、复杂代码库开发(Claude Code)、法律 / 合同审阅、需要高安全合规的场景。
- 优势对比:上下文窗口与代码能力第一梯队;幻觉率业界较低;中文略弱于国内模型。
- 版本状态(2026-08):
- Claude Opus 5(2026-07-24 发布,旗舰最强);
- Claude Sonnet 5(默认「工作马」,性价比均衡);
- Claude Haiku 4.5(最快最便宜);
- Claude Fable 5(长程 Agent,适合多步骤自主任务);
- Opus 4 / 4.1 已于 2026 退役,请勿再选用。
二、使用方法
- 注册获取:浏览器打开
claude.ai注册(邮箱 / Google);订阅 Pro / Max 解锁 Opus 5 与更高额度;开发者到console.anthropic.com获取 API Key。 - 基础步骤:
- 新建对话,可点「附加文件」上传 PDF / 代码;
- 直接提问或要求分析文档;
- 对长任务开启「扩展思考」提升推理质量。
- 高级功能示例:
- 上传 200 页合同,要求「列出所有责任条款与潜在风险的对照表」。
- 使用 Claude Code(终端工具)让 AI 对本地代码库做重构与修复。
- 常见问题 FAQ:
- Q:Claude 中文不如国产模型? A:属实,建议中文创作优先用文心一言、豆包。
- Q:上下文窗口不够用? A:Opus 5 / Sonnet 5 支持 100 万 token,超长资料无需切片;必要时用「项目(Projects)」归档素材。
4.1.3 Gemini(Google)
一、工具介绍
- 核心功能:Google DeepMind 多模态模型(Gemini 3 当前主线),原生支持文本 / 图像 / 音频 / 视频 / PDF;实时语音 Gemini Live(可「看」摄像头)、深度研究(Deep Research)、最长 2M 上下文窗口(Gemini 3 Pro / Ultra)。
- 适用场景:超长资料分析、跨模态理解(如图表 + 文字联合推理)、研究综述、Google 生态办公(Gmail / Docs / Slides)。
- 优势对比:上下文窗口最长(最高 2M)、与 Google 搜索 / 地图「接地(Grounded)」、免费层可用 2.5 Flash;中文弱于国内模型。
- 版本状态(2026-08):Gemini 3 为当前主线(3 Pro / Flash,部分预览);2.5 系列稳定至 2026-10-16 退役;「Bard(已停用)」名称已于 2023 年底停用,请勿再引用「Bard(已停用)」。
二、使用方法
- 注册获取:
gemini.google.com或 Android / iOS App,用 Google 账号登录;订阅 Google AI Pro 解锁 2.5 Pro / 3 Pro 与 Workspace 集成;开发者用aistudio.google.com(Google AI Studio)拿 API Key(Gemini 2.5 Flash 有免费层)。 - 基础步骤:
- 对话输入,或直接把文件 / 图片拖入窗口;
- 用「@」关联 Drive 文档;
- 点「Gemini Live」进入语音实时交互。
- 高级功能示例:
- 「深度研究」:给一个主题,AI 自动检索多源并生成带引用的研究报告。
- 用 2M 上下文窗口一次性投喂整本书 + 全部论文,要求「找出矛盾与共识」。
- 常见问题 FAQ:
- Q:所在地区无法访问? A:请以官方渠道与当地法律法规为准;企业用户可咨询官方支持获取区域部署方案。
- Q:选 2.5 还是 3? A:生产环境先用稳定的 2.5 Flash / Pro,2026-10 前迁移到 Gemini 3。
4.1.4 国内通用大模型(豆包 / DeepSeek / Kimi / 文心一言 / 通义千问 / 元宝)
本节按「代表工具简述 + 横向对比表」组织。国内工具共同优势:访问便捷、中文优化好、免费额度充足、数据合规驻留。
豆包(字节跳动 · 2.1 系列)
- 介绍:国民级全能 AI,拥有庞大的用户规模;2026 发布 2.1 系列,新增「办公任务模式」(自主拆解步骤、调用本地 Office / 浏览器执行任务)。中文创意写作、口语化表达最强。
- 使用要点:App / 网页 / 抖音内直接使用,免费层充足。适合日常问答、短视频脚本、PPT、数据分析。
DeepSeek(深度求索 · V4 系列)
- 介绍:V4 系列(2026-04),全系 100 万 token 上下文窗口;代码、数学、逻辑推理顶尖;开源 + 极低价,支持私有化部署。短板:多模态与生活化交互一般。
- 使用要点:
deepseek.com网页 / APP 免费;开放平台api.deepseek.com调用。开发者与理工科研首选。
Kimi(月之暗面 · K3)
- 介绍:K3(2026-07,2.8T 参数) 长文本之王,原生 100 万 token 上下文窗口、超强复杂推理;可一句话生成完整游戏、整合数十份研报。短板:日常响应偏慢、免费层紧。
- 使用要点:
kimi.com网页 / APP;适合长文献阅读、论文、合同、代码库分析。
文心一言(百度 · ERNIE 5.1)
- 介绍:中文理解与古文诗词领先,联动百度搜索带权威来源;2026 新增「深度阅读」「图表生成」;政企金融私有化成熟、合规强。短板:风格偏保守、更新节奏慢。
- 使用要点:
yiyan.baidu.com;适合公文、文史、识图、合规场景。
通义千问(阿里 · Qwen3.8-Max)
- 介绍:超长文本深度分析突出,原生 100 万 token 上下文窗口;多模态(图 / 语音 / OCR)组合强;开源体系完善、企业市场表现领先。
- 使用要点:
tongyi.com/ 通义 APP / 阿里云百炼;开发者可用 Qwen 开源权重本地部署。
腾讯元宝(混元)
- 介绍:深度集成微信生态,支持微信群聊一键总结、公众号检索、京东购物联动;对话流畅、安全合规。
- 使用要点:元宝 APP / 微信小程序;微信重度用户首选。
国内模型横向对比(2026)
| 工具 | 核心长板 | 典型场景 | 上下文 | 价格取向 |
|---|---|---|---|---|
| 豆包 | 全能均衡、生态联动 | 日常 / 创作 / PPT | 长 | 免费为主 |
| DeepSeek | 代码数学、性价比 | 编程 / 科研 / 私有化 | 1M | 极低价 |
| Kimi | 长文本 / 复杂推理 | 论文 / 合同 / 大代码库 | 1M | 中等 |
| 文心一言 | 中文 / 古文 / 合规 | 公文 / 文史 / 政企 | 长 | 订阅 |
| 通义千问 | 深度分析 / 多模态 | 企业 / 文档 / 分析 | 1M | 订阅 + 开源 |
| 元宝 | 微信生态 | 群聊总结 / 内容 | 长 | 免费为主 |
国际三强 vs 国内六款 全工具横向对比总表(2026-08)
| 工具名称 | 当前版本 | 核心长板 | 上下文长度 | 最适合场景 |
|---|---|---|---|---|
| ChatGPT | GPT-5.6 | 全能均衡、前端 UI 生成突出 | 约 400K token | 日常问答、文案创作、数据分析、前端 UI 生成 |
| Claude | Opus 5 / Sonnet 5 / Haiku 4.5 / Fable 5 | 长文本、代码工程、幻觉率低 | 100 万 token | 超长文档分析、复杂代码库、合同审阅 |
| Gemini | 3 | 多模态、深度研究、Google 生态 | 最高 2M token | 超长资料分析、研究综述、跨模态理解 |
| 豆包 | 2.1 | 全能均衡、中文创意写作、生态联动 | 长 | 日常问答、短视频脚本、PPT、数据分析 |
| DeepSeek | V4 | 代码数学、逻辑推理、性价比 | 100 万 token | 编程、科研推理、私有化部署 |
| Kimi | K3 | 长文本、复杂推理 | 100 万 token | 长文献阅读、论文、合同、大代码库 |
| 文心一言 | 5.1 | 中文理解、古文诗词、合规 | 长 | 公文、文史、识图、政企合规 |
| 通义千问 | Qwen3.8 | 深度分析、多模态、开源体系 | 100 万 token | 企业文档分析、多模态、本地部署 |
| 腾讯元宝 | 混元 | 微信生态深度集成 | 长 | 微信群聊总结、公众号检索、微信重度用户 |
4.2 操作示例
下面针对 5 款主力工具,每款提供 2 个完整示例。每个示例都包含:场景与前置准备、具体操作步骤、你实际输入的 Prompt、预期输出、常见问题排查。请打开对应工具网页 / App 后跟着做。
一、ChatGPT(2 个示例)
示例 1:写一段文艺风朋友圈文案,推荐一家咖啡馆
-
场景与前置准备:已注册 ChatGPT 账号、打开
chat.openai.com网页,使用免费层或 Plus 均可。 -
具体操作步骤:
- 点击「New chat」新建对话;
- 在底部输入框粘贴下面的 Prompt;
- 按回车发送;
- 觉得不满意可继续说「再短一点」「换个 emoji」。
-
你输入的 Prompt:
帮我写一段朋友圈文案,推荐一家咖啡馆,文艺一点。要求: - 风格:安静、治愈、带一点慵懒的文艺感 - 提到「手冲咖啡」「靠窗的位置」「午后阳光」三个元素 - 不超过 60 字 - 结尾加一个合适的 emoji -
> 示例输出:
午后的阳光斜斜落在靠窗的位置,一杯手冲慢慢凉下来。什么都不用赶,就这样坐着,也很好。☕️
-
常见问题排查:
- 输出太长 / 不够文艺?→ 在 Prompt 里强调「不超过 60 字」「更克制一点」。
- 免费层答得简单?→ 这是 GPT-5.6 mini 的正常表现,关键任务可升级 Plus 用完整 GPT-5.6。
示例 2:上传 Excel 后用「数据分析」生成图表
-
场景与前置准备:已注册 ChatGPT 账号;准备一份本地 Excel(例如「2026 上半年各月销售额.xlsx」,含「月份」「销售额」两列)。
-
具体操作步骤:
- 新建对话;
- 点输入框左侧「+」或回形针图标,上传 Excel 文件;
- 输入下面的 Prompt 发送;
- ChatGPT 会调用「数据分析」自动生成折线图与洞察,可要求「导出为图片」。
-
你输入的 Prompt:
请分析这份销售数据: 1. 用折线图展示各月销售额变化趋势; 2. 指出增长最快和最慢的月份; 3. 用一句话总结上半年的整体走势。 -
> 示例输出:
已为你生成折线图(见上方图表)。
- 增长最快:3 月(环比 +28%),主要受春季促销带动。
- 增长最慢:5 月(环比 +3%),临近淡季增速放缓。
- 整体走势:上半年呈「先升后稳」的温和上行,累计同比增长约 19%。
需要我把图表导出为 PNG 吗?
-
常见问题排查:
- 上传后无「数据分析」入口?→ 免费层可能受限,确认文件为 .xlsx 且数据规整;Plus 更稳定。
- 图表报错 / 读错列?→ 检查表头是否含合并单元格或空格,重新整理后重传。
二、Claude(2 个示例)
示例 1:让 Claude 审阅一份合同,列出风险条款
-
场景与前置准备:已注册
claude.ai账号;准备一份 PDF 合同(可用任意模板,几十页即可)。 -
具体操作步骤:
- 新建对话,点「附加文件」上传 PDF;
- 输入下面的 Prompt;
- 对长文档可先开启「扩展思考」再发送;
- 看完结果可追问「第 3 条风险怎么改」。
-
你输入的 Prompt:
这是我方(甲方)的一份服务合同,请帮我审阅: 1. 列出所有「责任划分」相关条款,并标注在第几页; 2. 指出其中对甲方潜在不利的 3 个风险点; 3. 用表格呈现「条款位置 | 风险 | 修改建议」。 -
> 示例输出:
已读取文档(共 38 页),定位到 5 处责任条款,重点风险如下:
条款位置 风险 修改建议 第 12 页 第 7.2 条 违约责任单方面加重甲方 改为双方对等,设上限 第 19 页 第 9.1 条 保密义务期限过长(永久) 限为合同终止后 3 年 第 24 页 第 11 条 争议管辖地在乙方所在地 改为甲方所在地或仲裁 需要我起草具体的修改措辞吗?
-
常见问题排查:
- 中文表达生硬?→ 在 Prompt 末尾加「用自然流畅的中文,避免翻译腔」。
- 文件太大传不上?→ Opus 5 支持 100 万 token,一般无需切片;仍超限可先转纯文本分段。
示例 2:用 Claude 重构一段 Python 代码
-
场景与前置准备:已注册 Claude(Opus 5)账号;有一段「能跑但写得乱」的 Python 函数。
-
具体操作步骤:
- 新建对话,直接粘贴代码(或上传 .py 文件);
- 输入下面的 Prompt;
- 把返回的新代码复制到本地运行验证。
-
你输入的 Prompt:
下面这段 Python 统计函数可读性差、还有重复计算,请帮我重构: 1. 保持功能不变(输入列表,返回均值和标准差); 2. 提取重复逻辑、加清晰变量名和注释; 3. 最后补一个简单单元测试。 (在此粘贴你的代码) -
> 示例输出:
重构后的代码:
import math def summarize(numbers): """返回列表的均值与标准差。""" n = len(numbers) if n == 0: return 0.0, 0.0 mean = sum(numbers) / n variance = sum((x - mean) ** 2 for x in numbers) / n return mean, math.sqrt(variance) def test_summarize(): assert summarize([2, 4, 4, 4, 5, 5, 7, 9]) == (5.0, 2.0) assert summarize([]) == (0.0, 0.0)已消除重复求和,并加了一个断言测试。
-
常见问题排查:
- 返回代码报语法错?→ 极少但可能发生,复制时确认未截断;可让 Claude「逐行解释这段代码」。
- 想接本地代码库?→ 用 Claude Code(终端工具),需
console.anthropic.com的 API Key。
三、Gemini(2 个示例)
示例 1:用「深度研究」生成一份带引用的调研报告
-
场景与前置准备:已用 Google 账号登录
gemini.google.com(或 App);可订阅 Google AI Pro 解锁 3 Pro,免费层用 2.5 Flash 也能做基础研究。 -
具体操作步骤:
- 新建对话,选择「深度研究(Deep Research)」模式;
- 输入下面的 Prompt;
- 等待 Gemini 检索多源(几十秒到几分钟);
- 查看带引用链接的报告,可要求「导出为 Google 文档」。
-
你输入的 Prompt:
请做一次深度研究:2026 年「AI 智能体(Agent)」在企业落地的三大主流场景是什么? 要求:检索近一年的权威来源,给出每个场景的代表性案例,并附引用链接。 -
> 示例输出:
AI Agent 企业落地三大场景(2026)
1. 客服与工单自动化
代表:某金融机构用 Agent 处理常见咨询,平均处理时长下降约 35%(来源:行业白皮书 [链接])。
2. 研发与代码工程
代表:Claude Code / Cursor 类工具进入工程流水线(来源:Anthropic 博客 [链接])。
3. 数据分析与决策辅助
代表:BI + Copilot 自动生成经营看板(来源:Microsoft 文档 [链接])。
共引用 11 个来源,完整列表见文末。 -
常见问题排查:
- 报告来源打不开?→ 引用可能失效,点开原文核实(见第六章 6.3)。
- 免费层研究慢?→ 2.5 Flash 够用;追求质量升 3 Pro。
示例 2:用 2M 上下文一次性对比「整本书 vs 多篇论文」
-
场景与前置准备:已登录 Gemini 3;准备一份 PDF 电子书 + 2~3 篇 PDF 论文(总页数适中,远未达 2M Token 上限)。
-
具体操作步骤:
- 把文件逐个拖入对话窗口;
- 输入下面的 Prompt;
- Gemini 3 会在超长上下文窗口中联合理解,输出对照结论。
-
你输入的 Prompt:
我上传了一本书和几篇相关论文。请帮我: 1. 找出书中观点与论文结论「相互矛盾」的地方,逐条列出; 2. 再找出「彼此印证」的共识点; 3. 用「矛盾 | 共识」两栏表格呈现。 -
> 示例输出:
已联合阅读全书(412 页)与 3 篇论文,核心对照如下:
矛盾 共识 书第 8 章认为「小模型已够用」,论文 A 指出「复杂推理仍需大模型」 双方都认同「数据质量决定上限」 书主张「Agent 今年普及」,论文 B 认为「企业落地慢于预期」 均同意「人机协作是主形态」 需要我针对某一条展开论证吗?
-
常见问题排查:
- 文件拖不进去?→ 确认是 PDF;超大文件先压缩或拆分。
- 输出偏泛?→ 在 Prompt 里指定「请引用具体页码」提升精度。
四、豆包(2 个示例)
示例 1:生成一条短视频口播脚本
-
场景与前置准备:已打开豆包 App 或
doubao.com网页,登录即可(免费层充足)。 -
具体操作步骤:
- 新建对话;
- 输入下面的 Prompt;
- 可继续说「改成 30 秒版本」「加点梗」。
-
你输入的 Prompt:
帮我写一条抖音口播脚本,主题:用 3 个习惯告别拖延症。 要求:口语化、有网感、开头 3 秒抓人,时长约 40 秒,分「画面 + 台词」两栏。 -
> 示例输出:
画面:博主对着镜头叹气,手机砸在桌上
台词:明知道该干活,手却停不下来刷视频?别急,这 3 个习惯救过我的命。
画面:字幕弹出「习惯1:两分钟法则」
台词:第一,两分钟能做完的事,立刻做,别进待办清单。
画面:切便利贴特写
台词:第二,睡前写明天三件事,多了不写。第三,手机丢远点,物理隔离最狠。
画面:比心结尾
台词:明早试试,评论区交作业! -
常见问题排查:
- 风格不够「抖音」?→ 加「多用短句、加 1 个热门梗、结尾引导互动」。
- 想要更长?→ 说「扩写到 1 分钟,每点加例子」。
示例 2:用「办公任务模式」做一份周报 PPT 大纲
-
场景与前置准备:已登录豆包 2.1,且版本支持「办公任务模式」(2.1 系列新增);手头有一份本周工作流水文字。
-
具体操作步骤:
- 新建对话,开启「办公任务模式」;
- 粘贴本周工作记录;
- 输入下面的 Prompt,豆包会自主拆解并产出大纲。
-
你输入的 Prompt:
根据我贴的工作记录,帮我生成一份周报 PPT 大纲: 1. 结构为「本周进展 / 风险与阻塞 / 下周计划」三页; 2. 每页用 3~5 个要点,结论先行; 3. 最后给一页「需要协调的资源」。 -
> 示例输出:
第 1 页 本周进展
- 完成 A 项目接口联调(进度 80%)
- 上线 B 功能,日活 +12%
- 修复 3 个高优 Bug
第 2 页 风险与阻塞 - C 依赖第三方延迟,存在排期风险
- 测试环境不稳定,偶发超时
第 3 页 下周计划 - 推进 A 项目上线 / 启动 D 需求评审
第 4 页 需协调资源 - 申请 1 名后端支援 C 项目 / 协调测试环境扩容
-
常见问题排查:
- 找不到「办公任务模式」?→ 确认豆包已更新到 2.1 系列,入口通常在对话框上方工具栏。
- 大纲太笼统?→ 贴更细的工作记录,并指定「每个要点带数据」。
五、DeepSeek(2 个示例)
示例 1:用 DeepSeek 解一道数学 / 逻辑题(一步步思考)
-
场景与前置准备:已打开
deepseek.com或 App,默认免费层即可(DeepSeek V4 推理强)。 -
具体操作步骤:
- 新建对话;
- 输入下面的 Prompt;
- DeepSeek 会展示推理过程,可要求「换种解法」。
-
你输入的 Prompt:
一个水池,进水管单独开 6 小时注满,出水管单独开 9 小时放空。 两管同时开,多久能注满空池?请一步步思考并给出最终答案。 -
> 示例输出:
设水池容量为 1。
- 进水速度:1/6(池/小时)
- 出水速度:1/9(池/小时)
- 同时开净速度:1/6 − 1/9 = (3−2)/18 = 1/18(池/小时)
- 注满时间:1 ÷ (1/18) = 18 小时
答案:两管同开需 18 小时注满。
-
常见问题排查:
- 想要更严谨?→ 加「请用方程并验算」。
- 回答偏简?→ DeepSeek 偏理工风,文案类任务它不擅长,换豆包 2.1 / 文心一言 5.1。
示例 2:用 DeepSeek 写并解释一段代码
-
场景与前置准备:已登录 DeepSeek;想实现一个小功能(示例:爬取并统计网页词频)。
-
具体操作步骤:
- 新建对话;
- 输入下面的 Prompt;
- 复制代码到本地运行,报错可贴回让它修。
-
你输入的 Prompt:
用 Python 写一个脚本:读取一个 txt 文件,统计出现频率最高的 10 个中文词(用 jieba 分词), 输出词和次数。请附:依赖安装命令、运行示例、关键代码注释。 -
> 示例输出:
依赖:
pip install jiebaimport jieba from collections import Counter text = open("article.txt", encoding="utf-8").read() words = [w for w in jieba.lcut(text) if len(w) > 1] # 过滤单字 top10 = Counter(words).most_common(10) for w, c in top10: print(w, c)运行:
python count.py,将输出词频前十。需要我加上「停用词过滤」吗? -
常见问题排查:
- 没装 jieba 报错?→ 先执行
pip install jieba。 - 想私有化部署?→ DeepSeek V4 开源,可本地起模型,适合数据敏感 / 合规要求高的场景(见第六章 6.1)。
- 没装 jieba 报错?→ 先执行
小结回顾
一、对话类工具怎么选
- 写文案 / 短视频 / 日常闲聊:豆包(中文最自然)、文心一言(公文文史)。
- 写代码 / 数学 / 科研推理:DeepSeek(性价比之王)、Claude(工程最强)、ChatGPT(前端 UI 突出)。
- 读超长文档 / 合同 / 论文:Claude(100 万 token、幻觉低)、Kimi(长文本王)、Gemini(2M 上下文窗口 + 深度研究)。
- 多模态 / 研究综述 / Google 生态:Gemini。
- 微信生态重度用户:元宝。
- 国际通用、全能均衡:ChatGPT。
二、对话类工具怎么用(通用三步法)
各工具常见问题速查表
| 工具 | 问题 | 解决方案 | 正文位置 |
|---|---|---|---|
| ChatGPT | 提示「当前区域不可用」 | 检查网络与账号地区设置;企业用户可咨询官方支持获取合规部署方案 | 4.1.1 常见问题 FAQ |
| ChatGPT | 回答「一本正经胡说」 | 开启联网搜索并要求「给出引用来源」;关键信息务必人工复核 | 4.1.1 常见问题 FAQ |
| ChatGPT | 免费层够用吗 | 日常问答、简单写作够用;重度写作 / 编程 / 长文档建议升级 Plus | 4.1.1 常见问题 FAQ |
| ChatGPT | 输出太长 / 不够文艺 | 在 Prompt 里强调「不超过 60 字」「更克制一点」 | 4.2 示例 1 常见问题排查 |
| ChatGPT | 免费层答得简单 | 这是 GPT-5.6 mini 的正常表现,关键任务可升级 Plus 用完整 GPT-5.6 | 4.2 示例 1 常见问题排查 |
| ChatGPT | 上传后无「数据分析」入口 | 免费层可能受限,确认文件为 .xlsx 且数据规整;Plus 更稳定 | 4.2 示例 2 常见问题排查 |
| ChatGPT | 图表报错 / 读错列 | 检查表头是否含合并单元格或空格,重新整理后重传 | 4.2 示例 2 常见问题排查 |
| Claude | 中文不如国产模型 | 属实;古文 / 诗词 / 本地化文案优先用文心一言、豆包 | 4.1.2 常见问题 FAQ |
| Claude | 上下文窗口爆了 | Opus 5 / Sonnet 5 支持 100 万 token,超长资料无需切片;必要时用「项目(Projects)」归档素材 | 4.1.2 常见问题 FAQ |
| Claude | 中文表达生硬 | 在 Prompt 末尾加「用自然流畅的中文,避免翻译腔」 | 4.2 示例 1 常见问题排查 |
| Claude | 文件太大传不上 | Opus 5 支持 100 万 token,一般无需切片;仍超限可先转纯文本分段 | 4.2 示例 1 常见问题排查 |
| Claude | 返回代码报语法错 | 极少但可能发生,复制时确认未截断;可让 Claude「逐行解释这段代码」 | 4.2 示例 2 常见问题排查 |
| Claude | 想接本地代码库 | 用 Claude Code(终端工具),需 console.anthropic.com 的 API Key | 4.2 示例 2 常见问题排查 |
| Gemini | 有些地方无法访问 | 请以官方渠道与当地法律法规为准;企业用户可咨询官方支持获取区域部署方案 | 4.1.3 常见问题 FAQ |
| Gemini | 选 2.5 还是 3 | 生产环境先用稳定的 2.5 Flash / Pro,2026-10 前迁移到 Gemini 3 | 4.1.3 常见问题 FAQ |
| Gemini | 报告来源打不开 | 引用可能失效,点开原文核实 | 4.2 示例 1 常见问题排查 |
| Gemini | 免费层研究慢 | 2.5 Flash 够用;追求质量升 3 Pro | 4.2 示例 1 常见问题排查 |
| Gemini | 文件拖不进去 | 确认是 PDF;超大文件先压缩或拆分 | 4.2 示例 2 常见问题排查 |
| Gemini | 输出偏泛 | 在 Prompt 里指定「请引用具体页码」提升精度 | 4.2 示例 2 常见问题排查 |
| 豆包 | 找不到「办公任务模式」 | 确认豆包已更新到 2.1 系列,入口通常在对话框上方工具栏 | 4.2 示例 2 常见问题排查 |
| 豆包 | 大纲太笼统 | 贴更细的工作记录,并指定「每个要点带数据」 | 4.2 示例 2 常见问题排查 |
| 豆包 | 风格不够「抖音」 | 加「多用短句、加 1 个热门梗、结尾引导互动」 | 4.2 示例 1 常见问题排查 |
| 豆包 | 想要更长 | 说「扩写到 1 分钟,每点加例子」 | 4.2 示例 1 常见问题排查 |
| DeepSeek | 回答偏简 | DeepSeek 偏理工风,文案类任务它不擅长,换豆包 2.1 / 文心一言 5.1 | 4.2 示例 1 常见问题排查 |
| DeepSeek | 想要更严谨 | 加「请用方程并验算」 | 4.2 示例 1 常见问题排查 |
| DeepSeek | 没装 jieba 报错 | 先执行 pip install jieba | 4.2 示例 2 常见问题排查 |
| DeepSeek | 想私有化部署 | DeepSeek V4 开源,可本地起模型,适合数据敏感 / 合规要求高的场景 | 4.2 示例 2 常见问题排查 |
- 写清 Prompt:用「角色 + 任务 + 格式 + 约束」结构,越具体越好。
- 多轮追问:第一次不满意就接着改,「更口语 / 更短 / 加例子」。
- 交叉验证:关键信息(医疗 / 法律 / 学术 / 数据)务必人工复核,警惕幻觉。
三、自测题(合上文档试试答)
- 免费用户想读 200 页合同并找风险,优先选哪款?为什么?
- 写一段小红书种草文案,你选豆包还是 DeepSeek?为什么?
- Prompt 的「四要素」是哪四个?
- Gemini 当前主线版本叫什么?「Bard(已停用)」还能用吗?
- 让 AI 分析 Excel 销售趋势,ChatGPT 里该用哪个功能?
- DeepSeek V4 的上下文窗口是多少?它的核心短板是什么?
- 国内六款模型中,哪款深度集成微信生态?
- Claude 2026-08 的旗舰版本是哪一个?
答案提示与解析:
1. 免费用户想读 200 页合同并找风险,优先选哪款?为什么?
优先选 Claude。理由:Claude 的 Opus 5 / Sonnet 5 支持 100 万 token 上下文窗口,200 页合同无需切片即可整体投喂;且其幻觉率业界较低,审阅法律条款这类高风险场景更可靠。对照「国际三强 vs 国内六款 全工具横向对比总表」,Claude 的「核心长板」正是「长文本、代码工程、幻觉率低」,「最适合场景」为「超长文档分析、复杂代码库、合同审阅」,与本题需求完全吻合。备选:Kimi(K3,原生 100 万 token,长文本之王)也可胜任,但合同审阅对严谨性要求更高,Claude 幻觉率更低更稳妥。2. 写一段小红书种草文案,你选豆包还是 DeepSeek?为什么?
选 豆包。理由:豆包(2.1 系列)的「核心长板」是「全能均衡、中文创意写作、生态联动」,中文创意写作与口语化表达最强,最适合小红书这类强种草、强网感的文案场景;而 DeepSeek(V4)的「核心长板」是「代码数学、逻辑推理、性价比」,偏理工风,文案类任务并非其强项。对照「国内模型横向对比(2026)」表,豆包「典型场景」为「日常 / 创作 / PPT」,DeepSeek 为「编程 / 科研 / 私有化」,二者定位差异明显。若文案偏公文、文史风格,可改用文心一言(5.1)。5. 让 AI 分析 Excel 销售趋势,ChatGPT 里该用哪个功能?
用 「数据分析(Data Analysis)」 功能。理由:ChatGPT(GPT-5.6)内置「数据分析」,上传 Excel 后选择该功能即可自动生成折线图与洞察,无需手动写代码。对照「国际三强 vs 国内六款 全工具横向对比总表」,ChatGPT 的「核心长板」含「全能均衡、前端 UI 生成突出」,「最适合场景」含「数据分析」,与本题需求一致。操作要点:上传 .xlsx 文件后输入分析 Prompt(如「用折线图展示各月销售额变化趋势」),免费层可能受限,Plus 更稳定。6. DeepSeek V4 的上下文窗口是多少?它的核心短板是什么?
DeepSeek V4 的上下文窗口是 100 万 token;核心短板是多模态与生活化交互一般。理由:对照「国际三强 vs 国内六款 全工具横向对比总表」,DeepSeek 的「上下文长度」为「100 万 token」,「核心长板」为「代码数学、逻辑推理、性价比」,短板在正文 4.1.4 节明确标注为「多模态与生活化交互一般」。因此 DeepSeek 适合编程、科研推理、私有化部署等理工场景;若需多模态识图或生活化闲聊,应改用豆包、通义千问等。
更多推荐




所有评论(0)