过去一年,AI(人工智能)发展得很快,特别是最近两个月,模型和工具更新得让人有点跟不上。看到别人用 AI 做报告、处理表格、写文章,再看看自己得到的结果,很多刚接触 AI 的人就开始困惑:是不是我用的工具不行?为什么我使用 AI 得到的结果不如他们?时间久了,有人直接认命,也有人觉得工具太差。
其实,工具只是其中一个原因。你想完成什么、给了 AI 哪些信息、有没有检查结果,同样会影响它的表现。我想开一个完整的系列,带你从零开始了解怎么使用 AI,让它成为学习和工作的好帮手。这一篇先聊三个问题:认识 AI、定位 AI,以及怎么选择适合自己的工具。
一、认识 AI#
首先,我们先来认识一下平时接触的 AI。ChatGPT、DeepSeek、千问、文心一言、豆包,这些都是我们常见的 AI 助手,它们背后通常由一个或多个大模型提供能力。有些名字也同时指模型系列,刚开始不用急着记清楚所有产品,先了解它们怎么工作就可以。
大语言模型的英文全称是 Large Language Model,简称 LLM,主要负责理解和生成语言。比如你问一个问题,让它解释一个概念、修改一段文字,它会根据你提供的信息生成回答。支持多模态的模型,还可以处理图片、声音、视频等不同类型的信息。
简单理解,大模型像 AI 的“大脑”。联网搜索、浏览器、文件操作、代码执行这些工具,则像它的手和眼睛,让它能够查资料、读取文件和完成具体操作。
Agent 的中文是“智能体”。你给它一个目标,它会根据任务和中间结果判断下一步,选择工具,再继续处理。比如 Codex、WorkBuddy 就是这类智能体工具,Codex 主要用于编程,WorkBuddy 面向办公任务。
智能体把模型和工具组织起来,推进多步骤的工作。不过,能搜索、能读文件,并不自动等于智能体;还要看它能不能根据执行情况继续安排步骤。这样理解,后面选工具时就容易判断了。
二、定位 AI#
其次,我们要正确地定位 AI。我很认同一个原则:AI 可以帮我们完成很多工作,也可以辅助思考,但最终的判断还是要自己负责,AI 不能代替思考。
比如它帮我制定一个计划,我需要看看时间和预算是否合适;它帮我总结论文,我需要核对原文和引用;它帮我处理表格,我也要确认公式和统计结果。AI 回答得很流畅,甚至看起来很有把握,内容仍然可能出错。
还有一点,不要因为觉得某个模型很强,就把所有事情都交给它。
我自己就遇到过这样的情况。当时觉得 Gemini(谷歌的 AI 助手)的多模态能力很好,就让它帮我提取视频字幕。结果折腾了一下午,额度用完了,提取出来的内容还是不尽人意。后来换成剪映,不到 10 分钟就处理完了。
这只是我那次使用的结果,不能由此判断 Gemini 在其他任务上的表现。但对那次提取字幕的需求来说,剪映确实更合适。工具能不能帮我把事情做好,需要看实际结果。
所以,把 AI 当作学习和工作的助手就可以。它可以讲题、查资料、整理材料、处理文件,我们要说清楚要求,也要检查它交出来的东西。
三、选择 AI#
最后,也是这一篇最重要的问题:怎么选择合适的 AI 工具?
网上经常有人嘲讽豆包,说它是“糖宝”。慢慢就形成了一种工具鄙视链:用豆包就被嫌弃,用 Codex 才显得懂 AI,甚至有人觉得不用 GPT6 Astra 就算不上会用 AI。
我自己就很喜欢用豆包。比如想找家常菜的做法,我会直接问它,它能帮我找到相关的抖音视频。豆包的语音输入工具我也经常用,对我来说很方便,输入快捷,识别效果也不错。能够把我的需求处理好,我就觉得它好用。
好了,回归正题。选工具前,先分清楚自己想要什么结果:想问一个答案、学会一种方法,还是想把一件事情交给它,最后拿到能用的成果?
比如,我现在有一个 Excel(电子表格软件)表格,只想知道怎么把 A 列乘 B 列,结果放到 C 列。这时候用普通聊天就够了,直接问:
A1 乘 B1,结果填在 C1,再向下填充,公式怎么写?
它告诉我在 C1 输入 =A1*B1,再向下填充,我就能自己完成操作,没有必要为这个问题专门启动智能体。
但如果我的要求是“把这个 Excel 文件交给你,删除没有数据的记录,补好公式,统计不同地区的销售额,生成三张图,最后写一份报告”,就需要能读写表格、计算、生成文件的工具。支持这些功能的 AI 助手、专门的表格工具或智能体,都可以考虑。哪些空白记录可以删除,也要先说清楚。
再说普通网页版聊天适合什么情况。比如我准备去北京玩,想问有哪些景点值得去,再查查故宫的开放时间和预约规则;遇到一道不会的题目,需要 AI 给我讲解;手里已经有三篇论文,上传以后让它总结内容、比较研究方法。这些需求,用具备联网搜索或文件阅读功能的网页 AI 就能处理。
如果想把同一件事情继续做下去,需求就会不同。北京旅游,我希望它自己查询景点、天气、预约规则和交通时间,根据我的预算、住宿位置调整路线,遇到时间冲突继续查询,最后生成三日行程表。学习上,我希望它把错题保存到指定文件,按知识点整理,持续更新练习和复习计划。论文上,我希望它自己搜索近五年的相关论文,筛选、阅读、比较方法,最后生成带引用的综述。这些任务需要调用工具、根据中间结果继续安排步骤,更适合交给具备相应能力的智能体,最后再检查行程、错题记录和论文引用。
不过,网页和应用程序只是使用入口。网页中的 AI 也可能提供智能体功能;能生成一份文档,也不代表一定要用智能体。真正要看的是它有哪些能力,能替你完成哪些步骤。
到这里就可以发现:先明确任务,再选择能完成任务的工具,使用 AI 会容易很多。 一个公式直接问聊天 AI,需要处理整份表格就找表格工具,要自行推进多个步骤再考虑智能体。没有必要只看模型名字和排行榜。
选好工具以后,怎么把要求说清楚,也会影响结果。下一篇,我们再聊怎么跟 AI 说话。










