地址: 福鼎市赔潮之塔17号 邮箱: nutty@msn.com 工作时间:上午9点-下午8点

新闻中心

  • 首页
  • Our Portfolio
  • 豆包成为机器之心编辑部的高效「实习生

豆包成为机器之心编辑部的高效「实习生

2026-08-22

豆包的面貌发生了显著变化。对于熟悉豆包的用户来说,启动最新版时,眼前依旧是熟悉的对话界面,但只需切换至“工作”模式,就能感受到它与以往的聊天式AI截然不同的功能。过去,用户通常只需提出问题,然后静待答案,豆包会提供知识的解析、信息搜索、文字润色及图片生成等,这种交互始终都围绕人发出指令,模型在对话框中作出回应的模式。然而如今,豆包已能够直接接手具体的任务!在遇到需要较长时间处理的工作时,它能够规划步骤、操作浏览器和电脑,甚至处理本地文件;它还可在云端电脑中持续运作,用户则可以通过手机远程查看和调整进程。随着技能商店的上线、连接器和工作伙伴功能的加入,豆包可以为自身安装工作经验,进入飞书等真实办公系统,并将复杂任务拆分给多个AI角色。因此,用户交给它的不再是单纯的问题,而是一项需要完成的具体任务,豆包的反馈也不再仅局限于一段回答,而可能是已经写入飞书的文档、一份处理完整的表格、一个网站或应用,或者涉及多个软件的一系列操作。

这样的转变不仅仅是在原有聊天产品中增加了几个按钮,而是豆包重新定义了其基本的交互单位:从“问与答”转变为“任务与交付”。总体来看,豆包的产品形态逐渐模仿Codex。最初Codex给人的印象是一个编程助手,但它所体现的产品形态并不仅限于“更能编程”。使用Codex时,用户通常会设定目标并提供背景信息,而代理程序则在独立的工作空间中读取文件、调用工具、修改内容、运行检查,最终交付可以供后续审阅与修改的成果。如今Codex(已经整合进ChatGPT的桌面端)也已经拓展到长期目标、技能、外部系统整合和计算机使用等任务导向的工作流程。而豆包则从另一个方向向这种形态靠近。虽然Codex起点是代码和工程环境,豆包则以大众用户的问答、创作和搜索为出发点,但两者正在逐步汇聚为相似的形态:以任务(而非消息)为中心,为代理提供可以持续工作的环境、可复用的技能、外部数据与工具,以及最终成果。

那么目前豆包的能力已经达到什么程度呢?为了回答这一问题,我们为豆包设计了一项接近现实工作的任务:创建一个能够自动运作的选题到文章的编辑工作流。在整体体验下来,我们的感受是操作简单,流程畅通无阻,最终成果基本可用,几乎就像一位拥有丰富经验的实习生。豆包成为了机器之心编辑部的“实习生”。在我们还未到达办公室的早晨,飞书工作群中已看到几篇新的草稿。每篇稿件都带有简介和飞书文档链接,点击后发现,无论是标题、封面图、配图、正文结构还是参考资料,几乎齐全。以一篇需进一步编辑和核实的新闻初稿为例,尽管AI风格明显,但其完成度已相当高。

在这个过程中,我们只做了一件事:在手机上输入了几个数字。根据下方的PANDA-NOTE,显示我们正在远程控制笔记本电脑上的豆包。真正执行这些编辑任务的,就是我们新招的“实习生”:豆包。我们不过是提供了400字不到的简短提示。这虽然看似又一次“AI写稿”,但更令我们关注的,是在文章生成前后发生的变化。通过观察,这实则是一条跨越浏览器、手机、电脑、文档及协作工具的工作链。我们设定目标,并在关键时刻进行判断;而过去编辑师需不断切换窗口、复制链接、传递信息的繁琐过程,如今可以由“无技术背景的用户”轻松将其整合于同一任务中连续执行。

如果再利用豆包桌面端的新功能工作伙伴·小队,我们便能构建出更强大的智能团队来完成编辑部的各项任务。举个例子,以上任务可以拆分为,由AI主编智能体协调管理选题捕手、调研员、主笔、AI绘画师、飞书文书、群聊信使这六个智能体,并为每个角色设定相应的任务和技能。随后,智能体团队便会按照预设的分工,依次推进各项任务。

从任务分解及成果交付的视角来看,这个智能体小队在相当程度上承担了独立编辑的执行工作。不过,这并不意味着它具备专业编辑的全部判断能力,我们仍然不会直接发布AI生成的稿件,事实核查、价值判断和最终责任依旧归于人类。但是,豆包确实使我们从具体操作的执行者转变为更接近工作成果的审查者。几天前,若想在一个通用AI产品中实现这样一条工作链,可能需要手工组合多个工具。然而,在过去一周,豆包工作任务的各项能力密集更新,正好满足了运行这一流程所需的各个部分。由此,我们决定暂时搁置“它写得像人”的老问题,换个视角评估办公AI:它能否在真实工作环境中,将任务从开始到最后的交付推进完成?

订阅我们的时事通讯并获取最新消息