pg电子麻将胡了吴恩达：AI智能体工作流今年将有巨大进展可能超过下一代基础模型_PG电子·麻将胡了「中国」官方网站-IOS/安卓通用版/手机APP下载

pg电子麻将胡了新闻中心

联系我们

电话：400-123-4567

邮箱：PG@zajsgc.com

地址：山东东阿经济开发区霞光路西首路北

pg电子麻将胡了吴恩达：AI智能体工作流今年将有巨大进展可能超过下一代基础模型

发布时间：2024-03-27 05:31:37 浏览：[]次

　　随着 ChatGPT、GPT-4、Sora 的陆续问世，人工智能的发展趋势引起了广泛关注，特别是 Sora 让生成式 AI 模型在多模态方面取得显著进展。人们不禁会问：人工智能领域下一个突破方向将会是什么？

　　今天，人工智能著名学者、斯坦福大学教授吴恩达指出：AI 智能体工作流将在今年推动人工智能取得巨大进步，甚至可能超过下一代基础模型。他呼吁所有从事人工智能工作的人都关注 AI 智能体工作流，并撰写一篇博客简单阐述了原因。

　　当前，我们主要在零样本模式下使用 LLM，提供 prompt，逐个 token 地生成最终输出，没有进行调整。

pg电子麻将胡了吴恩达：AI智能体工作流今年将有巨大进展可能超过下一代基础模型(图1)

　　这类似于要求某人从头到尾写一篇文章，直接打字，不允许退格，并期望得到高质量的结果。尽管有困难，LLM 在这项任务上仍然表现得非常好！

　　然而，通过智能体工作流，我们可以要求 LLM 多次迭代文档。例如，它可能需要执行一系列步骤：

　　这个迭代过程对于大多数人类作家写出好的文本至关重要。对于人工智能来说pg娱乐电子游戏，这种迭代工作流会比单次编写产生更好的结果。

　　Cognition AI 团队发布的最近在社交媒体上引起了广泛关注。吴恩达的团队一直密切关注 AI 编写代码的发展，并分析了多个研究团队的结果，重点关注算法在广泛使用的 HumanEval 编码基准上的表现。

　　如下图所示，吴恩达的团队发现：GPT-3.5（零样本）的正确率为 48.1%，GPT-4（零样本）的表现更好，为 67.0%。然而，相比于迭代智能体工作流，从 GPT-3.5 到 GPT-4 的改进不大。事实上，在智能体循环（agent loop）中，GPT-3.5 的正确率高达 95.1%。

　　开源智能体工具和有关智能体的学术文献正在激增。这是一个令人兴奋的时刻，也是一个令人困惑的时刻。为了帮助人们正确看待这项工作，吴恩达分享了一个对构建智能体的设计模式进行分类的框架。

　　工具使用：LLM 拥有网络搜索、代码执行或任何其他功能来帮助其收集信息、采取行动或处理数据。

　　规划：LLM 提出并执行一个多步骤计划来实现目标（例如，撰写论文大纲，然后进行在线研究，然后撰写草稿......）。

　　多智能体协作：多个 AI 智能体一起工作，分配任务并讨论和辩论想法，以提出比单个智能体更好的解决方案。

　　吴恩达表示 AI Fund 已在许多应用程序中成功使用这些模式，后续他将详细阐述这些设计模式。

　　本文为澎湃号作者或机构在澎湃新闻上传并发布，仅代表该作者或机构观点，不代表澎湃新闻的观点或立场，澎湃新闻仅提供信息发布平台。申请澎湃号请用电脑访问。