鹅厂员工怎么看Agent自动持续进化?

图片

话题背景

落地一个Agent容易,但通过一定机制自动持续优化Agent却很难,不知道大家当前自动优化agent的方式有哪些?

今天不聊 Agent 怎么搭,来聊聊:让Agent 自己优化自己的方式。

以下为 9 位鹅厂同事 分享的**「Agent如何自动持续进化?****」,也欢迎大家在评论区也畅所欲言(文末有礼)**

鹅厂工程师的看法

图片
@yuchen-游戏客户端开发

关键的关键是建立自己业务的评估体系:对于你的Agent经常执行的任务,该怎么评价AI每次执行结果的好坏,有了量化指标之后才能谈优化。

至于以什么形式去沉淀,如果你对AI的定位是临时工,每次都是一锤子买卖,就比如Coding Assistant,个人理解Skill和Rule比较合适;如果AI的定位是长工,需要它自身有成长,则还需要依赖记忆模块。

图片

图片
@jery-应用开发

这个问题戳中痛点了。

现在很多 agent 项目确实是“首版能跑”,但后面怎么让它越用越聪明就开始没人说清楚了。

感觉关键不是再调几版 prompt,而是有没有把真实任务里的成功和翻车都记录下来,让 agent 能复盘、能调整策略。不然每次都像第一次上岗,永远在同一个坑里反复踩。

挺期待看到更多关于“agent 怎么建立反馈闭环和自我优化机制”的实战经验分享。

图片

图片
@luping-后台开发

Agent优化需要有一套指标度量(比如用户正向/负面反馈、Agent自身的质量数据、用户纠偏的数据),只是这套反馈增强看是由AI自身迭代还是由人工程来迭代,前者更智能可能需要结合Memory做短期/长期记忆来修正Agent行为(类似Agent自我进化),后者更多是人为介入以工程手段优化Agent效果。

之前听到过播客里面提到的一个关于数据质量的观点颇有感触,观点大意是好数据”并不是“全部都正确的数据”,恰恰是那些“有问题但包含了纠正的数据”,因为这些问题+纠正数据就可以驱动Agent更加持续进化(数据飞轮+OnlineTraining),让Agent和模型基座一起进化(不过现实情况很可能是伪需求、低频用户使用Agent在驱动起来之前就被推翻了);

在我们使用ClaudeCode过程中,Human-In-Loop环节每次选择/ESC取消/补充问题修正等过程,相当于人类在帮助Agent进行数据纠正(和自动驾驶安全员类似),这些数据一定层面可以反馈出一个Agent的智能、稳定可靠的程度(是否有人类干预)。

图片

图片
@jhon-后台开发

强化学习了解一下!

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

图片
@levon-后台开发

LLM 有两种知识。一种是模型的知识,一种是上下文的知识。

数学角度看,【模型矩阵】和【上下文向量】,粗暴地说最后是要乘到一块去的。

但【模型】是被冻结的部分,【上下文】是不断改变的部分。在现有结构下,持续学习只有两条路:

1. 模型不再冻结,可塑性。

2. 巧妙的上下文工程,也就是 “工具交互和聊天记录” 的巧思。

第一条留给训模高手来做。

第二条是当下的最热方向,创新空间巨大。

图片

图片
@jeff-应用开发

结合元认知和本体论思想来设计Agent:

一方面依托本体知识库赋予Agent理解世界的能力,另一方面依托元认知赋予Agent对思考本身进行思考和进化的能力。

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

图片
@rhysr-研发

通过AI模型来逐步优化system/_message定义。

它是一个设定AI模型行为规范的声明,定义了Agent行为的基本规则和上下文,能够帮助模型更好的理解用户意图并正确调用工具完成任务。这里用自动化浏览器举例说下,通过AI模型模拟用户操作浏览器完成网页填写/浏览/提取等:

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

使用xml格式能够更加规范的表达基本规则,有助于模型的理解上下文逻辑,比常规的用字符串来简单定义几句话,效果要好得多!

图片
@eric-技术产品

如何 “自动、持续” 进化,这是个很实际的问题。

先说结论,我个人认为 AI agent 已经完全具备自我进化的「条件」了。

和传统软件工程的迭代模式不同的是,新时代的AI Agent 产品,效果优劣几乎完全取决于提示词和上下文管理的设计。而目前,就大家基于各种 AI 工具摸索出来的工作模式,Agent 产品的迭代其实已经演变成了:

产品与研发调教出一个初步的版本;

–> 人工测试 agent 的各种核心、边界场景,并沉淀出黄金评测集;

–> 工程师提出具体的错误用例和可能的原因 ;

–> 把错误和修改建议丢给 AI,让 coding agent 进一步优化提示词(别说你手工撸提示词,在我的日常观察中,很少有人自己从0手写prompt);

–> 工程师审核,并基于黄金测评集再次测试;

–> 测试通过,发布为修订版本;

重新复盘上面这个工作流程,会发现人类在其中起到的作用只不过是监督、引导和审核。既然这样,这个SOP中的很多环节,是否很多可以由 AI 直接取代、自主执行?LLM-as-judge 的形态已经不罕见了,agent 产品应该也是同理。

设想一下,假如:在每一次测评中,引入另外一个muti-agent,用于AI产品的测试。在每个 case 中,spec agent 评测最终结果的质量与正确性。若它认为某个测试用例不通过,那么将自主分析错误原因、分派任务给 coding subagent。后续则由 subagent 重新复盘、优化系统提示词,并提交 pr 给人类review。这个流程可能还涉及很多细节,例如错误归因是否需要有置信度阈值(只有高置信度的归因才触发自动修复)、人类在其中如何干预和监督。但总的来说,目前的技术手段是完全可行的。

再形而上的来说,AI 时代所谓的“测试驱动开发”的最佳范式,人类大概率会彻底从‘执行者’变为‘守门员’和‘裁判’了。

图片

图片
@zhiyuan-前端开发

之前一篇讲数字分身帮我24h打工的内容其中的一段,想必回答了这个问题

外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传

欢迎在评论区分享

[你如何看待**Agent自动持续进化?]******

图片

🎁关注有礼

关注【腾讯技术工程】账号后台回复【Q币】

可随机抽取2位同学送出100Q币

图片

图片

如何学习AI大模型 ?

“最先掌握AI的人,将会比较晚掌握AI的人有竞争优势”。

这句话,放在计算机、互联网、移动互联网的开局时期,都是一样的道理。

我在一线互联网企业工作十余年里,指导过不少同行后辈。帮助很多人得到了学习和成长。

我意识到有很多经验和知识值得分享给大家,故此将并将重要的AI大模型资料包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。【保证100%免费】🆓

CSDN粉丝独家福利

这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】

读者福利: 👉👉CSDN大礼包:《最新AI大模型学习资源包》免费分享 👈👈

(👆👆👆安全链接,放心点击)

对于0基础小白入门:

如果你是零基础小白,想快速入门大模型是可以考虑的。

一方面是学习时间相对较短,学习内容更全面更集中。
二方面是可以根据这些资料规划好学习计划和方向。

👉1.大模型入门学习思维导图👈

要学习一门新的技术,作为新手一定要先学习成长路线图,方向不对,努力白费。

对于从来没有接触过AI大模型的同学,我们帮你准备了详细的学习成长路线图&学习规划。可以说是最科学最系统的学习路线,大家跟着这个大的方向学习准没问题。(全套教程文末领取哈)
在这里插入图片描述

👉2.AGI大模型配套视频👈

很多朋友都不喜欢晦涩的文字,我也为大家准备了视频教程,每个章节都是当前板块的精华浓缩。
在这里插入图片描述

在这里插入图片描述

👉3.大模型实际应用报告合集👈

这套包含640份报告的合集,涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示。(全套教程文末领取哈)

在这里插入图片描述

👉4.大模型实战项目&项目源码👈

光学理论是没用的,要学会跟着一起做,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战项目来学习。(全套教程文末领取哈)
在这里插入图片描述

👉5.大模型经典学习电子书👈

随着人工智能技术的飞速发展,AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型,如GPT-3、BERT、XLNet等,以其强大的语言理解和生成能力,正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。(全套教程文末领取哈)
在这里插入图片描述

👉6.大模型面试题&答案👈

截至目前大模型已经超过200个,在大模型纵横的时代,不仅大模型技术越来越卷,就连大模型相关的岗位和面试也开始越来越卷了。为了让大家更容易上车大模型算法赛道,我总结了大模型常考的面试题。(全套教程文末领取哈)
在这里插入图片描述

为什么分享这些资料?

只要你是真心想学AI大模型,我这份资料就可以无偿分享给你学习,我国在这方面的相关人才比较紧缺,大模型行业确实也需要更多的有志之士加入进来,我也真心希望帮助大家学好这门技术,如果日后有什么学习上的问题,欢迎找我交流,有技术上面的问题,我是很愿意去帮助大家的!

这些资料真的有用吗?

这份资料由我和鲁为民博士共同整理,鲁为民博士先后获得了北京清华大学学士和美国加州理工学院博士学位,在包括IEEE Transactions等学术期刊和诸多国际会议上发表了超过50篇学术论文、取得了多项美国和中国发明专利,同时还斩获了吴文俊人工智能科学技术奖。目前我正在和鲁博士共同进行人工智能的研究。

资料内容涵盖了从入门到进阶的各类视频教程和实战项目,无论你是小白还是有些技术基础的,这份资料都绝对能帮助你提升薪资待遇,转行大模型岗位。

在这里插入图片描述
在这里插入图片描述

CSDN粉丝独家福利

这份完整版的 AI 大模型学习资料已经上传CSDN,朋友们如果需要可以扫描下方二维码&点击下方CSDN官方认证链接免费领取 【保证100%免费】

读者福利: 👉👉CSDN大礼包:《最新AI大模型学习资源包》免费分享 👈👈
%免费】**

读者福利: 👉👉CSDN大礼包:《最新AI大模型学习资源包》免费分享 👈👈

(👆👆👆安全链接,放心点击)
Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐