首位“AI软件工程师”亮相引爆科技圈
2024-05-16 【 字体:大 中 小 】
【科技创新世界潮】(317)
◎本报记者 张梦然
一家成立不到两个月但拥有十名天才工程师的初创公司Cognition,搞了一个引爆科技圈的大动作。
他们推出了一款名为Devin的人工智能(AI)助手,可以协助人类软件工程师完成诸多开发任务。Devin不同于现有其他AI编码者,它可以从零构建网站、自行部署应用、修复漏洞、学习新技术等,人类只需扮演一个下指令和监督的角色。
这是第一个真正意义上完全自主的AI软件工程师,一亮相即掀起轩然大波,因为人们担心:人类程序员是不是真要失业了?
测试表现超越“同辈”
据Cognition官网报道,Devin只需一句指令,即可端到端地处理整个开发项目。
按照用户需求,Devin可以同时执行多步骤工作流程,人类工程师则可以实时观察其进度,发现错误时,跳出指令进行修正。这便于工程师们将大部分工作“外包”给AI,自己则可以潜心于创意性工作。
在SWE-bench基准测试中,Devin的表现远超Claude 2、Llama、GPT-4等选手,能够完整正确地处理13.86%的问题。相较之下,GPT-4只能处理1.74%的问题。更重要的是,Devin在测试中没有得到任何帮助,而其他所有模型都需要帮助,即人们要准确告知模型需要编辑哪些文件。
这一进展,标志着AI在自主理解和解决软件开发问题方面取得了显著进步。目前,Devin已经成功通过一家AI公司面试,并且在Upwork上完成了实际工作。
运作几乎完全自主
Devin的厉害之处,还在于可以规划和执行异常复杂的工程任务,这类任务通常需要数千个决策才能完成。在这之中,无论进行到任何一步,它都可以回调所有相关的上下文信息,保证任务的逻辑性,也便于随时校正。
更让人震撼的是,Devin不仅能帮人们解决代码,还囊括了与之相关的整个工作流。
譬如,当工程师需要设计一个网页游戏时,Devin首先能生成网页,接着还能完成服务端的部署,最后直接发布上线,省去了中间大量人工操作。甚至在发现漏洞之后,Devin还会回溯报错出现的位置及对应的数据,然后分析原因并给出解决方案。
此外,作为一个AI全能助手,Devin还可以帮助人类训练和微调其他AI。对于一些常见的模型,你只需要提及模型的名称,Devin自己就知道要怎样去训练。
那人们需要做什么呢?按设想,最终的Devin会让人类只需要发号施令,其他什么也不用做。
对软件开发业影响深远
初创公司Cognition虽然只有十名员工,但他们手中却握着十块IOI(国际信息学奥林匹克竞赛)金牌,核心创始团队为3名华人。
Devin现处于内测阶段,有意用户可申请提前试用。目前,团队尚未透露更多核心技术细节,但他们表示,Devin源于其长期推理及规划研究的进展。编码只是第一步,这一AI助手其实可推广到更宽领域。
Devin的出现,可能对软件开发行业产生深远影响,甚至可能减少对人类开发者的需求。但须注意到,该技术仍处于早期阶段,其成熟度和效果需要业界作进一步评估。
就目前而言,Devin的成功可以说为当今软件开发人员带来更新更好的AI协作体验。人们从繁琐工作中“解放”,只需监督AI系统去处理,而自己将精力投入到创新性任务上,实现生产力的真正提高。(来源:科技日报)


猜你喜欢

1979年7名战士被越军包围,陈书利指挥队友杀敌36人,被授予“战斗英雄”


2024年3月8日全国主要批发市场猪心价格行情


麦捷科技(300319SZ):目前AI在云边端侧的应用产品仍有较多处于设计或概念阶段


郭艾伦称因物流失误“耽误治疗”,中通快运道歉


七星配资官网app下载:玩转杠杆,稳步致富?深度解析高风险高收益的配资游戏


两次潜入水潭救人,随后展开心肺复苏和人工呼吸急救,闵行这位年轻人太厉害了_黄建_男子_人员


破面股的值博率太低


隔夜外盘:美股三大指数集体收跌 热门中概股多数上涨 理想汽车涨超18%


CCR:普通型和去分化软骨肉瘤的临床


希腊股指创2014年以来收盘新高,逼近1400点


网易开放暴雪游戏退款申请通道 申请截止日期为6月30日


千里江陵一日还,基础设施中国奇迹如何炼成


通达信黄金柱底部主图公式 底部突破信号 看主图更方便


红帮裁缝、三宅一生和阿玛尼,细数《繁花》里的上海时尚


“五一”假期黄金消费升温,“以旧换新”要注意什么?_回收_金价_优惠


4月28日特纸转债下跌088%,转股溢价率3982%


房地产,终于上演大逆转


多家中小银行基金托管业务被采取监管措施


从信息化战争到智能化战争,未来战争或将经历深远变革


贸易战下,这些企业多元化市场开拓的底气何来
