首位“AI软件工程师”露脸引爆科技圈
米乐体育直播

  一家建立不到两个月但具有十名天才工程师的草创公司Cognition,搞了一个引爆科技圈的大动作。

  他们推出了一款名为Devin的人工智能(AI)帮手,能协助人类软件工程师完结许多开发使命。Devin不同于现有其他AI编码者,它可以从零构建网站、自行布置使用、批改缝隙、学习新技能等,人类只需扮演一个下指令和监督的人物。

  这是第一个实在意义上彻底自主的AI软件工程师,一露脸即掀起轩然,由于人们忧虑:人类程序员是不是真要赋闲了?

  据Cognition官网报导,Devin只需一句指令,即可端到端地处理整个开发项目。

  依照客户的实在需求,Devin可以一起履行多过程作业流程,人类工程师则可以实时调查其发展,发现错误时,跳出指令进行批改。这便于工程师们将大部分作业“外包”给AI,自己则可以潜心于构思性作业。

  在SWE-bench基准测验中,Devin的体现远超Claude2、Llama、GPT-4等选手,可以完好正确地处理13.86%的问题。相较之下,GPT-4只能处理1.74%的问题。更重要的是,Devin在测验中没有正真取得任何协助,而其他一切模型都需求协助,即人们要精确奉告模型需求修改哪些文件。

  这一发展,标志着AI在自主了解和处理软件开发问题方面取得了明显前进。现在,Devin现已成功经过一家AI公司面试,并且在Upwork上完结了实际作业。

  Devin的凶猛之处,还在于可以规划和履行反常杂乱的工程使命,这类使命常常要数千个决议计划才干完结。在这之中,不管进行到任何一步,它都可以回调一切相关的上下文信息,确保使命的逻辑性,也便于随时校对。

  更让人震慑的是,Devin不仅能帮人们处理代码,还包括了与之相关的整个作业流。

  比如,当工程师要规划一个网页游戏时,Devin首先能生成网页,接着还能完结服务端的布置,终究直接发布上线,省去了中心很多人工操作。甚至在发现缝隙之后,Devin还会回溯报错呈现的方位及对应的数据,然后剖析原因并给出处理方案。

  此外,作为一个AI万能帮手,Devin还可以在必定程度上协助人类练习和微调其他AI。关于一些常见的模型,你只需求提及模型的称号,Devin自己就知道要怎样去练习。

  那人们需求做什么呢?按想象,终究的Devin会让人类只需求指挥若定,其他什么也不用做。

  草创公司Cognition尽管只要十名职工,但他们手中却握着十块IOI(世界信息学奥林匹克比赛)金牌,中心开创团队为3名华人。

  Devin现处于内测阶段,有意用户可申请提早试用。现在,团队没有泄漏更多中心技能细节,但他们表明,Devin源于其长时间推理及规划研讨的发展。编码仅仅第一步,这一AI帮手其实可推行到更宽范畴。

  Devin的呈现,或许对软件开发职业发生深远影响,甚至有或许削减对人类开发者的需求。但须注意到,该技能仍处于前期阶段,其成熟度和作用需求业界作进一步评价。

  就现在而言,Devin的成功可以说为当今软件研制人员带来更新更好的AI协作体会。人们从繁琐作业中“解放”,只需监督AI体系去处理,而自己将精力投入到立异性使命上,完成生产力的实在进步。