首位“AI软件工程师”亮相引爆科技圈

来源: 人民网
2024-06-17 11:26:42

  【科技创新世界潮】(317)

  ◎本报记者 张梦然

  一家成立不到两个月但拥有十名天才工程师的初创公司Cognition,搞了一个引爆科技圈的大动作。

  这是第一个真正意义上完全自主的AI软件工程师,一亮相即掀起轩然大波,因为人们担心:人类程序员是不是真要失业了?

  测试表现超越“同辈”

  据Cognition官网报道,Devin只需一句指令,即可端到端地处理整个开发项目。

  按照用户需求,Devin可以同时执行多步骤工作流程,人类工程师则可以实时观察其进度,发现错误时,跳出指令进行修正。这便于工程师们将大部分工作“外包”给AI,自己则可以潜心于创意性工作。

  在SWE-bench基准测试中,Devin的表现远超Claude 2、Llama、GPT-4等选手,能够完整正确地处理13.86%的问题。相较之下,GPT-4只能处理1.74%的问题。更重要的是,Devin在测试中没有得到任何帮助,而其他所有模型都需要帮助,即人们要准确告知模型需要编辑哪些文件。

  这一进展,标志着AI在自主理解和解决软件开发问题方面取得了显著进步。目前,Devin已经成功通过一家AI公司面试,并且在Upwork上完成了实际工作。

  运作几乎完全自主

  Devin的厉害之处,还在于可以规划和执行异常复杂的工程任务,这类任务通常需要数千个决策才能完成。在这之中,无论进行到任何一步,它都可以回调所有相关的上下文信息,保证任务的逻辑性,也便于随时校正。

  更让人震撼的是,Devin不仅能帮人们解决代码,还囊括了与之相关的整个工作流。

  譬如,当工程师需要设计一个网页游戏时,Devin首先能生成网页,接着还能完成服务端的部署,最后直接发布上线,省去了中间大量人工操作。甚至在发现漏洞之后,Devin还会回溯报错出现的位置及对应的数据,然后分析原因并给出解决方案。

  此外,作为一个AI全能助手,Devin还可以帮助人类训练和微调其他AI。对于一些常见的模型,你只需要提及模型的名称,Devin自己就知道要怎样去训练。

  那人们需要做什么呢?按设想,最终的Devin会让人类只需要发号施 令,其他什么也不用做。

  对软件开发业影响深远

  初创公司Cognition虽然只有十名员工,但他们手中却握着十块IOI(国际信息学奥林匹克竞赛)金牌,核心创始团队为3名华人。

  Devin现处于内测阶段,有意用户可申请提前试用。目前,团队尚未透露更多核心技术细节,但他们表示,Devin源于其长期推理及规划研究的进展。编码只是第一步,这一AI助手其实可推广到更宽领域。

  Devin的出现,可能对软件开发行业产生深远影响,甚至可能减少对人类开发者的需求。但须注意到,该技术仍处于早期阶段,其成熟度和效果需要业界作进一步评估。

  <strong>流动的中国,跑出经济复苏“加速度”。</strong>

  案例解析:

  虽然五角大楼证实了米尼汉备忘录的存在,但他们更着急的似乎是撇清关系。一名美国国防部官员直言,米尼汉的言论是个人意见,“不代表美国国防部对中国的看法”。

  我国《民法典》规定,赠与合同是赠与人将自己的财产无偿给予受赠人,受赠人表示接受赠与的合同。“给孩子压岁钱在法律上属于赠与行为,孩子或者其监护人表示接受、钱款发生转移之时,压岁钱的所有权就归属于孩子所有。”法官解释说,家长给对方孩子压岁钱是另一个独立的赠与行为,并不存在压岁钱之间的交换和折抵,所以,家长给对方孩子压岁钱的行为并不影响压岁钱的归属。

  连续两年,“新春第一会”,释放出什么样的信号,背后有着怎样的深意?

  <strong>(新春走基层)乘警“老谭”值乘最后一趟列车:有开心,更有不舍</strong>

吴琳伟

声明:该文观点仅代表作者本人,搜狐号系信息发布平台,搜狐仅提供信息存储空间服务。
用户反馈 合作

Copyright © 2023 Sohu All Rights Reserved

搜狐公司 版权所有