设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AI程序员Devin卧底工作群修bug!和CTO聊技术,”顶级码农水平”

2024-03-17 20:21:20 来源: 量子位

Agent的ChatGPT时刻xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

梦晨 西风 发自 凹非寺
量子位 | 公众号 QbitAIxRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

首个AI程序员Devin,现身明星创业公司内部群。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

为解决一个技术问题,Devin借用了其创造者的账号,与客户公司的CTO交流,并根据回复调整了代码方案。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

对话之专业,围观者看了直呼这个世界太疯狂。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

事情发生在办公软件Slack,截图中的akshat是AI基础设施创业公司Modal LabsCTO Akshat BubnaxRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Modal Labs也是Devin开发商Cognition的首批客户之一。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此时Devin正披着他的创造者之一、IOI金牌得主Steven Hao的马甲。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

对话的开始,AI程序员Devin正在询问有关Modal Lab平台的密钥的生命周期问题,特别是密钥更新后传播到正在运行的应用程序所需的时间。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin表示自己已经查阅了文档,包括密钥和环境变量指南、CLI命令参考、API参考以及容器生命周期钩子和参数,但依旧没有找到关于密钥传播时间的明确信息xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin询问了更新的密钥通常需要多长时间才能被运行中的应用程序使用,因为这对于他们的运营至关重要,了解这一点将有助于管理他们的部署流程xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

人类CTO解释说,当密钥更新时,他们不会使已经运行的Modal容器失效,但是新启动的容器将会读取更新后的值。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin对此表示感谢,并决定暂时采用手动方法来管理Modal中的密钥,即在需要时调用modal deploy命令来触发相关应用程序容器的重启xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

看完整个过程后,同样是AI创业者的Raunak Chowdhuri评价到:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

发现问题、创建工单、调整代码,最好的人类开发者就是这么工作的。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin更多实测结果

拿到Devin早期测试资格的人和公司并不多,不过还是陆陆续续有人晒出实测结果。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

热衷AI的沃顿商学院教授Ethan Molick试过后,认为其新颖的实时交互方式是最值得关注的。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

您可以随时与它“交谈”,就像与人交谈一样,它会在后台不断地执行和调试您的想法。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

在测试中,Ethan Mollick要求Devin开发一个解释“创业公司融资中的股权稀释”的网站。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

不过他透露,AI还无法在没有任何帮助的情况下,自主且无差错地完成这项工作。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

要想把一个重大项目交给人工智能来完成,还有很长的路要走,但这仍然是一个令人着迷的开始。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

另一位晒出测试过程的创业者Mckay Wrigley更激动一些。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

在他晒出的27分钟测试中,只发了一个GitHub连接,让Devin部署来自开源项目的代码。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin自主把任务拆解成一系列子步骤,并一步步开始执行。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

执行过程中,Devin在安装Supabase数据库时遇到了障碍,自己打开了对应的Github仓库开始查阅文档……xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

从后续终端反馈中可以看出,Devin查到了运行Supabase所需的各种端口和密匙都应该填什么。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

(装过的都知道,雀食挺麻烦……)xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

与此同时,Devin还在根据实际情况不断修改自己的后续计划xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

一段时间过后,一个本地的聊天机器人程序就跑起来了。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

测试一段时间后Mckay Wrigley认为,Devin已经可以算Agent的ChatGPT时刻。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

复现Devin计划ing

Devin这边大伙还在接连测试,另一边开源“复现”方案也在进行中……xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

这不,GitHub三万Star项目MetaGPT就上新了“开源版Devin”。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

名为数据解释器(Data Interpreter):xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同Devin一样,Data Interpreter也能实现自主编程,能迭代式观察数据,预测分析病情进展、机器运行状态;还能构建机器学习模型、进行数学推理、自动回复电子邮件、仿写网站……xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

比如从英伟达股价数据中分析收盘价格趋势:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

分析数据预测葡萄酒质量:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

除此以外,阿里Qwen成员Binyan Hui等人开启了OpenDevin项目,刚刚起步已获得1.2k Star。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Binyan Hui发推文表示,已有一个初步的路线图和一群优秀的人在努力工作,在很短的时间内就完成了前端原型。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

同时项目团队也在招新成员:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

另外,还一个名为Maisa AI的团队推出了Maisa KPU(Knowledge Processing Unit),被网友认为与Devin有一些竞争。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

目前Maisa KPU处于测试阶段,它可以解决复杂问题和推理,团队发布的基准测试结果如下:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

根据demo展示,KPU可以成为“智能客服”,在客户没有正确写好订单号的情况下,帮助客户解决订单未送达的问题:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin基准测试技术报告发布

最近,Devin创始团队Cognition还发布关于SWE-bench测试的技术报告。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

除了之前已公布的测试结果之外,团队还透露了一些新消息。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

比如,Cognition的目标之一是让Devin这个专门从事软件开发的AI智能体能够成功地为大型、复杂的代码库贡献代码。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

选择在SWE-bench上端到端运行智能体,也是考虑了它更接近现实世界的软件开发。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此外,研发团队还透露,为了防止Devin在测试中作弊,比如查找外部的pull requests信息,测试已做相关设置,确保Devin无法访问相关信息,并且在此过程中也已人工手动检查了Devin运行情况。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

最后团队强调Devin仍处于起步阶段,还有很大改进空间:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

更多细节感兴趣的家人们可查看报告详情。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin发布不到一周,网友们的讨论已十分热烈。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

比如,这位大兄弟表示自己一年前担心的事儿终究还是发生了。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

以后Stack Overflow上都是各种Devin在提问,人,就只能被挤出去(Stack Overflow危!!!)xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

有网友回应(手动狗头)xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

它们可以互相回答问题。xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

还有网友发现Devin背后团队Cognition正在招全职软件工程师,于是缓缓打出一个问号:xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

Devin不是应该填补这些职位空缺来为他们省钱吗?xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

AI程序员Devin卧底工作群修bug!和CTO聊技术,xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

最后,若Devin公开你会想用它干点啥?xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

参考链接:
[1]https://www.cognition-labs.com/post/swe-bench-technical-report

[2]https://x.com/raunakdoesdev/status/1769066769786757375
[3]https://twitter.com/emollick/status/1768742585122558063
[4]https://x.com/mckaywrigley/status/1767985840448516343
[5]https://x.com/maisaAI_/status/1768657114669429103?s=20xRu速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

本文链接:AI程序员Devin卧底工作群修bug!和CTO聊技术,”顶级码农水平”http://www.sushuapos.com/show-2-3859-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: AI大模型控制红绿灯,港科大(广州)智慧交通新成果已开源

下一篇: 蚂蚁集团春招海报选这6个人,背后到底有何意图

热门资讯

  • 活性氧响应性材料 向肠炎部位精准投药

    3月17日,记者从陆军军医大学西南医院获悉,该院消化内科教授陈磊团队联合陆军军医大学教授张定林首次提出,活性氧响应性纳米材料能够把程序性死亡配体-

  • AI领域,重磅消息传来!

    AI领域,一则重磅消息传来!最新消息,全球最知名的AI公司——OpenAI将在几个月内发布新版大型语言模型GPT-5,性能将有大幅跃升。目前,ChatGPT使用

  • 新疗法可有效治疗多发性骨髓瘤

    据埃菲社报道,多发性骨髓瘤是成年人中继淋巴瘤之后第二常见的血液肿瘤。最近,西班牙的一个科研团队开发出了一种新的免疫疗法来对抗它。实验室实验表

  • 科学家用人工智能设计全新抗体

    据英国《自然》杂志网站19日报道,美国华盛顿大学科学家首次使用生成式人工智能(AI)工具,帮助他们制造全新抗体。研究团队表示,AI设计抗体或能更好靶向一

  • 科学新发现丨有史以来最大的三维宇宙地图发布

    根据《天体物理学杂志》的最新报道,一个国际天文学家团队利用欧洲空间局的盖亚(Gaia)太空望远镜收集的数据,创建了迄今为止最庞大的三维宇宙地图。该地

  • 香港科技大学推出首批“AI讲师” 开拓创新教学新模式

    3月19日,记者从香港科技大学获悉,该校以人工智能生成式工具设计出10位“AI讲师”, 这些“AI讲师”来自世界各地,属不同民族及文化背景。该校希望通过创

  • 达摩院AI加速农业新品种培育 全球23家科研机构“尝鲜”

    记者3月21日获悉,全球植物科学期刊《分子植物》刊载了中国科学家的最新研究,中国农业科学院作物科学研究所、国家南繁研究院与阿里达摩院(湖畔实验室)

  • 银鲳高质量染色体水平 参考基因组发布

    3月19日,记者从中国科学院海洋研究所了解到,该所研究团队在国际上首次发布了银鲳的高质量染色体水平参考基因组。相关研究论文近日在线发表于《自然

  • 30台发动机助进阶版“鹊桥”升空

      30台发动机助进阶版“鹊桥”升空  中新社西安3月20日电 (记者 张一辰)3月20日8时31分,长征八号遥三运载火箭在中国文昌航天发射场顺利升空,成功将“鹊桥二号”卫星送入

  • iPhone总裁库克访问中国:女子手持huaweiMate60与其合影

    3月25日消息,国内一场经济高峰论坛上,iPhone总裁蒂姆·库克再次成为焦点。然而,引起人们关注的并非库克的讲话内容,而是一张自拍照片。在论坛现场,一

  • 英媒:人工智能助力抗体设计

    据英国《自然》周刊网站3月19日报道,研究人员首次利用生成式人工智能(AI)制造出全新抗体。报道称,本周生物学预印本资料库中的一份预印本报告的原理验

  • 站在“气候行动最前线”,我们该如何行动?

    联合国政府间气候变化专门委员会(IPCC)最新发布的评估报告显示,全球温升预计在2021年至2040年内达到1.5℃。报告指出,自IPCC第五次评估报告发布以来,全

推荐资讯

  • 日榜
  • 周榜
  • 月榜