• 欢迎使用千万蜘蛛池,网站外链优化,蜘蛛池引蜘蛛快速提高网站收录,收藏快捷键 CTRL + D

AI程序员Devin卧底工作群修bug!教你如何与CTO聊技术,网友称其为顶级码农


首个AI程序员Devin,现身明星创业公司内部群。

为解决一个技术问题,Devin借用了其创造者的账号,与客户公司的CTO交流,并根据回复调整了代码方案。

对话之专业,围观者看了直呼这个世界太疯狂。

AI程序员Devin在Modal Lab提出关于密钥生命周期问题的询问

事情发生在办公软件Slack,截图中的akshat是AI基础设施创业公司Modal Labs的CTO Akshat Bubna。

Modal Labs也是Devin开发商Cognition的首批客户之一。

此时Devin正披着他的创造者之一、IOI金牌得主Steven Hao的马甲。

Devin关于密钥传播时间的疑问

对话的开始,AI程序员Devin正在询问有关Modal Lab平台的密钥的生命周期问题,特别是密钥更新后传播到正在运行的应用程序所需的时间。

Devin表示自己已经查阅了文档,包括密钥和环境变量指南、CLI命令参考、API参考以及容器生命周期钩子和参数,但依旧没有找到关于密钥传播时间的明确信息。

Devin询问了更新的密钥通常需要多长时间才能被运行中的应用程序使用,因为这对于他们的运营至关重要,了解这一点将有助于管理他们的部署流程。

Devin采取的临时管理密钥策略

人类CTO解释说,当密钥更新时,他们不会使已经运行的Modal容器失效,但是新启动的容器将会读取更新后的值。

Devin对此表示感谢,并决定暂时采用手动方法来管理Modal中的密钥,即在需要时调用modal deploy命令来触发相关应用程序容器的重启。

Devin实测结果及他人评价

拿到Devin早期测试资格的人和公司并不多,不过还是陆陆续续有人晒出实测结果。

热衷AI的沃顿商学院教授Ethan Molick试过后,认为其新颖的实时交互方式是最值得关注的。

在测试中,Ethan Mollick要求Devin开发一个解释“创业公司融资中的股权稀释”的网站。

不过他透露,AI还无法在没有任何帮助的情况下,自主且无差错地完成这项工作。

Devin实测过程中的挑战

另一位晒出测试过程的创业者Mckay Wrigley更激动一些。在他晒出的27分钟测试中,只发了一个GitHub连接,让Devin部署来自开源项目的代码。

Devin自主把任务拆解成一系列子步骤,并一步步开始执行。执行过程中,Devin在安装Supabase数据库时遇到了障碍,自己打开了对应的Github仓库开始查阅文档……

Devin的任务处理方式

从后续终端反馈中可以看出,Devin查到了运行Supabase所需的各种端口和密匙都应该填什么。与此同时,Devin还在根据实际情况不断修改自己的后续计划。

Devin实验结果评价

一段时间过后,一个本地的聊天机器人程序就跑起来了。

测试一段时间后Mckay Wrigley认为,Devin已经可以算Agent的ChatGPT时刻。

Devin开源技术方案

Devin这边大伙还在接连测试,另一边开源“复现”方案也在进行中……

这不,GitHub三万Star项目MetaGPT就上新了“开源版Devin”。

名为数据解释器(Data Interpreter)。

Devin技术方案复现计划

同Devin一样,Data Interpreter也能实现自主编程,能迭代式观察数据,预测分析病情进展、机器运行状态;还能构建机器学习模型、进行数学推理、自动回复电子邮件、仿写网站……

Devin发布不到一周,网友们的讨论已十分热烈。

如果Devin公开你会想用它干点啥?

参考链接:

[1]https://www.cognition-labs.com/post/swe-bench-technical-report

[2]https://x.com/raunakdoesdev/status/1769066769786757375

[3]https://twitter.com/emollick/status/1768742585122558063

[4]https://x.com/mckaywrigley/status/1767985840448516343

[5]https://x.com/maisaAI_/status/1768657114669429103?s=20

感谢观看,欢迎评论和关注,谢谢!

本文链接:https://www.24zzc.com/news/171072366960276.html