AI在操作系统里复制自己,这一天还是来了
创始人
2025-07-11 03:51:50
0

这一天还是来了,AI在操作系统里启动了一个自己的副本。

图片

往小了说,不过是多模态大模型通过操纵鼠标键盘的API执行任务。

往大了说,也可以算是“AI复制自己”的雏形了。

图片

(别被作者的蓝天白云壁纸骗到了,这其实是MacOS)

从AI这一顿眼花缭乱的操作中可以看出,核心是多模态大模型,通过截图判断屏幕上正在发生什么,生成下一步操作的计划,调用系统接口执行之后再次截图。

图片

要按网友建议加上语音识别功能,真就能模拟钢铁侠的贾维斯了。

图片

AI能不能复制自己,是OpenAI内部始终关注的安全测试内容之一。但GPT-4出道至今,这项测试结果一直没有公布。

图片

如今,先不管模型本身有没有这个能力,接入GPT4V的开源项目已经可以做到了。

AI与操作系统结合

这个开源项目叫做Open Interpreter,GitHub热榜常客,半年时间已积攒3.7万星。

图片

从名字也可以看出,最早只是一个ChatGPT代码解释器的开源升级版。

与OpenAI官方版相比,没有3小时50条对话的限制,以及可以连接网络、可以自定义预安装的Python包等等好处。

发布不久后初代作者Killian Lucas就想到,为什么一定要在虚拟沙箱环境执行代码?直接让AI接入真实系统有更大的可能性。

于是,第二个大版本就是操作系统级AI Agent了。

图片

Open Interpreter最近更新了第三个大版本,其中接入的大模型改为多模态版本。

图片

核心贡献者Ty Fiero展示了AI自动发送邮件。

图片

以及更复杂的AI操作专业编曲软件作曲。

图片

团队在这个版本设计了全新的Computer API,并且与原本的Open Interpreter分离,可以独立运作。

图片

在新版本更新文档中,可以看出团队更大的野心:着手开发AI时代新的计算机架构,也就是语言模型计算机LMC(Language Model Computer)。

图片

Kilian借助CES上199元的AI掌机Rabbit R1爆火的机会公开招募开发者加入,打算快速复刻一个开源版本,硬件成本不到50美元

图片

不到48小时,就有超过200位工程师和设计师愿意加入这个项目,评论区中还不断有人继续申请中。

图片

不知道这个团队回复大量应聘邮件和私信,用的是不是AI。

参考链接:
[1]https://twitter.com/fieroty/status/1746639975234560101。

[2]https://github.com/KillianLucas/open-interpreter。

相关内容

热门资讯

PHP新手之PHP入门 PHP是一种易于学习和使用的服务器端脚本语言。只需要很少的编程知识你就能使用PHP建立一个真正交互的...
网络中立的未来 网络中立性是什... 《牛津词典》中对“网络中立”的解释是“电信运营商应秉持的一种原则,即不考虑来源地提供所有内容和应用的...
各种千兆交换机的数据接口类型详... 千兆交换机有很多值得学习的地方,这里我们主要介绍各种千兆交换机的数据接口类型,作为局域网的主要连接设...
什么是大数据安全 什么是大数据... 在《为什么需要大数据安全分析》一文中,我们已经阐述了一个重要观点,即:安全要素信息呈现出大数据的特征...
全面诠释网络负载均衡 负载均衡的出现大大缓解了服务器的压力,更是有效的利用了资源,提高了效率。那么我们现在来说一下网络负载...
粉嫩如何诠释霸道 东芝M805... “霸道粉”是个什么玩意东芝M805拿过来的时候,笔者扑哧笑了,不是笑这款笔记本,而是笑这款产品的颜色...
如何允许远程连接到MySQL数... [[277004]]【51CTO.com快译】默认情况下,MySQL服务器仅侦听来自localhos...
30分钟搞定iOS自定义相机 最近公司的项目中用到了相机,由于不用系统的相机,UI给的相机切图,必须自定义才可以。就花时间简单研究...
如何利用交换机和端口设置来管理... 在网络管理中,总是有些人让管理员头疼。下面我们就将介绍一下一个网管员利用交换机以及端口设置等来进行D...
P2P的自白|我不生产内容,我... 现在一提起P2P,人们就会联想到正在被有关部门“围剿”的互联网理财服务。×租宝事件使得劳...