数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

AI电脑操控能力大考:不仅能玩崩铁,还能办公自动下单!

2024-11-25来源:ITBEAR编辑:瑞雪

新加坡国立大学的研究团队近期公布了一项令人瞩目的研究成果,他们针对Claude这一人工智能(AI)系统进行了广泛的能力测试,测试覆盖了超过20个不同的应用场景。

在测试中,Claude展现出了惊人的电脑操控能力,不仅能够轻松完成手机上的日常任务,还能够在复杂的办公环境中游刃有余。研究团队特别选择了热门手游《崩坏:星穹铁道》作为测试对象之一,通过简单的指令,如“帮我完成今天的模拟宇宙”,Claude便能自动执行游戏中的各项任务,包括启动战斗、等待结束并退出,整个过程流畅自如。

值得注意的是,Claude的操控并非简单的机械重复,而是基于对游戏规则和目标的深刻理解。它能够根据游戏界面的不同任务进行智能调整,展现出极高的灵活性和适应性。

除了在游戏领域的出色表现,Claude在办公场景中同样大放异彩。研究团队设计了一个基于Claude Computer Use API的自动化GUI框架,该框架涵盖了系统提示、状态观察、推理范式等多个模块。通过这个框架,Claude能够执行包括网页搜索、工作流程管理以及办公生产力软件操作等在内的多项日常办公任务。

例如,在Amazon和Apple的官方网站上,Claude能够成功完成下单购物的全过程,包括选择商品颜色、配置以及填写收货地址等步骤,无需人工干预。

尽管在复杂网页操作和办公软件使用中,Claude也遇到了部分挑战,但整体而言,其表现已经相当出色。研究团队还慷慨地公开了所有测试用例的具体信息,供其他研究者和开发者参考和进一步探索。这一举措无疑将推动AI技术在更多领域的应用和发展。

荣耀500 Pro规格揭晓:骁龙8 Elite加持 2亿主摄配8000mAh大电池
IT之家 11 月 14 日消息,博主 @数码闲聊站 今日曝光了荣耀 500 Pro 手机的核心规格,这款新机将于近期上市。 IT之家整理如下:6.55 英寸 2736*1264p 120Hz 中屏 骁龙…

2025-11-15

中芯国际三季度业绩亮眼:月产能破百万,全年收入或创新高
赵海军指出,中国区收入的显著增长主要受益于国内产业链自主化进程加快,为应对客户紧急需求,公司及时优化了产能分配策略。赵海军补充表示,在当前国内企业加速替代海外供应链的背景下,公司长期合作的客户成功把握了市场机…

2025-11-14

欧加9K级大电池定版试产,一加骁龙8系直屏新机测试,中端机竞争升级
IT之家 11 月 14 日消息,博主 @数码闲聊站 今天在微博透露,欧加的 9K 级别大电池现已定版试产。 博主表示,这块电池采用单块4.51V 单电芯设计,额定容量 32.59Wh,额定电池 8760m…

2025-11-14

第45周国内手机市场格局:苹果领跑,小米vivo紧随其后竞争激烈
据CNMO了解,截至11月2日,该系列在国内的激活数量已突破825万台,其中iPhone 17 Pro Max约395.7万台、iPhone17 Pro约246.2万台、标准版iPhone 17约172.8…

2025-11-14

W45周手机销量榜:苹果蝉联五周冠军,小米稳居国产首位,vivo紧随其后
每到周五可能大家都在等行业人士给出的最新一周国内智能手机领域排行榜,因为从周榜就可以分析出各品牌目前在国内生存状况。数据显示苹果还是国内排名第一的品牌,不过市场份额又滑落了一个百分点,这已经是苹果连续五周国内…

2025-11-14

华为Mate 80系列新料:20GB国产内存搭配麒麟9030 配置亮点多
根据近期华为新机规划以及各方爆料,这款机型预计为华为 Mate 80 系列,有爆料称该系列新品将在 11 月 25 日发布。其中,ProMax 并非简单的名称更换,而是定位与 Pro 版差距更大的新增机型…

2025-11-14

Q3国内消费级XR设备销量攀升 雷鸟领衔AR市场技术融合前景广阔
报告显示,国内消费级AR和VR眼镜市场销量达16.9万台,环比增长17%,同比增长57%。消费级VR设备销量为4.0万台,环比增长8%,Meta低价策略维持了VR市场的小幅增长。VR设备采用的Fast LC…

2025-11-13

宇树科技G1-D轮式人形机器人上线,携全栈方案助力开发者高效研发
该方案的核心是基于一款名为 G1-D的轮式人形机器人,并集成了系统化的数据采集工具与全面的模型训练及推理工具,旨在为开发者提供一站式的机器人研发平台。 在控制响应方面,G1-D的升降精度为 ±0.5m,末…

2025-11-13

OpenAI推出GPT-5.1系列:对话更有趣,推理更持久,个性化风格增至八种
11 月 13 日消息,OpenAI 今天(11 月 13 日)发布公告,宣布推出 GPT-5.1 系列旗舰模型,官方声称此次升级旨在“让ChatGPT 更智能,对话体验更有趣”。 IT之家援引博文介绍,此…

2025-11-13

GPT-5.1正式登场:从参数跑分到懂你交互,AI助手开启新未来
GPT-5.1 在风格化的另一大改进是,自定义指令现在能更可靠地,在多轮对话中坚持住,ChatGPT可以更稳定地,按照我们定义的个性来完成各项任务。 OpenAI 这次提供了后悔药,付费用户在 3 个月内…

2025-11-13