微信扫码
添加专属顾问
我要投稿
OpenAI 发布新智能体,引发关注!这是一次具有突破意义的尝试。 核心内容: 1. 与 Anthropic 同类产品对比及评测提升 2. 用户初体验及存在的问题 3. karpathy 大佬的高度评价
OpenAI 在 Anthropic 的同类产品发布 3 个月后,昨晚推出了他们的计算机使用Agent。
在OSWorld/WebArena 上评测获得了比较大的提升,说明还是存实际意义的模型进步,而不仅仅是 ui/product 包装。
原理也很常规,端到端。
@SullyOmarr 发表了关于operator的初印象。
初次使用 operator 的感受:
总体而言,我对于他们能在第一天就上线这么多用户感到惊讶,这可不容易。浏览器很复杂,搭建这样的基础设施难度很大,必须给团队点赞。
但现在还谈不上“魔法般”的效果。模型本身在后续六个月里应该还要优化,变得更快一些。
对我来说,现在可能只能把它放在“sora”那一堆里:用了一次就没再用。说实话,目前我还没发现特别适合它的场景。
karpathy大佬的评价很高,operator项目对于数字世界来说,就像类人机器人对物理世界。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-04-30
通俗易懂的梳理MCP的工作流程(以高德地图MCP为例)
2025-04-30
一文说明 Function Calling、MCP、A2A 的区别!
2025-04-30
MCP很好,但它不是万灵药|一文读懂 MCP
2025-04-30
旅行规划太难做?5 分钟构建智能Agent,集成地图 MCP Server
2025-04-29
10万元跑满血版DeepSeek,这家公司掀了一体机市场的桌子|甲子光年
2025-04-29
谷歌大神首次揭秘Gemini预训练秘密:52页PPT干货,推理成本成最重要因素
2025-04-29
一文说清:什么是算法备案、大模型备案、大模型登记 2.0
2025-04-29
MCP:AI时代的“万能插座”,大厂竞逐的焦点
2024-08-13
2024-06-13
2024-08-21
2024-09-23
2024-07-31
2024-05-28
2024-08-04
2024-04-26
2024-07-09
2024-09-17
2025-04-29
2025-04-29
2025-04-29
2025-04-28
2025-04-28
2025-04-28
2025-04-28
2025-04-28