标签:强化学习

New揭秘 OpenAI 的“终极野心”:让智能体像人类一样熟练操作电脑

8 月 20 日消息,据《商业内幕》今天(20 日)报道,OpenAI 员工乐观估计,公司正接近实现从创立之初就设定的目标:让 AI 智能体像人类一样熟练地操作电脑,...

New蚂蚁百灵开源 Ling-3.0 tiny / flash Base 模型,开放训练过程中的关键节点

8 月 21 日消息,蚂蚁百灵在本月陆续开源了 Ling-3.0-tiny 和 Ling-3.0-flash 模型。官方昨日宣布,将 Ling-3.0-tiny-base 与 Ling-3.0-flash-base 正式开源...

腾讯开源 UI-Mate-democua-27B:演示引导的 GUI 智能体

腾讯混元团队在 Hugging Face 上发布了开源模型 UI-Mate-democua-27B,这是一个演示引导的 GUI 智能体检查点。该模型基于 Qwen3.6-27B 底座,参数量为 27B,...

揭秘 OpenAI 的“终极野心”:让智能体像人类一样熟练操作电脑

8 月 20 日消息,据《商业内幕》今天(20 日)报道,OpenAI 员工乐观估计,公司正接近实现从创立之初就设定的目标:让 AI 智能体像人类一样熟练地操作电脑,...

学会看、写、生成之后,AI还能做什么?

从读懂图片的“视觉”,到写出文字的“表达”,再到创造视频画面的“想象”,当下,AI正持续“进化”。 学会看、写、生成之后,AI还能做什么?近年来,科技界正在探索...

OpenAI主动放慢AI开发节奏,安全与竞争如何平衡

OpenAI在周二宣布,将放缓部分AI开发进度,以加强安全防护措施。这一决定包括暂停其“用于部署的最新模型”的强化学习训练两周,并推迟“最大计划前沿强化学习运...

入侵 Hugging Face 事件后,OpenAI 放缓模型训练并加强安全监控

8 月 19 日消息,当地时间周二,OpenAI 宣布了一批新的安全政策,重点是控制模型在测试期间可能发生的安全事件。新的安全措施包括在模型开发过程中进行更加细...

OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题

8 月 19 日消息,OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分...

AI 模型混战:Grok 4.6 智力跃升、Gemini 3.7 Flash 速度称王、DeepSeek 涨价引争议

AI 模型市场再度迎来密集发布潮。xAI 推出 Grok 4.6,Google 带来 Gemini 3.7 Flash,DeepSeek 则发布 V4 Pro 0813。三家公司的模型几乎同时登场,围绕智慧、...

杰富瑞实测八款AI Agent:千问办公夺冠,Harness比模型更关键

华尔街投行杰富瑞(Jefferies)近期对八款主流中美AI Agent进行了一次系统性实测,结果颠覆了“模型越强,Agent越强”的直觉。在总分排名中,阿里巴巴的千问办...
123103