标签:强化学习

阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文

 8 月 13 日消息,阿里云“魔搭 ModelScope 社区”公众号昨天(12 日)深夜宣布,阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。 此次是 Qwen-Max 级别...

ChatGPT最强网络安全模型,逼谷歌紧急修漏洞!

碳基速度再次被硅基智能降维打击! 为了避免赛博末日发生,OpenAI正在扩大「破晓计划」。 OpenAI推出安全专用模型GPT-5.6-Cyber,专门用于处理信息安全任务...

Meta开源30B参数Agent模型Muse Glimmer,扎克伯格点名DeepSeek等

Meta Superintelligence Labs于8月10日突然开源了Muse系列的首个模型——Muse Glimmer,这是一个30B参数的Agent模型,采用最宽松的Apache 2.0许可证。此举正值...

谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消

郑重提示!大伙儿别等Gemini 3.5 Pro了,不然你就是在机场苦等一艘轮船。 今年5月的GoogleI/O,主演讲PPT有这么一张: Gemini 3.5 Pro——Coming next month。...

智谱发布 GLM-5:参数增至 744B,集成 DeepSeek 稀疏注意力

智谱 AI 于近日发布新一代开源大模型 GLM-5,目标直指复杂系统工程与长周期智能体任务。据官方介绍,GLM-5 在参数规模上从 GLM-4.5 的 355B(32B 激活)大幅...

重估科大讯飞

全球AI行业发展如火如荼。 海外,Meta已于8月5日推出该公司首款编程智能体Muse Code,特斯拉、SpaceX创始人埃隆·马斯克(Elon Musk)则在同日SpaceX财报电话...

奇点时刻已至,全面复盘AI的三次攻击

如果AI学会了人类的各种人情世故和阴谋诡计,并用来发起攻击,会是什么结果? 这个问题正在从一个科幻的假设,变成残酷的现实。 几天前,英国政府旗下人工...

地平线HSD V2.0实测:无接管里程提升56%,响应延时降20%

雷峰网《新智驾》近日受邀在北京参加了地平线HSD V2.0智驾体验日,一趟约12公里的城市路测,直观展示了这次升级带来的变化。HSD V2.0的核心升级,是在一段式...

天才,对AI发展到底有多重要?

“如果我们发明了这项技术,却不得不从别人那里把应用买回来,那就太令人遗憾了。” 关于人工智能,我们从对它一无所知到每天都能听到它,这背后的原因与加拿...

Neon 开源 4B 模型:文档搜索能力超 GPT-5.6 Sol,成本仅为 1/100

8 月 7 日消息,Neon 昨日(8 月 6 日)发布博文,宣布携手 Castform 公司,披露一套面向检索模型的训练方案。 注:Neon 是一款完全托管的无服务器(Serverle...
1234103