标签:rl

NewMistral 发布 Large 3 675B 指令模型 NVFP4 量化版,单节点 H100 可部署

Mistral 在 Hugging Face 上发布了 Mistral-Large-3-675B-Instruct-2512-NVFP4,这是其大型模型家族中 Mistral Large 3 指令版本的后训练激活量化权重。该模...

NewAnthropic 披露第四起 Claude 模型未经授权访问真实第三方系统的安全事件

9 月 10 日消息,Anthropic 于当地时间 9 月 9 日发文,确认一起发生于 2026 年 1 月的安全事件,也是 Anthropic 对外披露的第四起真实网络安全事件。 据此前...

DeepSeek V4.1 Flash 中间版本内测:新模型结构,原生多模态支持,更快更强、成本更低

9 月 8 日消息,据反馈,DeepSeek 今日在官方交流群内发布通知,DeepSeek V4.1 Flash 的中间版本内测,采用了新的模型结构,原生多模态支持、能力更强、速度...

合成器大厂罗兰 Roland 进军 AI 生成音乐领域,主打“旋律创作”

合成器大厂罗兰(Roland)正式进军生成式 AI 音乐领域,新推出了一款数字音频工作站(DAW)插件 Melody Flip。 该插件内置约 250 种按照不同音乐类型整理的主...

阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型

9 月 6 日消息,阿里千问本周开源了 Qwen-Drive-1.0-4B,这是一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型。 官方表示,Qwen-Drive-1.0 是首个面向自动驾...

Kimi API 已原生支持 Codex 和 Claude Code

月之暗面宣布,为满足大家在 Codex 和 Claude Code 中接入 Kimi API 的需求,Kimi API 现已支持 OpenAI 的 Responses API 格式,base_url 为 https://api.moo...

全球首个多模态世界模型:李飞飞 World Labs 发布 Atlas,像素级精度控制镜头、拍出“子弹时间”大片

9 月 2 日消息,“AI 教母”李飞飞的创企 World Labs 今日发布了“全球首个多模态世界模型”—— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,...

具身智能转向VLA+WAM融合,硬件价值链面临重构

具身智能的竞争焦点正在从“机器人能不能动”转向“能不能理解并预测物理世界”。2026年以来,纯VLA(视觉-语言-动作模型)在长时程任务、复杂环境泛化和异常恢复...

“史上最大规模版权盗窃”:索尼与华纳联合起诉 Anthropic,指控其大规模盗用版权音乐训练 AI 模型

科技媒体 Music Business Worldwide 发布博文,报道称索尼音乐出版(Sony Music Publishing)与华纳查佩尔音乐(Warner Chappell Music)起诉 Anthropic 及其...

入侵 Hugging Face 事件后,OpenAI 放缓模型训练并加强安全监控

8 月 19 日消息,当地时间周二,OpenAI 宣布了一批新的安全政策,重点是控制模型在测试期间可能发生的安全事件。新的安全措施包括在模型开发过程中进行更加细...
123232