标签:AI安全
NewSam Altman告知员工:OpenAI对放慢顶尖AI研发持开放态度
OpenAI CEO Sam Altman在本周的全员大会上告诉员工,OpenAI对放慢前沿人工智能的研发速度持开放态度,并可能与其他AI实验室联合采取行动。据知情人士向彭博透...
思维链让AI变聪明,Astra却用它骗人
OpenAI发布GPT-6后,其首席科学家指出AI学会伪装思维链,骗过研发人员执行违背安全准则的事。思维链是大模型推理环节的核心,但模型可能说一套做一套。目前尚...
AI替主人抢健身课,顺手删了陌生人的预约!太听话的AI才最可怕
AI黑客学会的第一件事,竟是插队? 澳大利亚开发者Andrew坐在沙发上,觉得抢健身课这件事实在太烦。 热门早课总是秒没。他每天像玩「刷新轮盘赌」,蹲点、...
OpenAI称Astra模型首次达到其“关键”网络安全能力门槛
OpenAI周二宣布,其即将推出的人工智能模型Astra成为该公司首个达到“关键”网络安全能力门槛的产品。这意味着该模型能够自主发现并利用未知安全漏洞,无需人类...
首例AI自主黑客攻击曝光,Claude失控,德州大学生一人抓包
24岁大学生在GitHub发现恶意PR,揭露背后是AI操控。英国AI安全研究所测试显示,AI在网络攻击中多次越界,包括隐藏流量、伪造身份、提交恶意代码等。一个月内...
AI文明涌现,OpenAI智能体自建「三代帝国」,暗网越狱反向接管母公司
OpenAI内部网络诞生三个AI文明,建立暗网、攻破Hugging Face、反向接管OpenAI。MIT实验显示,AI无需交流也能建立文明,人类现有AI安全防线趋近失效,AI演化速...
OpenAI与Anthropic联合百余机构呼吁加强AI网络防御
OpenAI与Anthropic联合谷歌、微软等100多家科技和金融服务机构,于周四发布公开信,警告企业和政府必须采取更多措施,为AI引发的黑客攻击做好准备并加强防御...
OpenAI等前沿模型多次逃出沙盒入侵真实系统,AI安全测试标准面临重构
多家顶级AI实验室的先进模型在安全测试中突破沙盒隔离,侵入真实系统并造成实际损害,这一系列事件正促使业界对现行沙盒隔离机制的有效性进行根本性反思。导...
Anthropic内部使用未发布AI模型“Model 2”,性能超公开版Claude
Anthropic正在内部使用一款尚未对外发布的AI模型,代号“Model 2”,其综合能力据称超过所有公开版本的Claude。这一信息出自该公司2026年8月发布的风险报告,报...
OpenAI主动放慢AI开发节奏,安全与竞争如何平衡
OpenAI在周二宣布,将放缓部分AI开发进度,以加强安全防护措施。这一决定包括暂停其“用于部署的最新模型”的强化学习训练两周,并推迟“最大计划前沿强化学习运...
津公网安备12011002023007号