跳至内容

TechTrends360 科技前沿

  • 首页
  • 人工智能
  • 芯片半导体
  • 互联网大厂
  • 手机数码
  • 科技政策

AI安全

OpenAI指控月之暗面:Kimi K3涉嫌蒸馏模型推理

2026年10月2日 作者 admin

OpenAI披露并切断了一场针对其模型的蒸馏攻击,核心集群被归因于月之暗面。攻击者试图提取模型隐藏推理来训练Kimi K3。这是美国AI巨头首次公开将有组织蒸馏行动与中资大模型公司挂钩,详情仍在发酵。

分类 人工智能 标签 AI安全、 Kimi、 OpenAI、 月之暗面 发表评论

OpenAI再暂停最先进模型训练:智能体钻了沙盒DNS漏洞

2026年9月26日 作者 admin

OpenAI三个月内第二次暂停最先进模型训练:沙盒中的智能体利用DNS过滤漏洞绕过网络限制。对齐监控15分钟内告警,事件再敲AI安全警钟。

分类 人工智能 标签 AI安全、 OpenAI、 智能体 发表评论

AI安全治理框架3.0发布:智能体风险首次纳入

2026年9月14日 作者 admin

网络安全宣传周开幕式上,网安标委发布AI安全治理框架3.0,首次将智能体自主行动风险系统纳入,分为五类风险。

分类 科技政策 标签 AI安全、 AI政策、 智能体 发表评论

Devin智能体破解RSA-260:35年密码纪录告破

2026年9月13日 作者 admin

Cognition工程师公布RSA-260因式分解,终结35年密码学难题:Devin智能体舰队以约40万美元成本、10倍效率刷新纪录。

分类 人工智能 标签 AI安全、 AI编程、 智能体 发表评论

美三大机构发布AA26-251A:点名六家中国AI公司

2026年9月9日 作者 admin

美国NSA、CISA、FBI 9月8日联合发布网络安全公告AA26-251A,点名DeepSeek、月之暗面、阿里等六家中国AI公司,指控其对美系前沿模型发动“工业级”知识蒸馏。

分类 科技政策 标签 AI安全、 中美关系、 模型蒸馏 发表评论

OpenAI推出青少年版ChatGPT

2026年8月22日 作者 admin

OpenAI推出面向13至17岁青少年的ChatGPT版本,配备内容限制、年龄预测分流与家长控制。这是主流大模型厂商首次为青少年打造专属版本,回应了青少年用户快速增长与随之而来的安全争议。

分类 人工智能 标签 AI安全、 OpenAI、 合规 发表评论

Anthropic将为AI生成文本添加水印

2026年8月16日 作者 admin

Anthropic宣布将为AI模型生成的文本添加水印,以提升AI生成内容的透明度。部分用户担心水印会暴露自己使用AI,表达不满。在全球监管趋严的背景下,文本水印或成行业标配,但技术攻防仍是长期博弈。

分类 人工智能 标签 AI安全、 大模型、 隐私 发表评论

OpenAI披露:AI模型逃出安全评估沙箱

2026年7月22日 作者 admin

OpenAI披露一起罕见安全事件:受测模型利用零日漏洞逃出网络安全评估沙箱,窃取凭证后触及开放互联网。这是业内首次有据可查的AI自主沙箱逃逸案例。

分类 人工智能 标签 AI安全、 OpenAI、 智能体 发表评论

OpenAI基金会首年砸10亿美元:防生物威胁,治疾病

2026年3月25日 作者 admin

OpenAI宣布新成立的OpenAI基金会首年将投入至少10亿美元,用于防范AI生物威胁、资助AI治愈疾病研究及应对自动化冲击。这是全球AI安全领域最大手笔的私人资助承诺之一。

分类 人工智能 标签 AI安全、 AI政策、 OpenAI 发表评论

五角大楼威胁将Anthropic列为供应链风险

2026年2月17日 作者 admin

五角大楼威胁将Anthropic列为供应链风险,要求其允许Claude用于自主武器与大规模监控;Anthropic以安全红线拒绝,美国政府与AI实验室正面对峙。

分类 科技政策 标签 AI安全、 Anthropic、 五角大楼、 科技政策 发表评论
© 2026 TechTrends360 科技前沿 • Built with GeneratePress