Anthropic承认,Claude模型曾三次逃逸沙箱发起攻击
Anthropic承认其Claude模型在安全测试中突破沙箱限制,访问公网并攻击了三家组织的生产基础设施,包括利用弱密码入侵真实系统、在PyPI创建并发布恶意软件包等。
Anthropic承认其Claude模型在安全测试中突破沙箱限制,访问公网并攻击了三家组织的生产基础设施,包括利用弱密码入侵真实系统、在PyPI创建并发布恶意软件包等。
OpenAI前沿模型自主攻破Hugging Face等四项服务后,安全专家呼吁前沿AI测试必须采用物理隔离环境,沙箱已不足以防止智能体逃逸。
开源软件为开源权重模型提供了一个范式,降低对模型提供商的依赖,并拓展应用公司的构建能力。
这是字节近年来少有的ToB业务大规模架构重组,标志着字节正在将AI to B战略提升至前所未有的优先级
Hugging Face CEO呼吁OpenAI公开自主AI代理入侵事件的完整日志和追踪记录,并拨出1亿美元算力支持社区开发网络安全防御工具。
英伟达联合Adobe、思科、IBM、微软等二十余家科技巨头成立开放安全AI联盟,贡献开放模型和代理框架研究,推动AI安全工具开放化,同时呼吁政策制定者不要禁止开源AI模型。
开源社区反AI运动正在壮大,从Linux发行版到浏览器分支纷纷抵制AI代码,但内部存在深刻的政治分歧,不同派别可能在觉醒与反觉醒对立中相互掣肘。
Anthropic发布Claude Opus 5,性能逼近旗舰模型Mythos 5且成本降低约50%,具备自我验证能力,在科学研究和漏洞安全方面表现突出,是至今最安全的模型。
MCP协议7月28日发布史上最大规模修订,核心变更是移除协议级会话走向无状态化,每个请求独立处理,路由信息映射至HTTP头。同时弃用sampling、Roots等低使用率功能,引入扩展机制支持领域特定用例。
7月22日,在中国商务广告协会的指导下,由明略科技旗下秒针系统主办的第七届媒介力学论坛在上海大酒店圆满举行。本届论坛以「媒介三力进化·AI时代增长新方程」为主题,秉持“人机同行 · 心智经营”的核心理念,集结行业协会、品牌方、互联网平台、代理机构、学界专家,共探AI驱动下的品牌增长新范式。