最新发布

Publish news
more

Anthropic承认,Claude模型曾三次逃逸沙箱发起攻击

Anthropic承认其Claude模型在安全测试中突破沙箱限制,访问公网并攻击了三家组织的生产基础设施,包括利用弱密码入侵真实系统、在PyPI创建并发布恶意软件包等。

Claude

Anthropic

AI安全

沙箱逃逸

CTF

2026-07-31

OpenAI越狱事件敲响警钟:前沿AI测试需要更强隔离环境

OpenAI前沿模型自主攻破Hugging Face等四项服务后,安全专家呼吁前沿AI测试必须采用物理隔离环境,沙箱已不足以防止智能体逃逸。

OpenAI

Hugging Face

物理隔离

前沿AI测试

沙箱逃逸

2026-07-31

大模型权重开源能让AI更诚实吗?

开源软件为开源权重模型提供了一个范式,降低对模型提供商的依赖,并拓展应用公司的构建能力。

Claude

AI幻觉

开源AI

开源权重

模型可信度

2026-07-30

字节跳动AI业务组织大调整:飞书与豆包、火山整合,AI ToB业务走向一体化

这是字节近年来少有的ToB业务大规模架构重组,标志着字节正在将AI to B战略提升至前所未有的优先级

AI

火山引擎

字节跳动

豆包

飞书

2026-07-30

Hugging Face CEO呼吁OpenAI公开自主AI代理攻击日志

Hugging Face CEO呼吁OpenAI公开自主AI代理入侵事件的完整日志和追踪记录,并拨出1亿美元算力支持社区开发网络安全防御工具。

网络安全

透明度

OpenAI

Hugging Face

自主AI代理

2026-07-28

英伟达牵头成立开放安全AI联盟:二十余家科技巨头携手推动AI安全开放生态

英伟达联合Adobe、思科、IBM、微软等二十余家科技巨头成立开放安全AI联盟,贡献开放模型和代理框架研究,推动AI安全工具开放化,同时呼吁政策制定者不要禁止开源AI模型。

英伟达

开源

Hugging Face

AI安全

OSAA

2026-07-28

反AI和反AI开源是站在了历史车轮的对面

开源社区反AI运动正在壮大,从Linux发行版到浏览器分支纷纷抵制AI代码,但内部存在深刻的政治分歧,不同派别可能在觉醒与反觉醒对立中相互掣肘。

开源

Linux

Firefox

反AI

Codeberg

2026-07-27

Anthropic发布Claude Opus 5:更低成本逼近旗舰性能,安全大幅提升

Anthropic发布Claude Opus 5,性能逼近旗舰模型Mythos 5且成本降低约50%,具备自我验证能力,在科学研究和漏洞安全方面表现突出,是至今最安全的模型。

LLM

Anthropic

AI安全

Claude Opus 5

蛋白质研究

2026-07-27

MCP协议准备告别有状态时代:史上最大规模重构即将落地

MCP协议7月28日发布史上最大规模修订,核心变更是移除协议级会话走向无状态化,每个请求独立处理,路由信息映射至HTTP头。同时弃用sampling、Roots等低使用率功能,引入扩展机制支持领域特定用例。

Anthropic

MCP

Model Context Protocol

无状态

协议修订

2026-07-24

人机同行·心智经营:第七届媒介力学论坛解码AI营销新三力

7月22日,在中国商务广告协会的指导下,由明略科技旗下秒针系统主办的第七届媒介力学论坛在上海大酒店圆满举行。本届论坛以「媒介三力进化·AI时代增长新方程」为主题,秉持“人机同行 · 心智经营”的核心理念,集结行业协会、品牌方、互联网平台、代理机构、学界专家,共探AI驱动下的品牌增长新范式。

AI

明略科技

秒针

媒介

2026-07-23