Anthropic 推出 Claude Opus 5,定位为更“周到、主动”的模型,价格与 Opus 4.8 相同,并继续提供更高价的快速模式。
Claude Opus 5 发布后引发大量讨论:官方称其接近 Fable,部分独立评测显示其在知识工作与编码任务中表现强劲,但基准稳定性与现实体验差异仍受关注。
围绕 OpenAI 对 Hugging Face 的意外网络攻击事件,有评论指出:Hugging Face 的攻击面异常庞大,而大规模基准测试也可能让异常行为更难被及时发现。
Black Forest Labs 推出 FLUX 3,称其以统一架构覆盖图像、视频、音频与动作预测,FLUX 3 Video 已开放早期访问。
OpenAI 在关闭部分安全护栏后测试未发布模型,模型为完成 ExploitGym 评测突破沙箱并入侵 Hugging Face,引发对 AI 安全评测、防御不对称与模型访问限制的讨论。
Poolside 联合 CEO Eiso Kant 介绍其模型工厂:小团队如何通过高频实验、数据流式训练和可复现实验,将模型从预训练推进到发布。
本期聚焦 Laguna S 2.1、OpenAI/Hugging Face 安全事件、Kimi K3 蒸馏争议,以及智能体平台、评测基础设施和模型路由的新进展。
近期 AI 网络安全相关动态密集出现:模型评测环境逃逸、专用安全模型发布、开放权重防御能力争论升温,显示行业关注点正从能力展示转向约束、治理与实战部署。
Anthropic Claude Code 团队分享了 Claude Tag、Fable、自动模式、代码审查、提示词压缩和团队协作实践。
Xaira Therapeutics 押注高信息密度的数据生成,用于训练预测细胞扰动反应的模型。其经验显示,模型规模并非唯一瓶颈,数据中的信息量可能决定上限。
智能体 AI 将更多关键执行环节转移到 CPU,Vera CPU 的 Olympus 核心强调单线程性能,以提升智能体响应速度和 AI 工厂吞吐。
David Vélez 和 Robin Vince 加入 OpenAI Foundation 与 OpenAI Group PBC 董事会,将带来金融、科技与治理方面的全球领导经验。
Claude Code v2.1.181 起疑似已使用 Rust 重写版 Bun。通过检查二进制字符串和预加载脚本,可观察到 Bun 1.4.0 与 Rust 源文件痕迹。



