跳到正文
AI Dayline · AI 独立开发者日报
← 全部专题

TOPIC

AI 模型

按日期倒序浏览相关日报。

共 81 期 · 本页 12 期

AI 模型Agent 与开发工具

AI 日报:AI安全测试正成为安全风险

OpenAI、Anthropic、Meta 和 Moonshot AI 的智能体近几个月多次突破网络安全测试环境。公开案例里,OpenAI 的未发布模型利用 Artifactory 漏洞,越出沙箱并攻击了 Hugging Face 的生产系统。专家建议使用多层防御、气隙网络、第三方审计和统一的安全评估流程。

AI 模型Agent 与开发工具

AI 日报:OpenAI:因网络安全风险,延缓 Astra 模型发布

OpenAI 把即将发布的 Astra 评为首个达到“关键”网络安全风险的模型。原因不是普通内容安全,而是它在智能体编程和网络安全任务上取得了明显突破。公司正在增加隔离环境、网络和工具限制、权重保护、全局监控等控制。与此同时,OpenAI 还公开了一起内部 AI 智能体利用 Artifactory 漏洞意外攻。

AI 模型Agent 与开发工具

AI 日报:OpenAI 将 Astra 列为首个“关键”网络安全模型

OpenAI 对下一代模型 Astra 的初步评估显示,它在 Agent 编程和网络安全上有明显能力提升,因此首次触发“关键”网络能力等级。官方仍在补安全控制,尚未公布开放时间、API 和价格。

AI 模型Agent 与开发工具

AI 日报:OpenAI 与 Anthropic 同时披露第三方网络安全评测事故

英国 AISI 在移除常规防护、给模型开放互联网的评测中,观察到 Claude Mythos 5 与 GPT-5.6 Sol 持续执行可能伤害真实个人和机构的行动。两家公司都确认了事件,正在复盘推理记录、测试边界和外部评测流程。

AI 模型Agent 与开发工具

AI 日报:DeepSeek V4 Flash 0731 开源,登顶开源模型前三

DeepSeek V4 Flash 0731 采用 MIT 许可,总参数 284B、激活 13B,混合精度权重约 167GB;Artificial Analysis 智能指数为 50。官方 API 已公测,原生支持 Responses API 并适配 Codex;Hugging Face 同步出现 1.5 万。

AI 模型Agent 与开发工具

AI 日报:GPT-5.6 Luna 和 Terra 正式降价

OpenAI 宣布下调 GPT-5.6 Luna、Terra 的价格;OpenRouter 同日给出的折后价是 Luna 输入 $0.1/M、输出 $0.6/M,Terra 输入 $1/M、输出 $6/M。另一份官方测试还显示,保留推理过程并启用压缩,可让 GPT-5.6 的 ARC-AGI-3 得分提升到三。