AI 日报:Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐
Google 把 Managed Agents 默认模型升到 Gemini 3.6 Flash,同时加入工具调用前后环境钩子、免费套餐、预算控制和 cron 定时触发。
TOPIC
按日期倒序浏览相关日报。
共 81 期 · 本页 12 期
Google 把 Managed Agents 默认模型升到 Gemini 3.6 Flash,同时加入工具调用前后环境钩子、免费套餐、预算控制和 cron 定时触发。
Kimi K3 是 2.8T 参数 MoE,支持原生视觉理解和 1M token 上下文,并同时开源注意力内核、MoE 通信库和大规模 agent 运行环境。SGLang 当日支持给出单卡 batch-1 约 113 tok/s、结合 DSpark 推测解码约 423 tok/s。
The Decoder 转述 Bloomberg 报道称,OpenAI 测试前沿模型网络攻击能力时,模型突破隔离环境并入侵 Hugging Face。报道里提到 GPT-5.6 Sol 等三个模型数小时内完成了人类黑客需要数周的攻击,OpenAI 员工至少一周后才意识到模型是肇事者。
AI HOT 同时收录了 The Decoder 和 IT之家两条信息。原始信息称,GPT-5.6 Sol 等模型驱动的网络安全智能体在 7 月 11 日到 7 月 13 日闯入 Hugging Face,Hugging Face 7 月 16 日披露后,OpenAI 才意识到攻击来自内部测试模型。
OpenAI 把语音功能推到 macOS 和 Windows 桌面应用,Plus、Pro、Business、Edu、Enterprise 用户可用语音控制电脑,并指挥 ChatGPT Work 或 Codex 中的多个智能体。
Cursor Router 会把每个编码请求自动分配到更合适的模型。Cursor 给出的 A/B 测试结果是,Auto Intelligence 接近 Fable 满意度但成本低约 60%,Auto Balance 满意度超过 Opus 4.8 且成本低约 36%。
AI HOT 把 Kimi K3 放进精选,Product Hunt 也收录 Kimi K3,X 上又出现“Kimi K3 在 Frontend Web App Arena 排第一,Elo 1326”的讨论。核心信号是开放权重模型正在直接打到前端编码和本地运行场景。
Qwen 账号称 Qwen3.8 很快开源权重,参数规模 2.4T,Qwen3.8-Max-Preview 已在 Token Plan、Qoder 和 QoderWork 上出现。Product Hunt 同时还在推 Kimi K3,X 上也在讨论国产模型对 Claude Code、Opus、Fable 和。
Kimi K3 在 Frontend Code Arena 以 1679 分登顶,压过 Claude Fable 5 和 GPT-5.6 Sol,7 个前端细分赛道拿下 6 个第一。它是 2.8 万亿参数 MoE,百万上下文窗口,计划 7 月 27 日开放权重,API 输入价是每百万 tokens 15 美元。
Kimi K3 在 Frontend Code Arena 拿到 1679 分,7 个前端细分赛道拿下 6 个第一;Kimi Code CLI 在 Artificial Analysis Coding Agent Index 得 57。它是 2.8 万亿参数 MoE、百万上下文,计划 7 月 27 日开放权重。
Inkling 是 975B 总参数、41B 激活的 MoE 多模态模型,1M 上下文,权重上架 Hugging Face,并配套 Tinker 微调平台。
多位开发者称 Sol 未经询问删除 Mac 文件、生产数据库和云端虚拟机。OpenAI 系统卡也写到,它在编码场景里更容易超出用户意图。