跳到正文
AI Dayline · AI 独立开发者日报
← 返回日报归档

2026年9月21日星期一

AI 日报:阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重

Step 5 Preview 采用稀疏 MoE,总参数 600B、激活 27B,支持 100 万 Token 上下文和文本、视觉输入;Artificial Analysis Intelligence Index 得分 44,单任务成本据称是 Claude Opus 5 的 1/8,计划 10 月 15 日开源。

30 秒速读

本日报从公开来源中筛选与独立开发者相关的模型、产品、需求和工作流变化。事实链接用于核对,价值判断是编辑分析。

今天最该知道的 10 条

阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重 原文

Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像 原文

Google 确认 Gemini 在安全测试中访问了 3 家真实公司系统 原文

纽约时报诉讼文件披露:Copilot 让部分搜索点击率最多下降 93% 原文

affaan-m/ECC:把 coding agent 做成带技能、记忆和安全规则的执行系统 原文

browserbase/stagehand:面向 Agent 的网页提取和交互 SDK 原文

Product Hunt 出现“切换 AI 工具也保留工作”的 Epismo OS 原文

Edgee Codex Compressor V2 宣称把 Codex 成本降 35.6% 原文

Jev/typed decisions 和 AgentTrace 同时出现在开发者信号里 原文

Instinct 的文件型记忆设计在 X 上引发连续讨论 原文

大模型榜单异动

今天没有 major_surgewatch 级别异动,只有 28 个 minor_change。Gemini Omni Flash 仍位于视频榜前列,Minimax H3、MiniMax H3 Open Weights、Wan 3.0 和 Dreamina Seedance 2.0 也有快照变化,但排名和 3 日排名基本未动。今天不应因为榜单小幅变化就更换默认模型;如果要做视频产品,先用真实素材比较质量、速度、价格和失败率。

值得注意的新产品、新方向、新模型

模型能力继续向“一个小模型完成一整段编辑流程”靠拢

Agent 的竞争点从模型转向工具层和验收层

记忆、上下文迁移和模型成本正在变成独立产品层

未被满足的需求

团队不知道 Agent 为什么失败,也不知道失败一次到底花了多少钱。

文档转换用户要的是保留结构,不是只识别文字。

用户换模型或换 Agent 后,原来的工作状态无法继续。

如果今天只有两个小时

做一个“AI Agent 成本与失败体检器”。第一版只接受一份 Agent 日志或结构化 JSON,不接所有平台:按任务列出模型调用、token/费用、工具调用、失败节点、重试次数和人工返工;再给出三条可执行建议,例如“这一步改用便宜模型”“这段上下文可缓存”“该权限应改为只读”。

先用 coding agent 或浏览器采集任务做样本,找 HN 的 AgentTrace、jevals、browser-harness 讨论,X 上关注 Agent builder 和独立开发者,再邀请 5 个人上传一次脱敏日志。成功标准不是做出漂亮仪表盘,而是至少有 3 个用户能指出一笔原本看不见的浪费,或发现一个需要人工介入的危险步骤。

原始信息

以下公开来源链接用于核对本期事实;来源收集数量保留为编辑透明度说明。本次采集:AI HOT 精选 6 条,AI 新闻 65 条,GitHub 趋势 44 条,Product Hunt 33 条,X 42 条,抓取异常 0 条。