跳到正文
AI Dayline · AI 独立开发者日报
← 返回日报归档

2026年8月13日星期四

AI 日报:阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文

Qwen-Max 级模型首次开放权重;总参数 2.4T、每个 token 激活 95B,原生上下文 262,144 token,并称可扩到约 101 万 token。

30 秒速读

本日报从公开来源中筛选与独立开发者相关的模型、产品、需求和工作流变化。事实链接用于核对,价值判断是编辑分析。

今天最该知道的 10 条

阿里开放 Qwen3.8-2.4T-A95B 模型权重:2.4T MoE、激活 95B、原生 256K 上下文 原文

xAI 发布 Grok 4.6,强化长时运行智能体能力 原文

NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 原文

Claude in Chrome 侧边栏升级为 Claude Cowork 会话 原文

OpenRouter 推出实时网页搜索基准测试:如何为智能体选择引擎、深度与模型 原文

AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求 原文

Show HN: Decant – Understand how you spend tokens 原文

Codex for Linux 发布,带来并行 agent、worktree 与浏览器工作流 原文

Media Sharing:让 AI agents 把截图和视频放进 Pull Request 原文

Google 研究:Recall 是参数化事实性的瓶颈 原文

大模型榜单异动

今天没有 major_surge 或 watch 级别的榜单异动;采集到的 30 项均为 minor_change,例如 Dreamina Seedance 2.0 720p 在图生视频仍为第 1、文生视频仍为第 3。它们没有足够的排名或 Elo 变化,不应单独触发换模型决策。今天该把测试预算放在新开放权重、长时 agent 与具体工作流的成本上。

值得注意的新产品、新方向、新模型

浏览器会话开始承载跨端 agent 工作

模型供应快速增多,路由与可观测性变成基础需求

视频生成正从单段素材走向可编排产线

未被满足的需求

团队不知道 token 到底浪费在什么环节

长任务完成后,负责人仍缺少可审核的交接物

模型更强,却仍会在关键事实和开放式写作上失手

如果今天只有两个小时

做一个“Agent 任务账单 + 交接包”原型:接一份真实的 coding 或网页采集日志,按模型调用、搜索、重试、工具调用和人工等待拆成本,并自动生成一页交接卡,附上结果、截图/链接、失败点和下次继续的位置。第一批用户去 HN 的 Decant 讨论、使用 Codex/Claude Code 的 X 开发者,以及有浏览器自动化 PR 的开源项目维护者中找;先问他们最近一次“跑完了但不敢合并”的任务。

原始信息

以下公开来源链接用于核对本期事实;来源收集数量保留为编辑透明度说明。本次采集 238 条:AI HOT 精选 34、AI 新闻 71、GitHub 趋势 57、Product Hunt 33、X 43;没有抓取异常。