AI 周报 · 自动抓取生成
Yunumi AI 周报
每周从技术社区(掘金 · CSDN · 知乎 · Hacker News · arXiv)与「全球12亿文献知识库」学术文献库自动抓取,经智能筛选后整合为结构化周报,推送给订阅用户。
本周要点
一眼看本周发生了什么
01
开源权重再下探旗舰边界:阿里 Qwen3.8-Max 预告开源 Max 级权重、蚂蚁 Ling-3.0-flash 与 Sand.ai MAGI-2 同日开源,闭源护城河继续被削弱。
02
数学与密码学被 AI 正面攻破:OpenAI Astra 攻克十道数学难题、Claude Mythos 击溃后量子签名 HAWK,前沿模型进入严肃科研与安全领域。
03
交互范式从轮次走向全双工:OpenAI GPT-Live 移除轮次检测器、Grok 上线视频理解,模型开始接管连续、实时的感知与对话回路。
04
规模竞赛再升一维:字节被曝训练最高 10 万亿参数模型,规模超 Kimi K3 并逼近 Anthropic Mythos 5,预训练军备赛再度加码。
分类速览
新闻 · 技术 · 论文
每条均附一句话价值与原文链接。本期论文侧来自 arXiv 公开检索,「全球12亿文献知识库」因凭证未绑定暂未接入,下期恢复。
新闻动态
模型
阿里 Qwen3.8-Max 发布,预告开源 Max 级权重
总参 2.4 万亿、激活 95B、100 万上下文,下周开源权重(国产首次开放 Max 级旗舰),API 定价仅为海外同级的 24% 至 40%。
阅读原文
模型
字节被曝训练最高 10 万亿参数模型
据英国《金融时报》,字节正训练最高 10 万亿参数模型,处于 3 至 6 个月预训练早期,规模超 Kimi K3,张一鸣明确反对模型蒸馏。
阅读原文
科研
OpenAI Astra 破解十道数学难题,全部 Lean 验证
下一代推理模型 Astra 在高维几何、群论、格密码等方向攻克 10 项悬置十年的公开难题,单题成本约 2000 美元,证明开源并通过 Lean 验证。
阅读原文
安全
Claude Mythos 攻破后量子签名 HAWK
Anthropic 公布 Claude Mythos Preview 对 NIST 后量子签名候选 HAWK 的非平凡自同构攻击,有效密钥强度砍半(约 60 小时),HAWK 团队已从流程撤回。
阅读原文
技术实践
开源
蚂蚁百灵 Ling-3.0-flash 开源:124B/5.1B MoE
原生混合推理模型,扩展超 10000 个真实交互训练环境,针对 Agent 场景优化自我纠错与长程规划,提供 API、私有化部署等三种落地方式。
阅读原文
开源
Sand.ai 开源千亿级 MoE 视频模型 MAGI-2
总参 114B、单 token 激活仅 6B,单流 DiT 统一建模文本/音频/视频,图生视频居 Artificial Analysis 榜第六,权重已开源。
阅读原文
架构
OpenAI GPT-Live 全双工语音架构解析
从轮流对话升级为流式全双工,移除经典轮次检测器;推理引擎用 Go 重写,新 WARP 协议把会话启动从 6 次网络往返压缩至 1 次。
阅读原文
论文精选 来源:arXiv 公开检索
推理优化
CostAda:预算感知的 LLM 发现控制器(arXiv:2607.26828)
提出成本校准的前沿效用,让搜索预算决定探索强度与战术干预;16 个基准-骨架组合中 12 个仅用一半预算就追平最强基线,全员均值质量第一。
阅读原文
Agent 训练
GRPO 密集奖励会拖垮 LLM Agent(arXiv:2607.21273)
74 组预注册实验 dissect 同一预测奖励信号:标准归一化下所有持续该奖励的运行都会崩溃,根因是「通道」而非「内容」,为 RL 调参敲响警钟。
阅读原文
Agent 策略
TAPO:面向 LLM Agent 的转移动态策略优化(arXiv:2607.27973)
让 Agent 在长程任务中显式感知状态转移,相较通用 GRPO 在多步工具调用与规划上更稳定,呼应本站「AI Agent 编排」模块。
阅读原文
历史归档
往期周报
第 33 期
2026-08-04 ~ 2026-08-10
当前一期
第 32 期
2026-07-28 ~ 2026-08-03
阅读
第 34 期
2026-08-11 ~ 2026-08-17
生成中…
每周日 20:00,自动推送新一期
留下邮箱,周报与新课提醒准时送达。随时退订,绝不打扰。
我们重视你的隐私,邮箱仅用于周报与课程通知。