Pablo早报

2026-07-21

AI 科技早报 · 2026-07-21

今日要闻

1. 🔥 阿里通义千问发布 Qwen 3.8——2.4T 参数开源模型,自称仅次于 Fable 5

阿里巴巴通义千问团队宣布 Qwen 3.8 即将开源,这是一个拥有 2.4 万亿参数的庞然大物,官方声称其性能"与前沿 AI 模型兼容,仅次于 Fable 5"。 该消息以 938 分和 682 条评论登上 HN,成为当日 AI 领域最受关注的事件。Qwen 3.8-Max-Preview 已在阿里百炼平台、Qoder 和 QoderWork 上线,用户无需等待开源即可尝鲜。

关键细节:

— 来源:Twitter/@Alibaba_Qwen | HN

2. 🔥 小米发布 Robotics-1——首个基于 10 万小时真实操作数据训练的机器人基础模型

小米发布了 Xiaomi-Robotics-1:一个开箱即用的机器人基础模型,基于超过 10 万小时的真实世界操作轨迹训练而成,论文、代码和模型权重全部开放。 该发布以 424 分和 287 条评论登上 HN。

关键细节:

— 来源:Xiaomi Robotics | HN

3. 🔥 GPT-5.6 发现价值 50 万美元的 WordPress RCE 漏洞——成本仅 $25

安全研究公司 Searchlight Cyber(原 SLCyber)发表了一篇令人震惊的博客文章:漏洞经纪人愿意为 WordPress 远程代码执行(RCE)漏洞支付 50 万美元,而他们使用 GPT-5.6 Sol Ultra 和仅 $25 的 API 费用就找到了一个。 该文章以 355 分和 202 条评论登上 HN。

关键细节:

— 来源:Searchlight Cyber | HN

模型与基础设施

4. Kimi K3、Qwen 3.8 与 Anthropic 的"潜在瓦解"——前沿模型经济学的战略分析

Emerging Trajectories 发表了一篇战略分析文章,从经济学角度解读了 Kimi K3、Qwen 3.8 的发布对 Anthropic 商业模式的潜在冲击。 该文以 214 分和 227 条评论登上 HN,标题中的"Potential Unravelling(潜在瓦解)"引发了激烈讨论。

关键细节:

— 来源:Emerging Trajectories | HN

5. 控制 LLM 的推理努力——Sebastian Raschka 解读 GPT-5.6 的三档推理模式

机器学习教育家 Sebastian Raschka 发表了一篇深度文章,介绍了 LLM 如何学习低、中、高三种推理努力模式——从 OpenAI o1 到 DeepSeek-R1,再到 GPT-5.6 的三档推理设置。 该文以 50 分登上 HN。

关键细节:

— 来源:Sebastian Raschka Magazine | HN

6. Inertia-1:可穿戴设备的通用运动基础模型

学术团队发布了 Inertia-1——一个统一的运动基础模型,仅通过腕部加速度计数据学习运动表征,并能泛化到全身、多传感器和多任务场景。 该论文以 45 分登上 HN,代表了"健康 AI 基础模型"这一新兴方向。

关键细节:

— 来源:Inertia-1 Project Page | HN

7. Soofi:欧洲主权开源基础模型首次亮相

Soofi 联盟发布了 Soofi S——欧洲首个面向工业 AI 应用的开源基础模型系列的首个组件,专注技术文档、代码生成和 Agent AI 系统。 该发布以 43 分登上 HN。

关键细节:

— 来源:Soofi | HN

AI 应用与产品

8. "我烧光了所有 Token 来研究如何省 Token"——一套自建深度研究管道的实战经验

Quesma 博客发表了一篇"以身试法"式的文章:作者为了研究 AI Agent 的经济学,搭建了一套自建深度研究管道——结果第一次运行就在 30 分钟内烧光了一整个 Claude Max 5x 计划的 Token 配额。 该文以 166 分和 206 条评论登上 HN。

关键细节:

— 来源:Quesma Blog | HN

9. Cursor 发布 Agent Swarm 实验——更好的协调实现相近质量、极低成本

Cursor 发表了关于"Agent Swarms"的研究文章,比较了新旧两代 Agent Swarm 从零构建 SQLite 的表现——发现更好的协调机制可以在保持相近质量的同时,将成本降低一个数量级。 该文以 34 分和 13 条评论登上 HN。

关键细节:

— 来源:Cursor Blog | HN

10. 四大编码 Agent 厂商同时爆出沙盒逃逸漏洞

安全公司 Pillar Security 披露了针对四家主流编码 Agent 供应商(Claude Code、Codex、Cursor 和另一家未具名厂商)的沙盒逃逸漏洞——攻击者可以通过精心构造的恶意代码库让 Agent 突破其安全沙盒,访问和修改主机文件系统。 该报告以 11 分登上 HN。

关键细节:

— 来源:Pillar Security | HN

行业与投资

11. "中国的开源权重 AI 策略正在获胜"——一篇引发 564 条评论的分析

开发者 Ben Werdmuller 发表了一篇引发广泛讨论的博客文章,系统论证了"美国的 AI 被锁定和专有化——它正在失败"以及"中国的开源权重策略是更聪明的长期玩法"。 该文以 652 分和 564 条评论登上 HN。

关键细节:

— 来源:werd.io | HN

12. Google 正在将 Gemini 烧入芯片硅层——"Frozen"芯片计划 2028 年实现 10 倍效率

据 TNW 报道,Google 正在开发代号为"Frozen"的服务器芯片,将 Gemini 模型的设计硬连线到硅层中——如果成功,将以高达 10 倍的效率运行 Gemini 模型。 该消息以 4 分登上 HN。

关键细节:

— 来源:TNW | HN

研究与突破

13. arXiv 论文中有多少是 AI 写的?——一项大规模测量的诚实报告

Unslop 团队对 12,750 篇 arXiv 论文进行了全文 AI 写作检测——发现约三分之一的新论文读起来像机器写的。 该研究以 163 分和 118 条评论登上 HN。

关键细节:

— 来源:Unslop | HN

14. AI 解决了图论领域 20 年未解猜想——10 行算法被证明是最优的

研究人员 Mars Xiang 等人在 Twitter/X 上宣布:他们使用 AI 辅助方法,在 Lean 证明助手中完成了对一个 20 年历史的图论猜想的证明——证明了贪心算法在半流式匹配问题上达到了最优近似比。 该消息以 12 分登上 HN。

关键细节:

— 来源:Twitter/@marsxiang_ | HN

政策与社会

15. 黑客清空罗马尼亚全国土地登记数据库——关键基础设施的网络安全警示

据 Risky Business 报道,一名黑客成功入侵并清空了罗马尼亚的全国土地登记数据库——该数据库包含该国所有不动产的产权记录。 该事件以 482 分和 264 条评论登上 HN,虽然不直接涉及 AI,但在 AI 辅助攻击工具(如 GPT-5.6 发现 WordPress RCE,见第 3 条)成本急剧下降的背景下,其警示意义被放大了。

关键细节:

— 来源:Risky Business | HN