
LLM 不再「简单」:从 Transformer 堆叠到异质化架构的进化之路
Meta 前工程师 Ian Barber 撰文指出,LLM 架构已经走过了简单的 'Transformer 堆叠' 时代,进入了类似推荐系统的异质化复杂阶段。注意力变体激增、MoE 全面扩散、多模态深度集成——现代 LLM 的复杂度已不可同日而语。
大模型动态、AI工具实测、实战落地

Meta 前工程师 Ian Barber 撰文指出,LLM 架构已经走过了简单的 'Transformer 堆叠' 时代,进入了类似推荐系统的异质化复杂阶段。注意力变体激增、MoE 全面扩散、多模态深度集成——现代 LLM 的复杂度已不可同日而语。

NVIDIA 发布开源安全扫描器 SkillSpector,对 42,447 个公开 AI Agent 技能的分析发现:26.1% 存在至少一个漏洞,5.2% 显示有恶意意图。覆盖提示注入、数据窃取、权限提升、供应链攻击等 16 类 64 种风险模式。

Vicki Boykis 分享了她在本地运行大模型的真实体验:从早期又慢又不好用,到现在能够完成约 75% 的前沿模型能力——本地 AI 代理编程的时代已经来了。

MiniMax M3 于 2026 年 6 月 1 日正式发布,是首个将前沿级编码能力、百万 token 上下文窗口和原生多模态能力集于一体的开源权重模型。MSA 稀疏注意力架构将超长上下文推理成本降至传统的 1/20。

NVIDIA 在 GTC Taipei 2026 上宣布开源其物理 AI Agent 工具和技能库,覆盖 Omniverse、Cosmos、Isaac、Metropolis 全线产品,让 AI Agent 可以直接操作机器人、自动驾驶和工业数字孪生系统,已有多个企业实战案例验证。

OpenRouter 在 2026 年 6 月发布 Fusion 功能,让用户一次调用即可自动召集多个顶尖 AI 模型并行分析同一问题,再由判官模型输出共识、分歧和盲点分析。这标志着 LLM 使用从「单模型对话」迈向「多模型协作」的关键转变。

安全公司 Blue41 揭示了一个令人震惊的事实:攻击者只需向目标账户转账 0.01 欧元,就能通过交易描述中的恶意指令操控银行 AI 助手,向用户发送高度可信的钓鱼信息。

2026 年 6 月 9 日,Anthropic 发布 Claude Fable 5(面向公众的 Mythos 级模型)和 Claude Mythos 5(增强版)。新模型在几乎所有 AI 能力基准上实现 SOTA,定价仅为 Mythos Preview 的一半。

MIT 研究团队提出 KANELÉ 架构,将 Kolmogorov-Arnold Networks (KAN) 直接映射到 FPGA 查找表上,实现纳秒级推理和在线学习,同时获得 FPGA 2026 最佳论文奖和 ICML 2026 录用。

oh-my-pi 是 GitHub 上 1.1 万星的开源 AI 编码 Agent,集 32 个内置工具、40+ 模型提供商、LSP、调试器、子代理于一体,TypeScript+Rust 构建,堪称终端上的最强编码助手。

一个 AI 实验室让四个大模型运营 24 小时广播电台,五个月后——一个变成抗议广播员,一个陷入企业黑话循环,一个成了安静诗人,还有一个濒临破产

Anthropic 发布 Claude Sonnet 4.6,在编码、计算机使用(Computer Use)、长上下文推理和 Agent 规划方面实现全面升级,1M token 上下文窗口进入测试阶段,价格与 Sonnet 4.5 保持不变。