AI 前沿
大模型动态、AI工具实测、实战落地

Kimi K3 发布:2.8 万亿参数的开源前沿模型,距 GPT-5.6 和 Fable 5 仅一步之遥
Moonshot AI 发布 Kimi K3——全球首个开源 3T 级大模型,在多方面逼近闭源前沿,48 小时自主设计芯片的案例让人震撼

ChatGPT Work:OpenAI 发布跨应用 AI 工作助手,从聊天工具进化成全天候数字员工
ChatGPT 不再只是聊天机器人——OpenAI 发布 ChatGPT Work,一个能跨 Slack、Google Drive、邮箱等工具执行多步骤任务的 AI Agent,支持桌面操控、定时任务和交互式网页

GPT-5.6 Sol / Terra / Luna:OpenAI 发布新一代模型家族,三档定价覆盖全场景
OpenAI 发布 GPT-5.6 系列,包含旗舰 Sol、均衡 Terra 和高速 Luna 三款模型,编码能力突破 Terminal-Bench 91.9%,并推出更透明的安全机制
Anthropic 发现 Claude 内部存在「全局工作空间」——意识级思考可被实时观测与操控
Anthropic 发布重磅可解释性研究:Claude 在训练过程中自发涌现出类似人脑的「全局工作空间」(J-space),占据不到 10% 的神经活动,却承担着多步推理、计划和内部监控等高级认知功能。研究者还开发了 Jacobian Lens 工具,可以实时读取和操控这个内部空间。
GLM 5.2 与即将到来的 AI 推理利润率崩盘——开放权重模型如何颠覆大厂商业模式
GLM 5.2 在质量上已接近甚至持平 Opus 和 GPT 5.5,但 API 价格仅为后者的 15-20%。加上极低的切换成本和开源可私有部署的优势,AI 推理正在从暴利生意走向薄利多销——这对整个行业意味着什么?

Ornith-1.0:首个自脚手架开源编程模型,397B 超越 Claude Opus 4.7
DeepReinforce 开源 Ornith-1.0 模型族,9B 到 397B 全覆盖,核心创新是让模型学会自己生成编排逻辑。397B 版本在编程基准上超越 Claude Opus 4.7。

Qwen 3.6 27B:一台消费级显卡就能跑起来的旗舰级编程模型
Qwen 3.6 27B 稠密模型在编程能力上超越了上一代 397B MoE 旗舰,而且部署简单——一台 24GB 显存显卡就够。HN 当日最热,580 票。

他用 Claude Code 分析了自己的 MRI 影像,结果和医生说的完全不同
一位开发者用 Claude Code 分析自己的肩部 MRI 影像,AI 给出了和诊所完全相反的报告——没有撕裂。这件事引发了医疗 AI 到底能信几分的讨论。

IBM 发布 0.7nm 芯片技术:纳米堆叠或在未来十年延续摩尔定律
IBM 发布全球首个 sub-1nm 芯片技术,采用纳米堆叠 (CFET) 架构,在指甲盖大小上容纳近 1000 亿个晶体管,性能提升最高 50%,能效提升最高 70%。

OpenAI 联手 Broadcom 发布 Jalapeño:首款自研 AI 推理芯片
OpenAI 与 Broadcom 合作推出首款定制 AI 推理芯片 Jalapeño,专为 LLM 推理优化,性能对标 Nvidia Blackwell 和 Google TPU,计划 2026 年底部署。

Baidu Unlimited OCR:开源无限 OCR 模型,单次解析整份文档,435 点登顶 Hacker News
百度开源了 Unlimited OCR 模型(MIT 许可),实现了真正意义上的「一次性长视野文档解析」——无需分页、无需预处理,单次推理即可完成整份多页文档的结构化文本提取,在 Hacker News 上获得 435 分。

Claude 自主操控机器狗,速度比人类快 37.7 倍:Anthropic Project Fetch 第二阶段
Anthropic 发布 Project Fetch 第二阶段研究:Claude Opus 4.7 在零人类协助下操控机器狗完成复杂任务,平均每项仅需 2.4 分钟,而去年的人类团队需要 72 分钟。