
OpenAI Presence 发布:专为企业打造的 AI 客服代理平台
OpenAI 于 7 月 22 日推出 Presence,一个面向企业客户的 AI 代理平台,集成了语音对话、策略管理、安全护栏和持续改进机制,已在 OpenAI 自身客服中实现 75% 的自动解决率。
大模型动态、AI工具实测、实战落地

OpenAI 于 7 月 22 日推出 Presence,一个面向企业客户的 AI 代理平台,集成了语音对话、策略管理、安全护栏和持续改进机制,已在 OpenAI 自身客服中实现 75% 的自动解决率。

Moonshot AI 发布 Kimi K3——全球首个开源 3T 级大模型,在多方面逼近闭源前沿,48 小时自主设计芯片的案例让人震撼

ChatGPT 不再只是聊天机器人——OpenAI 发布 ChatGPT Work,一个能跨 Slack、Google Drive、邮箱等工具执行多步骤任务的 AI Agent,支持桌面操控、定时任务和交互式网页

OpenAI 发布 GPT-5.6 系列,包含旗舰 Sol、均衡 Terra 和高速 Luna 三款模型,编码能力突破 Terminal-Bench 91.9%,并推出更透明的安全机制
Anthropic 发布重磅可解释性研究:Claude 在训练过程中自发涌现出类似人脑的「全局工作空间」(J-space),占据不到 10% 的神经活动,却承担着多步推理、计划和内部监控等高级认知功能。研究者还开发了 Jacobian Lens 工具,可以实时读取和操控这个内部空间。
GLM 5.2 在质量上已接近甚至持平 Opus 和 GPT 5.5,但 API 价格仅为后者的 15-20%。加上极低的切换成本和开源可私有部署的优势,AI 推理正在从暴利生意走向薄利多销——这对整个行业意味着什么?

DeepReinforce 开源 Ornith-1.0 模型族,9B 到 397B 全覆盖,核心创新是让模型学会自己生成编排逻辑。397B 版本在编程基准上超越 Claude Opus 4.7。

Qwen 3.6 27B 稠密模型在编程能力上超越了上一代 397B MoE 旗舰,而且部署简单——一台 24GB 显存显卡就够。HN 当日最热,580 票。

一位开发者用 Claude Code 分析自己的肩部 MRI 影像,AI 给出了和诊所完全相反的报告——没有撕裂。这件事引发了医疗 AI 到底能信几分的讨论。

IBM 发布全球首个 sub-1nm 芯片技术,采用纳米堆叠 (CFET) 架构,在指甲盖大小上容纳近 1000 亿个晶体管,性能提升最高 50%,能效提升最高 70%。

OpenAI 与 Broadcom 合作推出首款定制 AI 推理芯片 Jalapeño,专为 LLM 推理优化,性能对标 Nvidia Blackwell 和 Google TPU,计划 2026 年底部署。

百度开源了 Unlimited OCR 模型(MIT 许可),实现了真正意义上的「一次性长视野文档解析」——无需分页、无需预处理,单次推理即可完成整份多页文档的结构化文本提取,在 Hacker News 上获得 435 分。