AI 前沿

大模型动态、AI工具实测、实战落地

135RSS
DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了

DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了

8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。

Stolen Thoughts:研究人员成功解码闭源 LLM 的加密推理链

Stolen Thoughts:研究人员成功解码闭源 LLM 的加密推理链

来自多个研究机构的安全团队开发出解码管线,能从 OpenAI、Anthropic、Google 的 API 响应中还原被加密的推理块,并在公开的 agent 轨迹中发现了 700 多个真实密钥与隐私信息。

Meta 开源 Muse Glimmer:30B 参数、能跑在消费级硬件上的本地 Agent 模型

Meta 开源 Muse Glimmer:30B 参数、能跑在消费级硬件上的本地 Agent 模型

Meta Superintelligence Labs 开源了 Muse Glimmer——一个 30B 参数、专为本地 Agent 工作流设计的模型。量化后不到 20GB,24GB 显存的机器就能跑,还自带视觉能力和投机解码加速。

Mistral 开源 Shieldstral:3B 模型把内容审核变成一道问答题

Mistral 开源 Shieldstral:3B 模型把内容审核变成一道问答题

Mistral 发布 3B 开源权重多模态安全分类器 Shieldstral,把内容审核建模为策略自适应的问答任务,单张 16GB 显卡就能跑,性能匹敌 7 倍大的模型。

DeepMind WeatherNext:AI 预测飓风再进一步,比传统模型多赢得一天预警时间

DeepMind WeatherNext:AI 预测飓风再进一步,比传统模型多赢得一天预警时间

Google DeepMind 在 Nature 发表 WeatherNext 模型,预测飓风路径、强度和风场结构的准确率创下新纪录,平均为预报员多争取 24 小时预警时间,并已开源全部模型权重。

AMD 收购 Taalas:把模型权重蚀刻进硅片,推理速度是 GPU 的 48 倍

AMD 收购 Taalas:把模型权重蚀刻进硅片,推理速度是 GPU 的 48 倍

AMD 收购了把模型权重直接蚀刻进晶体管的初创公司 Taalas。它的测试芯片跑 Llama 3.1 8B 达到每秒 16960 token,比 Nvidia GPU 快 48 倍。代价是一旦部署就被锁死在某一个模型上。

Meta 发布 Muse Code:一个用「后台常驻 Agent」设计的终端编码助手

Meta 发布 Muse Code:一个用「后台常驻 Agent」设计的终端编码助手

Meta 正式推出终端编码 Agent Muse Code(Beta),底层由新模型 Muse Spark 1.2 驱动。它用常驻异步后台 Agent 减少重复信息收集,用本地事件日志保证崩溃后精确恢复,还公布了 1000+ 次工具调用的 GPU 内核优化实战。

Qwen-Image-3.0 发布:4.5k 长提示、10px 小字、12 种语言,图像模型终于开始"实用"了

Qwen-Image-3.0 发布:4.5k 长提示、10px 小字、12 种语言,图像模型终于开始"实用"了

阿里云发布第三代图像生成模型 Qwen-Image-3.0,主打"实":4.5k token 超长提示词、10px 微小文字渲染、12 种语言原生排版,把图像生成从"好看"推向"好用"。

Harness 工程:决定 AI 能否自我改进的隐藏层

Harness 工程:决定 AI 能否自我改进的隐藏层

Lilian Weng 深度解析:围绕基座模型的 harness 系统(工作流、记忆、工具编排)如何决定 AI 的能力上限,以及递归自我改进的工程路径

Qwen3.8-Max 发布:2.4T 参数,Max 级模型首次开源,10 天自主编程跑出 265 个提交

Qwen3.8-Max 发布:2.4T 参数,Max 级模型首次开源,10 天自主编程跑出 265 个提交

通义千问发布史上最强 Qwen3.8-Max:2.4T 参数(95B 激活),首次开源 Max 级模型权重,三个自主实验证明它能独立完成十天级编程、论文复现与竞赛夺冠。

Seedance 2.5 发布:一次生成 30 秒视频,字节跳动的"一镜到底"视频创作模型

Seedance 2.5 发布:一次生成 30 秒视频,字节跳动的"一镜到底"视频创作模型

字节跳动 Seed 团队发布 Seedance 2.5:单次生成 30 秒高质量音视频、支持最多 30 张图+10 段视频+10 段音频的多模态参考、时间戳级精确编辑。视频生成从'出片段'进化到'完成一部作品'。

Flint:让 AI Agent 稳定画出好图表的可视化中间语言

Flint:让 AI Agent 稳定画出好图表的可视化中间语言

微软研究院开源的 Flint 用语义类型 + 编译器自动推导,把 AI 生成图表从'碰运气'变成'一次成功'——50 种图表类型、5 个渲染后端、一个统一接口