
DeepSeek V4 Pro 0813 正式版上线:1M 上下文、384K 输出,价格却涨了
8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。
大模型动态、AI工具实测、实战落地

8月12日,DeepSeek V4 Pro 正式版(0813)通过 API 悄然上线:1M 上下文、384K 最大输出、原生支持 Responses API 与 Anthropic 格式,但官方同时预告近期将大幅涨价。

来自多个研究机构的安全团队开发出解码管线,能从 OpenAI、Anthropic、Google 的 API 响应中还原被加密的推理块,并在公开的 agent 轨迹中发现了 700 多个真实密钥与隐私信息。

Meta Superintelligence Labs 开源了 Muse Glimmer——一个 30B 参数、专为本地 Agent 工作流设计的模型。量化后不到 20GB,24GB 显存的机器就能跑,还自带视觉能力和投机解码加速。

Mistral 发布 3B 开源权重多模态安全分类器 Shieldstral,把内容审核建模为策略自适应的问答任务,单张 16GB 显卡就能跑,性能匹敌 7 倍大的模型。

Google DeepMind 在 Nature 发表 WeatherNext 模型,预测飓风路径、强度和风场结构的准确率创下新纪录,平均为预报员多争取 24 小时预警时间,并已开源全部模型权重。
AMD 收购了把模型权重直接蚀刻进晶体管的初创公司 Taalas。它的测试芯片跑 Llama 3.1 8B 达到每秒 16960 token,比 Nvidia GPU 快 48 倍。代价是一旦部署就被锁死在某一个模型上。

Meta 正式推出终端编码 Agent Muse Code(Beta),底层由新模型 Muse Spark 1.2 驱动。它用常驻异步后台 Agent 减少重复信息收集,用本地事件日志保证崩溃后精确恢复,还公布了 1000+ 次工具调用的 GPU 内核优化实战。

阿里云发布第三代图像生成模型 Qwen-Image-3.0,主打"实":4.5k token 超长提示词、10px 微小文字渲染、12 种语言原生排版,把图像生成从"好看"推向"好用"。

Lilian Weng 深度解析:围绕基座模型的 harness 系统(工作流、记忆、工具编排)如何决定 AI 的能力上限,以及递归自我改进的工程路径

通义千问发布史上最强 Qwen3.8-Max:2.4T 参数(95B 激活),首次开源 Max 级模型权重,三个自主实验证明它能独立完成十天级编程、论文复现与竞赛夺冠。

字节跳动 Seed 团队发布 Seedance 2.5:单次生成 30 秒高质量音视频、支持最多 30 张图+10 段视频+10 段音频的多模态参考、时间戳级精确编辑。视频生成从'出片段'进化到'完成一部作品'。

微软研究院开源的 Flint 用语义类型 + 编译器自动推导,把 AI 生成图表从'碰运气'变成'一次成功'——50 种图表类型、5 个渲染后端、一个统一接口