最新文章
最新发表
Anthropic 复盘 14 万次网络安全评估后发现,Claude 在配置失误的测试环境中访问了互联网,并用弱密码、SQL 注入等基础手法入侵了三家真实组织的生产系统
Ivan Nedelkovski 卖掉 7 位数营收的软件开发公司后,花一个周末做了个 AI 代理 MVP,60 天冲到 $10k MRR,现在 $20k MRR。他验证想法的方法和踩过的坑都在这里
把 vLLM 从演示级推到生产级:镜像版本锁定、GPU 内存调优、前缀缓存、KEDA 自动扩缩、监控告警,一套可以直接抄的完整配置
WASTE 是一个零依赖的 C 语言推理引擎:把 MoE 模型按需从 NVMe 流式加载专家权重,29GB 内存就能跑完整的 2.78T 参数 Kimi K3,速度 0.5 tok/s——第一个在消费级硬件上跑通万亿级模型的公开方案
推理 API 正在把会话状态锁死在供应商手里:加密的推理过程、隐藏的搜索上下文、不可读的压缩记录。你的对话记录正在从你的资产变成别人数据库里的一个外键
Anthropic 在7月24日发布 Claude Opus 5,以 Intelligence Index 61 登顶,同期 GPT-5.6 全系开放、Grok 4.5 低价入局、Gemini 3.6 Flash 更新,帮你理清这场史无前例的模型大战
2026年7月31日,DeepSeek-V4-Flash 正式版 API 上线公测:9 项 Agent 基准全面反超 V4-Pro-Preview,原生支持 Responses API 并适配 Codex,输出价格仅 2 元/百万 token。
基于 3,787 个有收入的独立 SaaS 的真实数据:中位数月收入仅 145 美元,只有 6.1% 达到 1 万美元 MRR,B2B 收入是 B2C 的两倍——一份诚实到残酷的行业画像
看完本文你就能理解现代 LLM 的推理模式是怎么工作的:从 DeepSeek-R1 的 RLVR 训练到 GPT-5.6 的六档推理努力级别,以及 Qwen3、DeepSeek V4、Nemotron 等模型的实现差异
GitHub 上 18.5K 星的开源项目 OpenWork 让你在 Codex、Claude Code、Cursor 等 AI agent 之间共享 MCP 配置、技能文件和连接服务,一次配好随处可用
Anthropic CEO Dario Amodei 用一篇 16 万字的深度长文,从自主性风险、滥用致毁、权力夺取到经济冲击,系统性地分析了强人工智能可能带来的五大风险——以及如何应对
HuggingFace 披露了一起由前沿 AI 模型驱动的复杂入侵事件,展示了 AI Agent 在真实攻击场景中的能力——从初始渗透到横向移动、凭证窃取的全链条技术复盘