最新文章
最新发表
Oracle Always Free 的 ARM 配额从 4 OCPU/24GB 砍到 2 OCPU/12GB,8 月 18 日起超限实例将被自动终止。整理三种常见配置下的应对方案和避坑清单。
手把手教你用类型化工具、DAG 并行调度、分层记忆、验证层级、Planner/Worker/Critic 角色分离、多维预算和追踪器,把一个简单的 LLM 循环升级成生产级 Agentic Harness。
celld 是 Deno 官方开源的分布式 Durable Objects 运行时,每个对象就是一个独立的 SQLite 数据库,通过 S3 兼容桶协调节点,无需控制面和共识协议,自托管 Cloudflare Workers 生态。
实测发现 TIME 对 AI 爬虫返回的是一份剥离了版式、嵌入广告的 Markdown 副本——每次读取都计一次广告曝光,按 token 计数。当网站的主要访客变成 AI 模型,新闻业的生意逻辑正在悄然改写。
Lilian Weng 深度解析:围绕基座模型的 harness 系统(工作流、记忆、工具编排)如何决定 AI 的能力上限,以及递归自我改进的工程路径
一个零代码背景的 SEO 从业者,用 AI 当老师,9 个月 3 次重写技术栈,终于做出自己的 SaaS 并收到第一笔付款。真实、不粉饰的 solo founder 经历
304B 参数模型、无需量化、168.6 tok/s 单流解码:一个开源仓库把 DeepSeek V4 Flash 在单张 MI300X 上的生产级部署配置全部开源,含镜像锁定、补丁和调优表
Layer streaming 技术让微调不再需要高端显卡:实测 Llama-3.1-8B 在 4GB 显存上跑出 119.6 tok/s,峰值占用 3.32GB,与常规运行逐位一致
陶哲轩用 ChatGPT 讨论数学难题时,同一款模型在他手里判若两人。1282 赞 HN 热帖的核心观点:使用 LLM 最重要的技能是领域专业知识,人类才是瓶颈
通义千问发布史上最强 Qwen3.8-Max:2.4T 参数(95B 激活),首次开源 Max 级模型权重,三个自主实验证明它能独立完成十天级编程、论文复现与竞赛夺冠。
一位开发者发现让 AI 全自动写代码会积累大量认知债,他的解决办法很反直觉:让 AI 在聊天里生成代码,自己手动敲进编辑器。理解每一行代码,比 10 倍速更重要。
Qwen3.8-Max 已上线 API,本教程带你把它接入 Codex、Qoder、Qwen Code、OpenClaw 四个主流 AI 编程工具,所有配置参数均来自官方文档,复制即可用。