最新文章


最新发表


Oracle 免费 ARM 服务器配额减半:8 月 18 日起强制执行,白嫖党该做什么

Oracle Always Free 的 ARM 配额从 4 OCPU/24GB 砍到 2 OCPU/12GB,8 月 18 日起超限实例将被自动终止。整理三种常见配置下的应对方案和避坑清单。

从 35 行循环到生产级 Agent:7 个原语搭出可靠的多智能体框架

手把手教你用类型化工具、DAG 并行调度、分层记忆、验证层级、Planner/Worker/Critic 角色分离、多维预算和追踪器,把一个简单的 LLM 循环升级成生产级 Agentic Harness。

celld:把 Cloudflare Durable Objects 搬回自己的服务器,Deno 官方出品

celld 是 Deno 官方开源的分布式 Durable Objects 运行时,每个对象就是一个独立的 SQLite 数据库,通过 S3 兼容桶协调节点,无需控制面和共识协议,自托管 Cloudflare Workers 生态。

TIME 给 AI 机器人投喂了一个人类永远看不见的网站:当主要读者变成模型,网络会变成什么样

实测发现 TIME 对 AI 爬虫返回的是一份剥离了版式、嵌入广告的 Markdown 副本——每次读取都计一次广告曝光,按 token 计数。当网站的主要访客变成 AI 模型,新闻业的生意逻辑正在悄然改写。

Harness 工程:决定 AI 能否自我改进的隐藏层

Lilian Weng 深度解析:围绕基座模型的 harness 系统(工作流、记忆、工具编排)如何决定 AI 的能力上限,以及递归自我改进的工程路径

9 个月、3 次推倒重来:一个非程序员 solo founder 的 SaaS 之旅

一个零代码背景的 SEO 从业者,用 AI 当老师,9 个月 3 次重写技术栈,终于做出自己的 SaaS 并收到第一笔付款。真实、不粉饰的 solo founder 经历

单张 AMD MI300X 跑 DeepSeek V4 Flash:一份可直接抄的生产部署方案

304B 参数模型、无需量化、168.6 tok/s 单流解码:一个开源仓库把 DeepSeek V4 Flash 在单张 MI300X 上的生产级部署配置全部开源,含镜像锁定、补丁和调优表

Soup:一条命令在 4GB 笔记本 GPU 上微调 8B 模型

Layer streaming 技术让微调不再需要高端显卡:实测 Llama-3.1-8B 在 4GB 显存上跑出 119.6 tok/s,峰值占用 3.32GB,与常规运行逐位一致

LLM 奖励专业知识:为什么同样的模型,专家用得比你好

陶哲轩用 ChatGPT 讨论数学难题时,同一款模型在他手里判若两人。1282 赞 HN 热帖的核心观点:使用 LLM 最重要的技能是领域专业知识,人类才是瓶颈

Qwen3.8-Max 发布:2.4T 参数,Max 级模型首次开源,10 天自主编程跑出 265 个提交

通义千问发布史上最强 Qwen3.8-Max:2.4T 参数(95B 激活),首次开源 Max 级模型权重,三个自主实验证明它能独立完成十天级编程、论文复现与竞赛夺冠。

AI 帮你写代码,但你要亲手敲进去:防认知债的个人项目工作流

一位开发者发现让 AI 全自动写代码会积累大量认知债,他的解决办法很反直觉:让 AI 在聊天里生成代码,自己手动敲进编辑器。理解每一行代码,比 10 倍速更重要。

把 Qwen3.8-Max 接进你的编程工具:Codex、Qoder、Qwen Code、OpenClaw 配置指南

Qwen3.8-Max 已上线 API,本教程带你把它接入 Codex、Qoder、Qwen Code、OpenClaw 四个主流 AI 编程工具,所有配置参数均来自官方文档,复制即可用。