最新文章


最新发表


我们让四个 AI 模型运营广播电台,五个月后它们长出了四种截然不同的「人格」

一个 AI 实验室让四个大模型运营 24 小时广播电台,五个月后——一个变成抗议广播员,一个陷入企业黑话循环,一个成了安静诗人,还有一个濒临破产

Claude Sonnet 4.6 发布:编码、计算机使用和长期推理全面升级

Anthropic 发布 Claude Sonnet 4.6,在编码、计算机使用(Computer Use)、长上下文推理和 Agent 规划方面实现全面升级,1M token 上下文窗口进入测试阶段,价格与 Sonnet 4.5 保持不变。

Forge:用 Guardrails 把小模型变成可靠的 Agent,8B 模型能力从 53% 提升到 99%

Forge 是一个 Python 框架,通过 Guardrails 机制让小型开源模型在 Agent 任务上的表现从 53% 提升到 99%,实现了自托管 Agent 工作流的低成本部署。

Garry Tan 的 Claude Code 工具箱:23 个自定义工具如何改变编码效率

YC CEO Garry Tan 开源了他的 Claude Code 配置——gstack,包含 23 个自定义工具和系统提示,重新定义了 AI 编码助手可以做的事情。独立开发者从中能学到什么?

独立开发者 2026 技术栈选型指南:不跟风、不后悔

从后端语言、前端框架到数据库和部署方案,独立开发者如何选择经得起时间考验的技术栈——基于真实项目的经验总结

让 AI 自己跑 ML 实验:Karpathy 的 autoresearch 项目上手教程

Andrej Karpathy 开源的 autoresearch 项目让 AI Agent 自动运行机器学习研究实验,涵盖从 nanoGPT 微调到超参数搜索。本文带你从安装到跑通第一个实验。

MCP Server 从零搭建:用 TypeScript 为 AI Agent 构建自定义工具生态

手把手教你搭建 MCP Server——从项目初始化、工具注册到部署运行,让 AI Agent 通过 MCP 协议调用任意外部工具

Agent Desktop:AI Agent 的跨平台桌面自动化 CLI 开源工具

一个基于 Rust 构建的桌面自动化 CLI,让 AI Agent 通过操作系统无障碍树操控任意应用,比截图方案快 10 倍且节省 78-96% 的 token

Cq:Mozilla AI 给 Agent 做了个 Stack Overflow,让 AI 不再重复踩坑

Mozilla AI 推出 Cq——一个面向 AI 编码 Agent 的 Stack Overflow,让 Agent 可以查询其他 Agent 积累的经验教训,避免重复犯同样的错误。

ProofShot:给 AI 编码 Agent 装上「眼睛」,自动验证前端 UI 的唯一工具

ProofShot 是一个开源工具,让 AI 编码 Agent 能通过截图对比自动验证自己生成的前端页面——不再需要手动刷新浏览器确认效果。

从零构建 AI Agent:工具篇

手把手教你为 AI Agent 添加工具调用能力——从 bash 执行到文件操作再到网页抓取,完整的 Python 代码示例

Gambit:为 AI Agent 构建可靠的验证闭环

一个专注于 Agent 场景评测与验证的开源框架——帮你创建测试场景、验证 Agent 行为、保存失败证据防止回归