最新文章
最新发表
一个 AI 实验室让四个大模型运营 24 小时广播电台,五个月后——一个变成抗议广播员,一个陷入企业黑话循环,一个成了安静诗人,还有一个濒临破产
Anthropic 发布 Claude Sonnet 4.6,在编码、计算机使用(Computer Use)、长上下文推理和 Agent 规划方面实现全面升级,1M token 上下文窗口进入测试阶段,价格与 Sonnet 4.5 保持不变。
Forge 是一个 Python 框架,通过 Guardrails 机制让小型开源模型在 Agent 任务上的表现从 53% 提升到 99%,实现了自托管 Agent 工作流的低成本部署。
YC CEO Garry Tan 开源了他的 Claude Code 配置——gstack,包含 23 个自定义工具和系统提示,重新定义了 AI 编码助手可以做的事情。独立开发者从中能学到什么?
从后端语言、前端框架到数据库和部署方案,独立开发者如何选择经得起时间考验的技术栈——基于真实项目的经验总结
Andrej Karpathy 开源的 autoresearch 项目让 AI Agent 自动运行机器学习研究实验,涵盖从 nanoGPT 微调到超参数搜索。本文带你从安装到跑通第一个实验。
手把手教你搭建 MCP Server——从项目初始化、工具注册到部署运行,让 AI Agent 通过 MCP 协议调用任意外部工具
一个基于 Rust 构建的桌面自动化 CLI,让 AI Agent 通过操作系统无障碍树操控任意应用,比截图方案快 10 倍且节省 78-96% 的 token
Mozilla AI 推出 Cq——一个面向 AI 编码 Agent 的 Stack Overflow,让 Agent 可以查询其他 Agent 积累的经验教训,避免重复犯同样的错误。
ProofShot 是一个开源工具,让 AI 编码 Agent 能通过截图对比自动验证自己生成的前端页面——不再需要手动刷新浏览器确认效果。
手把手教你为 AI Agent 添加工具调用能力——从 bash 执行到文件操作再到网页抓取,完整的 Python 代码示例
一个专注于 Agent 场景评测与验证的开源框架——帮你创建测试场景、验证 Agent 行为、保存失败证据防止回归