最新文章


最新发表


从零构建 AI Agent:先写一个最小的"读-想-做"循环(Node.js 实战)

不依赖任何框架,用 Node.js + Ollama 从零搭出 AI Agent 的最小骨架:一个 REPL 循环、一次模型调用、一个工具。理解了这个循环,所有 Agent 框架都不再神秘。

Rust Glancer:把 Rust 语言服务器的内存压到 100MB 以下,rust-analyzer 之外的轻量选择

一个花了 4 个月开发的 Rust LSP 替代实现,通过'冻结分析结果'的核心设计,目标是让语言服务器在合理规模项目上的内存占用压到 100MB 以下,还能免重索引热重启。

我花 5 欧元买了个过期域名,意外接管了三个地区的电话网络

一个安全研究员发现 e164.arpa 电话网络基础设施的域名过期无人续费,花 5 欧元买下后控制了三个地区的通话路由 DNS,意外记录了数十万条打给军事基地的电话查询。

DeepSeek 终于开放视觉:V4-Flash-Vision 模型怎么用、贵不贵、能做什么

DeepSeek-V4-Flash-Vision-Exp 上线:纯文本模型现在能看图了。三种传图方式、单图最多 384 token 的计价规则、48MiB 请求上限等关键参数一次说清。

一条提示词跑完整个开发流程:20 英镑/月搭出的全自动 AI 软件工厂

一位开发者用 eBay 二手服务器 + Coolify + Forgejo + Hermes 搭出完全自托管的 AI 开发流水线:一条提示词就能让 AI 自动完成建仓库、写代码、跑 CI、部署上线全流程,成本只有每月 20 英镑的 Codex 订阅。

llama.cpp 还是 vLLM?2026 年本地 LLM 推理引擎选型指南(附实测基准)

Red Hat 工程师用 Llama 3.1 8B 在单张 H200 上实测了两个主流推理引擎:64 并发下 vLLM 吞吐是 llama.cpp 的 44 倍,但 llama.cpp 在消费级硬件上依然是唯一选择。本文把量化、GGUF、PagedAttention、连续批处理讲清楚,附完整选型决策树。

Proliferate:让 Claude Code、Codex、OpenCode 并行干活的生产级开源 AI IDE

Proliferate 是一个开源 AI IDE:在同一个工作区里并行运行 Claude Code、Codex、OpenCode、Cursor、Grok 等任意编码 Agent,每个任务有独立的 git worktree、终端和审查状态,还支持完整的自托管部署。

我正在变成 AI 盲:当大脑学会自动忽略 AI 写的文档

一位工程师发现自己读不进去同事发来的文档——因为它们都带着明显的 AI 痕迹。他的大脑被训练成了 AI 内容过滤器:扫一眼就知道是 AI 写的,然后直接忽略。本应提高生产力的 AI,正在以意想不到的方式拖慢协作。

给钢琴接上 AI 自动续写:125M 参数模型从数据清洗到 DPO 的完整实录

一个 125M 参数的小模型如何在 iPhone 上实时续写钢琴演奏?作者复盘了 MIDI 表示设计、数据清洗、scheduled sampling、DPO 的全过程,以及一堆被验证无效的弯路。

独立开发者的省钱方案:月租不到 10 欧元的全欧盟技术栈

云服务器、邮件、分析、监控、支付、认证、CDN——独立开发者在验证想法阶段,能不能把整条基础设施的月成本压到 10 欧元以内?这篇指南给出了逐项对比和推荐。

在 Mac 上搭建本地编程 Agent:llama.cpp + Gemma 4 + MTP 投机解码完整指南

断网也能用的编程 Agent:用 llama.cpp 在 Mac 上跑 Gemma 4 26B,配合 MTP 投机解码把生成速度从 58 提到 72 token/s,再接上支持图片输入的 Pi 终端 Agent。

GoModel:用 Go 写的高性能开源 AI 网关,LiteLLM 的轻量替代

GoModel 是一个用 Go 写的 AI 网关/代理,统一 OpenAI 和 Anthropic 兼容 API,内置缓存、成本追踪、预算限额、智能路由、故障转移和实时日志。作为 LiteLLM 的替代品,它的性能和多 Provider 支持值得一试。