最新文章
最新发表
不依赖任何框架,用 Node.js + Ollama 从零搭出 AI Agent 的最小骨架:一个 REPL 循环、一次模型调用、一个工具。理解了这个循环,所有 Agent 框架都不再神秘。
一个花了 4 个月开发的 Rust LSP 替代实现,通过'冻结分析结果'的核心设计,目标是让语言服务器在合理规模项目上的内存占用压到 100MB 以下,还能免重索引热重启。
一个安全研究员发现 e164.arpa 电话网络基础设施的域名过期无人续费,花 5 欧元买下后控制了三个地区的通话路由 DNS,意外记录了数十万条打给军事基地的电话查询。
DeepSeek-V4-Flash-Vision-Exp 上线:纯文本模型现在能看图了。三种传图方式、单图最多 384 token 的计价规则、48MiB 请求上限等关键参数一次说清。
一位开发者用 eBay 二手服务器 + Coolify + Forgejo + Hermes 搭出完全自托管的 AI 开发流水线:一条提示词就能让 AI 自动完成建仓库、写代码、跑 CI、部署上线全流程,成本只有每月 20 英镑的 Codex 订阅。
Red Hat 工程师用 Llama 3.1 8B 在单张 H200 上实测了两个主流推理引擎:64 并发下 vLLM 吞吐是 llama.cpp 的 44 倍,但 llama.cpp 在消费级硬件上依然是唯一选择。本文把量化、GGUF、PagedAttention、连续批处理讲清楚,附完整选型决策树。
Proliferate 是一个开源 AI IDE:在同一个工作区里并行运行 Claude Code、Codex、OpenCode、Cursor、Grok 等任意编码 Agent,每个任务有独立的 git worktree、终端和审查状态,还支持完整的自托管部署。
一位工程师发现自己读不进去同事发来的文档——因为它们都带着明显的 AI 痕迹。他的大脑被训练成了 AI 内容过滤器:扫一眼就知道是 AI 写的,然后直接忽略。本应提高生产力的 AI,正在以意想不到的方式拖慢协作。
一个 125M 参数的小模型如何在 iPhone 上实时续写钢琴演奏?作者复盘了 MIDI 表示设计、数据清洗、scheduled sampling、DPO 的全过程,以及一堆被验证无效的弯路。
云服务器、邮件、分析、监控、支付、认证、CDN——独立开发者在验证想法阶段,能不能把整条基础设施的月成本压到 10 欧元以内?这篇指南给出了逐项对比和推荐。
断网也能用的编程 Agent:用 llama.cpp 在 Mac 上跑 Gemma 4 26B,配合 MTP 投机解码把生成速度从 58 提到 72 token/s,再接上支持图片输入的 Pi 终端 Agent。
GoModel 是一个用 Go 写的 AI 网关/代理,统一 OpenAI 和 Anthropic 兼容 API,内置缓存、成本追踪、预算限额、智能路由、故障转移和实时日志。作为 LiteLLM 的替代品,它的性能和多 Provider 支持值得一试。