教程

后端、跨平台、AI编程

100RSS
免费跑出 1500 token/s:Cerebras 上跑通 Qwen 3.8 27B 实操指南

免费跑出 1500 token/s:Cerebras 上跑通 Qwen 3.8 27B 实操指南

阿里开源模型 Qwen3.8-27B 本周上架 Cerebras,跑出约 1500 token/s 的速度——比本地推理快一两个数量级,输入价格每百万 token 不到 1 美元,免费层每天送 100 万 token。本文用官方文档参数,带你从注册、配 key 到跑通第一个请求,并讲清楚 reasoning 控制、图像输入和速率限制这些坑。

浏览器主线程为什么贵?一份系统的前端性能指南:拆、批、排、延、绕

浏览器主线程为什么贵?一份系统的前端性能指南:拆、批、排、延、绕

从'代码不慢,只是恰好占着主线程'出发,系统讲解浏览器主线程的运作机制与帧预算,给出五大优化策略:拆分长任务、批处理高频事件、优先级队列、延迟非必要工作,以及把工作移出主线程(合成器线程、Worker)甚至直接消除。每个策略都附代码与交互示例。

不想再交 Google Photos 月费?用 Immich 在旧电脑上自建私人照片云(Docker 完整教程)

不想再交 Google Photos 月费?用 Immich 在旧电脑上自建私人照片云(Docker 完整教程)

手把手教程:用一台闲置电脑 + Docker 部署开源的 Immich,搭一个属于自己的 Google Photos。自动备份、相册浏览、AI 人脸/物体识别都有,照片存在自己硬盘上,月费为零。含 compose.yml、.env 配置与备份方案。

48GB 内存跑 104GB 大模型:slotstream 从 SSD 流式加载专家,小内存 Mac 也能跑 Qwen3.8-Flash-Next

48GB 内存跑 104GB 大模型:slotstream 从 SSD 流式加载专家,小内存 Mac 也能跑 Qwen3.8-Flash-Next

手把手教程:用开源工具 slotstream 在内存远小于模型体积的 Mac 上运行 125B 参数的 Qwen3.8-Flash-Next(4bit 量化 104GB),从安装、下载权重到内存调优的完整实操。

扩散语言模型是怎么构建的:从 masked diffusion 到 Mercury、Gemma Diffusion 的完整路线图

扩散语言模型是怎么构建的:从 masked diffusion 到 Mercury、Gemma Diffusion 的完整路线图

一次讲透扩散语言模型:为什么自回归不是唯一出路,masked diffusion 怎么把 BERT 变成生成模型,block diffusion、remasking、蒸馏、可控生成这些模块如何拼出 Mercury、Gemma Diffusion、Nemotron 等生产级模型。

从提示词到模型部署:这套免费 Colab 笔记本把 AI 工程师技能栈讲透了

从提示词到模型部署:这套免费 Colab 笔记本把 AI 工程师技能栈讲透了

calmrocks 开源的 AI Engineer Notebooks:一套框架无关的 Colab 笔记本,从提示词、结构化输出、RAG、Agent 循环,到微调、安全、LLMOps、模型部署,完整覆盖 AI 工程师技能栈,全程跑在免费 Groq API 上,还带练习和求职用的 capstone 项目。

在 Mac 上虚拟一台 iPhone:vphone-cli 从零到开机完整教程

在 Mac 上虚拟一台 iPhone:vphone-cli 从零到开机完整教程

vphone-cli 利用苹果官方 Virtualization.framework 在 Apple Silicon Mac 上启动虚拟 iPhone,支持刷入越狱固件、SSH/VNC 连接,配合 vphone-mcp 可做 AI 驱动的自动化测试。本文从前置条件、安装、一条命令创建虚拟机,讲到手动流程拆解。

让 AI Agent 直接读你的网站:Accept: text/markdown 内容协商实战教程

让 AI Agent 直接读你的网站:Accept: text/markdown 内容协商实战教程

手把手教你把网站变成 AI Agent 友好:用 Accept: text/markdown 内容协商,让 Claude Code、Cursor 等工具直接读到干净的 Markdown。含 Caddy、Nginx、Next.js、Cloudflare 配置和验证方法。

从 2500 亿条缓存里抠出 100TB 内存:Cloudflare 的五个内存优化手法,每个都能直接抄

从 2500 亿条缓存里抠出 100TB 内存:Cloudflare 的五个内存优化手法,每个都能直接抄

Cloudflare 对 1.1.1.1 的 DNS 缓存做了 5 个存储层优化,每条目占用从 953 字节降到 420 字节,整个机群省下约 100TB 内存,缓存反而更快了。本文逐条拆解这些可复用的 Rust 内存优化技术。

RAG 没那么复杂:6 个检索方案,从最小到完整

RAG 没那么复杂:6 个检索方案,从最小到完整

大多数人的 RAG 栈都过度设计了。这篇指南给出 6 种检索方案,从纯全文搜索到全量预 embedding,每个都有明确的适用条件、成本账和权衡。

微软画图'隐形水印'逆向实录:你以为本地生成的 AI 图片,像素里藏着一个服务器下发的 GUID

微软画图'隐形水印'逆向实录:你以为本地生成的 AI 图片,像素里藏着一个服务器下发的 GUID

安全研究员逆向 Windows 自带画图和照片应用发现:即使图片在本地 NPU 生成,你的提示词也会发到微软服务器审核,返回的 GUID 会作为隐形水印嵌入图片像素。附完整检测原理和隐私含义。

把可执行文件改成 SQLite 数据库:用 SQL 查询 ELF 的一切,程序照常运行

把可执行文件改成 SQLite 数据库:用 SQL 查询 ELF 的一切,程序照常运行

SELF 格式用 SQLite 数据库替代 ELF 作为可执行文件:file 命令显示它是 SQLite 数据库,./hello 照样输出 Hello world,而 ldd、nm、readelf、strip 全部退化成一条 SQL 查询。附完整原理和实操命令。