Featured image of post 27B 装进 5.95GB 之后:你的本地 Agent 该换引擎,还是该换信仰

27B 装进 5.95GB 之后:你的本地 Agent 该换引擎,还是该换信仰

Prism ML 把 Qwen3.8-27B 压成三值权重,语言塔 5.95GB、1.72 bits/weight,官方报告保住 FP16 基线 98.2% 成绩。本文拆开那 1.8% 到底卖掉了什么:数学编码几乎无损、知识类掉 5.7 分;PTQ1_0 与 PQ2_0 按硬件怎么选;以及必须绑定 llama.cpp fork 这笔供应链账该怎么算。

Featured image of post Linux 内核在给 AI Agent 写说明书:为什么你的 AGENTS.md 正在倒贴 20% 成本

Linux 内核在给 AI Agent 写说明书:为什么你的 AGENTS.md 正在倒贴 20% 成本

Linux 内核补丁提议加入 AGENTS.md,实测修复了 AI 署名违规,却引爆 token 开销争论。三篇实证研究给出裁决:这份文件是每次请求全量加载的运行时配置,写对了提速 28%,让 LLM 自动生成则亏 3% 成功率、多花 20% 成本。附进文件/进CI/进链接三分法与五分钟审计清单。

Featured image of post Opus 5.5 便宜了 40%,但你那套 Opus 5 的调用代码可能先报 400

Opus 5.5 便宜了 40%,但你那套 Opus 5 的调用代码可能先报 400

Opus 5.5 单价降 20%、官方称综合省 40%,但照 Opus 5 写的 agent 代码换模型 ID 后会撞上 4 个 400 和 1 个不报错的静默变化。这篇给一份升级前审计清单:四处硬失败的错误串与替换写法、工具旁白消失的修法、缓存读取如何决定真实降幅,以及为什么该重跑 effort 扫描而不是拉满。

Featured image of post Agent 里那些 if/else,该从 prompt 里搬出来了:不用等 Jev 的模型,一张 3090 加冻结的 4B 就能复现这套接口

Agent 里那些 if/else,该从 prompt 里搬出来了:不用等 Jev 的模型,一张 3090 加冻结的 4B 就能复现这套接口

TypeSafe 的 Jev 把「让模型判断」从生成一句话再解析,改成运行时定义 schema、直接读选项概率。24 小时内两个开源复刻证明这套接口模式用一张 3090 加冻结的 Qwen3.5-4B 就能跑:777 次判断从 2.33 提到 20.03 decisions/s。本文拆开这套接口,并给出哪些 if/else 该搬、搬到哪一层、自己跑要接受什么代价。

Featured image of post Codex 内嵌的 V8 打了 152.2.0 的标签,代码里却还锁着 150.4.0

Codex 内嵌的 V8 打了 152.2.0 的标签,代码里却还锁着 150.4.0

openai/codex 在 9 月 16 日打了一个空的 rusty_v8 152.2.0 标签,42 个产物躺在那儿,而 main 分支的 Cargo.toml 依旧写着 v8 = '=150.4.0'。真正的信号在两天前的那个 commit 里:他们关掉了 Maglev 和 Turbolev。本文拆开这条从「发布产物」到「仓库主线」的时差,给你一份 Agent 要不要内嵌真 V8 的判断清单。

(1 - 19)
Enter Press Enter to jump