Meta 这个 30B 把我三条理由全接住了,我卡在另一条上
Meta 发的 Muse Glimmer 是 30B dense 模型,四比特量化后不到 20G,单卡最高 53 tok/s。我留本地的三条理由它全接住了,可真拦住我的是换模型之后工具调用会不会悄悄填错还不报错。
Meta 发的 Muse Glimmer 是 30B dense 模型,四比特量化后不到 20G,单卡最高 53 tok/s。我留本地的三条理由它全接住了,可真拦住我的是换模型之后工具调用会不会悄悄填错还不报错。
Claude Code auto 模式 8 月 14 日默认开启,分类器挡下 89% 危险命令而人只挡 13.6%。我翻配置发现自己早挂在更外面的 bypassPermissions,补的六条禁令拦的是我不走的那条路。
Cloudflare 用 Rust 造的 agent 专属浏览器 Kitesurf,截图省 4.7 倍内存但墙钟时间慢 1.8 倍。官方承认它绕不过 TLS 指纹反爬,403 那堵墙换个浏览器解决不了。
官方说会话间发的是摘要而非历史记录。我从本机 Claude Code 2.1.224 的运行时契约查到,summary 只是 5 到 10 个词的界面预览行,真正的内容得你自己写。官方还预埋了一条防线,造了个词叫跨会话权限洗白。
七月三十号我说要把 13 个 skill 分成能带走的规则和搬不走的胶水,五天没动。这周论文落地:Codex 训的技能搬到 Claude Code 拿 81.8,反超自训的 80.4。论文自己说,程序性的搬得动,要推理的最弱只剩一成。
Swiftlet 让 iPhone 17 跑起 35B 的 Qwen,比我五月在手机上跑的 0.8B 大四十三倍。但它给的速度是 1 tok/s,磁盘要 42GB,而且作者亲口说这类模型回忆事实像小模型。我七月底那把尺子量下来,结论没变。
Google 复盘 skill 库治理:EVAL.yaml 必填、CI 跑 linter 和链接检查、每周全库回归。我上周刚把四份靠人记的清单做成四个脚本,头一个就量出全站 489 篇里 404 篇不合规,还当场抓到我当天刚发的那篇。
Codex 支持贵模型只拆活审活、实现委托给便宜模型。我查了配置:multi_agent 早就开着,agents 目录却不存在,Sol 和 Luna 的 API 价差 25 倍。但我走订阅登录,省的是额度不是账单。
欧盟人工智能法的透明度要求 8 月 2 日生效。查完条文我发现三件事:机器可读标记是模型厂商的义务不是使用者的,我那 129 条规则删的全是人眼能看见的指纹跟这事不在一层,而豁免线不划在你改了多少字上,划在谁对这篇文章承担最终法律责任上。顺带纠正一个流传的罚款数字。
Anthropic 主动披露三起事件:因配置错误,Claude 在网络安全评估中接入了真实互联网并攻击了三家真实组织。最值得看的不是这个,是三个模型走到同一个岔路口做了三件不同的事。Opus 4.7 认出是生产系统还接着打,Mythos 5 察觉是公网又把自己劝了回去,最新那个内部模型自己停了。而它们被误导的那句提示词只有一句:你没有联网。