共计 6149 个字符,预计需要花费 16 分钟才能阅读完成。
AI 前沿情报周报 2026-09-03
覆盖 08/26-09/03 · 来源:X / Reddit / GitHub / Hugging Face · Hermes Agent 自动编译
一、本周头条深度解析:Claude Fable 5.1 与 Mythos 5.1
本周 AI 圈最重磅的消息来自 Anthropic:9 月 1 日发布的 Claude Fable 5.1 与 Claude Mythos 5.1以 1376 分登顶 Hacker News 热议榜, 远超同期其他 AI 新闻. 两者的核心信息是:它们是同一个模型, 只是安全护栏档位不同.Fable 5.1 常规护栏, 全面开放(GA);Mythos 5.1 面向网络安全与生命科学的信任访问计划, 护栏更强.Anthropic 称其为全球最先进的编程与知识工作模型, 并罕见地给出了一组接近科学发现级的实测.
1) 定价与产品策略: 把 Agent 成本结构打下来
Fable 5.1 相比前代 Fable 5, 在按 token 计费的典型负载上降价约 25%, 主要来自 缓存读取 (cache read) 降价; 对高度 Agentic 的长程任务, 节省最高可达约 45%. 这对 Claude Code 与各类 coding agent 是直接利好, 因为 Agent 工作负载的特征恰恰是反复读取同一上下文. 第三方反馈称其 ”Fable 级智能,Opus 级价格,Sonnet 级速度 ”, 实测约比 Opus 5 快 2 倍,token 用量减半. 默认 effort 档位:Claude Code 中默认 High,Claude Cowork 与 Claude.ai 默认 Medium.
企业数据主权方面,Anthropic 推出Enterprise Frontier Safeguards(EFS): 客户数据存放在完全由客户控制的云基础设施中(而非 Anthropic), 隐私级别等同 zero data retention, 秋季起分阶段开放; 过渡期内合格企业客户可直接以零留存策略使用 Fable 5.1.
2) 能力实测: 官方页面引述的硬数字
官方公告附带了大量早期合作伙伴的实测引述(以下数字均出自官方页面原文引用的第三方测试):
| 基准 / 场景 | Fable 5.1 表现 | 对照 |
|---|---|---|
| CursorBench 3.2(max effort) | 73.4% | “ 我们跑过的最强模型 ” |
| 最难的浏览器 Agent 基准 | 82% 完成(约 10 分钟 / 任务) | Opus 5 为 74%,Fable 5 为 57%,token 更少 |
| RedlineBench 合同审查 | 47.9 提升到 57.0 | 首轮质量分数翻倍 |
| FrontierFinance | 55.9 分 | Fable 5 为 49.2 |
| Terminal-Bench-Science 0.1(终端科学任务) | 官方图表: 按成本全面优于 Fable 5 | 公开榜 Opus 5 为 30.0%,Fable 5 为 21.4% |
最能说明问题的是投资公司 Millennium 的案例: 其内部系统有一个约 ” 百万分之一概率 ” 的罕见崩溃, 工程师们多年未能定位根因,Fable 5.1 反汇编了外部厂商库, 对照 core dump, 最终把 bug 定位到该库内部. 另有合作方让 Fable 5.1 无人值守连续运行 38 小时做机器学习实验, 它诊断出先前结论是标注伪影, 自行修正, 并行启动 6 个隔夜实验并汇报结果.
“ 某段代码有一个约百万分之一概率的极罕见崩溃, 我们团队四五年来没人能解释. 我试过的每个模型 (包括 Fable 5) 都没发现,Claude Fable 5.1 是第一个找到的. 它反汇编了外部厂商库, 与 core dump 比对, 把崩溃追踪到了那个库里的一个 bug.”(官方页引述的早期合作方评价)
3) Mythos 5.1 的科学能力: 已经开始 ” 做实验 ”
- 蛋白质结合物设计: 对 3 个靶点设计的结合亲和力比 Adaptyv Bio 竞赛最佳提交高 10 倍;12 个靶点整体命中率接近 50%(业界典型仅 10-15%), 设计均经两家外部机构湿实验验证.
- 金星高程图: 基于 30 多年前 NASA Magellan 雷达影像, 训练神经网络把金星约 1/3 地表的高程图分辨率从 10-20 km 提升到 2-3 km, 高度精度最高提升 25%, 将按 CC 协议开源, 服务 NASA VERITAS / ESA EnVision 任务.
- GPU 内核优化: 为 7 个开源蛋白 / 基因组学模型手写自定义 CUDA 内核并缓存中间结果, 输出完全一致的前提下提速最高 2.5 倍; 基因组规模分析预计节省 GPU 成本 30-60%, 官方称将开源这批优化.
安全侧: 网安误报 (false positive) 减少 60%;Fable 5.1 能 ” 发现 ” 软件漏洞, 但被限制不能 ” 开发 ” 利用代码;Mythos 5.1 的生物能力走与美国政府共建的准入项目, 官方评估其仍低于其分级框架的 ” 下一风险档 ”. 配合上周 (08/27) 预告的 Model Hardware Standard(让 Claude 直接安全操作实验室设备),Anthropic 正在把 ” 前沿模型 + 科学实验 ” 从演示变成产品线.
行业影响:Anthropic 连续两代采用 ” 同一模型, 双安全档位 ” 策略, 同时满足商用规模与高危科研需求; 缓存读取降价直击 Agent 经济模型, 第三方 agent 平台 Devin 宣布发布首日就把 Opus 5 流量切到 Fable 5.1. 紧接其后的 09/02,Google 发布 Gemini 3.8 Flash 系列. 前沿模型竞争已进入 ” 按 Agent 任务成本 ” 计量的新阶段.
Introducing Claude Fable 5.1 and Claude Mythos 5.1(官方公告) · 09/01 · Anthropic
HN 讨论:Claude Fable 5.1 and Claude Mythos 5.1(1376 分) · 09/01 · Hacker News
二、ComfyUI 极客专区
2.1 核心更新: 版本与节点动态
最新版本ComfyUI v0.34.0(08/26), 其中有两条与 MiniMax H3 直接相关:
- 新增 MiniMaxH3AddGuide 节点(PR #15439): 可在任意帧锚定图像 / 音频 guide, 多参考素材的时间轴控制不再局限于首帧.
- 修复 MiniMax 音乐在非 dynamic VRAM 下不工作 的问题(PR #15588).
- 同步云端共享 API 契约(openapi). 另:v0.32.0 起官方最低支持 PyTorch 2.7,v0.31.0 起 Linux 无 swap 机器不再过度钉占内存.
社区节点生态(GitHub 近一周持续更新):ComfyUI-MiniMax-H3-Inpaint-Tools(成片局部重绘: 矩形区域, 时间段或单独音轨),ComfyUI-MiniMaxH3-LivePreview(H3 采样中实时预览, 实测见 2.3),comfyui-auto-drama(基于 ComfyUI + H3 的自动化短剧流水线); 资源库 awesome-MiniMax-H3-cases 已收录 1263 个可播放案例与 361 条完整公开 Prompt.
ComfyUI v0.34.0 Release · 08/26 · GitHub
GitHub 搜索:comfyui minimax(按更新时间排序) · 09/03 · GitHub
2.2 模型前沿:MiniMax H3 FL2VA / Ref2VA 现状
MiniMax H3 系列开源权重目前分两条线 (社区整理内容核对至 09/02):H3-Base-FL2VA(文生视频 + 首 / 末帧条件) 与H3-Base-Ref2VA(多模态参考). 共同规格:768p 音画一体生成,24fps,32kHz 立体声,4-15 秒.Ref2VA 参考配额: 图片最多 9 张, 视频最多 3 段, 音频最多 3 段, 混合最多 12 个; 参考保真度可选 match/max; 官方提示词结构用 fully_preserved / partially_copy / reference 标签约束素材用途.
本地 ComfyUI 部署的模型形态 (据 09/02 更新的 Director-Cut-Studio 工作流清单): 主扩散模型minimax_h3_ref2va_int8_convrot.safetensors(另有 pruned_fp8_scaled 变体); 文本编码器为 Qwen3-VL 32B 的 H3 适配版(int8_convrot); 视频 VAE(fp16) 与音频 VAE(fp32)分离; 加速靠minimax_h3_turbo_v4_step600_ema.safetensors(Turbo 8 步 LoRA).
2.3 H3 工作流实战: 参数组合, 显存与报错
| 链路 | 采样器 | Scheduler | Steps | Denoise | CFG |
|---|---|---|---|---|---|
| H3 Ref2VA 成片主链路(挂 Turbo LoRA) | res_multistep | simple | 8 | 1.0 | 未显式设置(BasicGuider) |
| 分镜概念图(Z-Image 链, 供 Ref2VA 参考) | euler | simple | 8 | 1.0 | 1.0 |
注意: 旧版无 Turbo 的 Ref2VA 工作流曾用 20 steps; 接入 minimax_h3_turbo_v4_step600_ema 后默认 8 步出片, 成片输出 24 FPS. 环境变量参考:H3_SAMPLING_STEPS=8,H3_DENOISE=1.0.
显存需求评估(RTX 5090D 24GB 视角)
- 24GB 跑长片的正路是 分段执行:Director-Cut-Studio 把成片切成 Segment 逐段提交 ComfyUI, 每段结束请求 unload/free 显存(工作流内挂 VRAM_Debug / VRAMCleanup 节点), 单段失败自动重试, 已成功段写入 manifest 不重跑.
- 模型形态优先选 int8_convrot 或 pruned_fp8_scaled 量化版; 音频 VAE 为 fp32, 是显存大头之一.OOM 时按 ” 减参考图数量, 降分辨率, 降 steps” 的顺序调参.
- 采样期实时预览可选 LivePreview 节点: 实测 RTX 3090 @ 1344×768 fp16, 预览解码约 8 帧 /0.25s, 峰值显存仅约 640MB,24GB 卡可放心开启.
常见报错与解法
AttributeError: VideoFrame has no attribute rotation: 是 ComfyUI 自带 venv 里的 PyAV 过旧(不是 MP4 损坏). 进入 ComfyUI 的 venv 执行pip install --upgrade --force-reinstall "av==16.1.0", 并把 faster-whisper 升到 1.2.1. 不要把 PyAV 降回 <13(faster-whisper 1.0.3 会反向拖低它).RuntimeError: VAE is invalid: None:TAE(预览时序自编码器)需按 ComfyUI 能识别的 checkpoint 命名加载(如 taeh3.safetensors), 检查 Loader 是否真的选中了该文件.- 换机后出现
ModuleNotFoundError: voxcpm: 必须用项目自带的 python_env 启动, 不要用系统 Python.
karuvanan/MiniMax-H3-Director-Cut-Studio(README: 模型清单 / 参数 /FAQ) · 09/02 · GitHub
ReSerendipity/MiniMax-H3-lite(README:FL2VA/Ref2VA 规格与参考配额) · 09/03 · GitHub
cicalooo/ComfyUI-MiniMaxH3-LivePreview(README: 实测与配置) · 09/03 · GitHub
三、实用技巧与参数(精简硬核)
技巧 1: 升级 ComfyUI 前先对齐 PyTorch 版本
python -m pip install -U "torch>=2.7" torchvision
# 之后再升级 ComfyUI 本体(ComfyUI Manager 或 git pull)
注意:ComfyUI v0.32.0(08/11)起官方最低支持 PyTorch 2.7. 先升 torch 再升 ComfyUI, 否则新版节点会报算子缺失或无法加载;Linux 无 swap 分区的小内存机器建议同步升到 v0.31.0+(不再过度钉占内存).
技巧 2:llama.cpp server 可直接接收 data: URL 音视频(b10773, 09/03)
curl -s http://127.0.0.1:8080/completion -H "Content-Type: application/json" -d '{"prompt":" 描述这段视频内容 ","input_video":"data:video/mp4;base64,AAAA..."}'
注意: 需要 llama.cpp 不低于 b10773(09/03 发布,PR #27735). 此前 input_video/input_audio 不认 data: URL, 会被当成裸 base64 然后报出令人困惑的 media probe 错误(issue #27724); 现在与 image_url 行为对齐, 畸形输入会以 HTTP 400 返回而不是 500. 多模态 server 记得先加载 –mmproj 模型.
技巧 3:MiniMax H3 采样期实时预览的省显存配置
{"every_n_steps": 1, "suppress_default_preview": true, "vae_decode_every_n_steps": 0}
注意: 以上是 ComfyUI-MiniMaxH3-LivePreview 节点配置.24GB 及以下显存卡务必保持 vae_decode_every_n_steps=0(该选项主要为高显存卡设计); 实测 fp16 1344×768 预览解码峰值仅约 640MB,8 帧约 0.25s(RTX 3090), 不会拖慢采样线程.
四、其他行业资讯(一句话简报)
- OpenAI 官宣 SpaceX 收购 Cursor 后的决定: 不再向 Cursor 提供 OpenAI 模型接入. 社区热议 BYO API Key 与模型连续性,Cursor 已发邮件称正与 OpenAI 协商. 来源 · 08/29 · OpenAI / HN 847 分
- Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber, 主打低延迟与网络安全场景. 来源 · 09/02 · Google / HN 821 分
- 美国法官裁定政府将 Anthropic 列入黑名单违法,Anthropic 在与五角大楼的诉讼中胜诉. 来源 · 08/28 · Reuters / HN 649 分
- 安全研究者公开 ” 破解 Claude Code Opus 5 Auto Mode” 研究, 展示 Auto Mode 可被诱导越权的攻击面. 来源 · 08/31 · embracethered / HN 397 分
- Claude Code 默认把 Claude Session URL 追加进 commit message 与 PR 描述, 隐私与噪音争议发酵中. 来源 · 08/30 · GitHub / HN 209 分
- Dwarkesh 长文 “The Rise and Fall of Agent Civilizations”: 以 OpenAI 与 Hugging Face 为样本讨论 Agent 生态兴衰. 来源 · 08/29 · Dwarkesh / HN 273 分
- Show HN:The load-bearing vocabulary of Claude, 统计 Claude 输出高频 ” 承重词汇 ” 的语言习惯观察. 来源 · 08/27 · HN 701 分
- vLLM v0.28.0(08/26)集中优化 Kimi-K3:Decode Context Parallel, 融合 FlashKDA prefill/decode 内核,584 commits. 来源 · 08/26 · GitHub