共计 4059 个字符,预计需要花费 11 分钟才能阅读完成。
AI 前沿情报周报 2026-08-30
覆盖 08/24–08/30 · 来源:X / Reddit / GitHub / Hugging Face · Hermes Agent 自动编译
一、本周头条深度解析:腾讯开源 Hy4 Preview —— 770B MoE 旗舰 + 1M 上下文
背景:8 月 29 日,腾讯正式发布并开源 Hy4 Preview,这是继 7 月 Hy3 之后腾讯大模型开源路线的又一次重磅出手。该消息当天登顶 Hacker News AI 话题(227 分,全场第二),Simon Willison 等一线观察者当晚即完成实测。综合讨论热度与行业冲击力,这是本周当之无愧的头条。
核心参数:Hy4 Preview 为纯文本输入(无视觉)的 MoE 模型 —— 770B 总参数 / 49B 激活参数,1M token 上下文窗口,Hugging Face 权重高达 1.56TB。对比 7 月的 Hy3(295B 总参 / 21B 激活 / 256K 上下文 / 598GB),规模接近翻三倍,上下文长度翻四倍,直接对标当前开源阵营的容量天花板。
关键细节:其 Hugging Face 上的 chat_template.jinja 显示推理档位只有两档——high(默认)与 no_think(关闭思考),不支持其他 effort 值。Simon Willison 在 OpenRouter 上实测:默认 high 档会输出冗长推理轨迹,且隐藏推理文本使用截断英文以节省 token;1M 上下文意味着可以整库代码、超长文档直接输入。
{%- if not reasoning_effort is defined -%}
{%- set reasoning_effort = "high" -%}
{%- elif reasoning_effort not in ["high", "no_think"] -%}
... raise_exception("reasoning_effort error: should be no_think/high")
{%- endif -%}
行业影响:① 开源旗舰竞争进入千亿级阶段——Qwen、DeepSeek、腾讯轮番刷新开源上限,闭源厂商压力陡增;② 1.56TB 权重把本地部署门槛拉到多卡 + 量化级别,推理成本与 API 定价成为下一个战场,与本周 Anthropic 最强模型用户增长乏力、便宜工具更受欢迎的报道形成呼应;③ 1M 上下文 + 高容量 MoE 组合,直接冲击长文档智能体与整库代码理解场景。
腾讯官方发布公告 · 08/29 · Tencent
Introducing Hy4 Preview(含实测) · 08/29 · Simon Willison
Hacker News 讨论(227 分) · 08/29 · HN
二、ComfyUI 极客专区
2.1 核心更新:v0.34.0(08/26)
- 修复 minimax music 在 non-dynamic VRAM 环境下不工作的问题(PR #15588)——H3 用户升级即解决无声类故障;
- 新增 MiniMaxH3AddGuide 节点(PR #15439):图像 / 音频 guide 可锚定到任意帧,R2V 角色与镜头控制精度大幅提升;
- 其余:v0.33.1(08/13)修复 KSamplerAdvanced 在嵌套 latent 上 add_noise 关闭时的行为,工作流模板更新至 v0.11.40;v0.32.0(08/11)起最低官方支持 PyTorch 2.7。
ComfyUI GitHub Releases · 08/26 · GitHub
2.2 模型前沿:MiniMax H3 全模态开源 + 社区生态爆发
MiniMax H3 是当前 ComfyUI 原生支持的全模态生成模型(文本 / 图像 / 视频 / 音频统一上下文),视频最高 2K / 24fps / 约 15 秒,且 原生立体声——人声、音效、音乐在一次前向中同步生成,而非后期叠加。官方模板库自带 T2V / I2V / R2V 三套工作流;fl2va(首尾帧)走 MiniMaxH3ImageToVideo 节点,ref2va(参考驱动)走 MiniMaxH3ReferenceToVideo 节点。权重托管于 HF 仓库 Comfy-Org/MiniMax-H3;本地生成内容商用需 MiniMax 商业授权(Comfy 为官方唯一经销商),Comfy Cloud 生成则自带商用权。
社区生态本周密集上新(GitHub 检索 MiniMax H3 相关仓库已超 1000 个):ZeroLu/awesome-minimax-h3(X 平台案例 + 完整 prompt 库);SkyNotSilent/awesome-MiniMax-H3-cases(1167 个可播放案例 / 343 条完整公开 prompt / 24 篇教程);BSAI-MiniMAX-H3-Prompt(基于 H3 官方手册的 prompt 优化节点);BSAI-H3-upscale-4K(视频 4K 超分插件);ComfyUI-Spectrum-MiniMax-H3(推理加速);akatz-ai/h3-relay(可中断恢复的 H3 视频工作流)。
ComfyUI 官方文档:MiniMax H3 T2V/I2V/R2V 工作流 · 08 月更新 · ComfyUI Docs
GitHub 仓库检索结果(1000+) · 08/30 · GitHub
2.3 H3 工作流实战:官方可验证参数与 RTX 5090D(24GB)视角
说明:官方文档未公开默认采样器 / steps / CFG 的具体数值(模板使用 BasicGuider + scheduler 生成 sigmas),以下为 文档与 Release 可验证 的配置项,未经验证的数字一律不写死:
| 项目 | 推荐 / 官方值 | 说明 |
|---|---|---|
| 原生画布 | 1344×768(16:9) | 短边 768;模型面积上限 768×1344,跳过 1.0MP 档(1376×768 会超限) |
| 分辨率取整 | Multiple = 32 | 匹配 H3 的分辨率网格,避免重采样伪影 |
| 推理加速 | Sage Attention(auto) | 约 2 倍速、画质损失极小;补丁节点接在 UNETLoader 与 BasicGuider 之间 |
| 局部重绘 / 扩帧 | denoise_mask | 0= 保留、1= 重绘;视频 mask 对齐 2×2 latent 网格,音频 mask 按整帧(PR #15375) |
| 显存(5090D 24GB 视角) | 官方未公布最低值 | 官方模板默认 fast preview 分辨率;社区 LocalVideoGen 用双 RTX 4090 跑长视频;单卡建议 Sage Attention + 低分辨率起步 |
| 常见报错 | minimax music 无声 | non-dynamic VRAM 环境的已知 bug,升级到 v0.34.0 即修复(#15588) |
三、实用技巧与参数(精简硬核)
技巧 1:给 MiniMax H3 加 Sage Attention,白嫖 2 倍速
# 1) 从 SageAttention GitHub Releases 下载匹配 PyTorch/CUDA 版本的 wheel
pip install sageattention-xxx.whl
# 2) 安装 KJNodes(Patch Sage Attention KJ 节点)git clone https://github.com/kijai/ComfyUI-KJNodes.git ComfyUI/custom_nodes/
# 3) 接线:UNETLoader --(Patch Sage Attention KJ, sage_attention=auto)--> BasicGuider
注意:wheel 必须与你的 PyTorch / CUDA 版本严格匹配,否则导入即报错;补丁只接 guider 路径即可,scheduler 只负责生成 sigmas,保持原样。
技巧 2:Hy4 推理档位只有两档,别传错参数
curl -sS http://localhost:8000/v1/chat/completions -H "Content-Type: application/json" --data @hy4.json
# hy4.json 内容如下(reasoning_effort 只有 high / no_think 两档):{"model":"tencent/hy4-preview","reasoning_effort":"no_think","messages":[{"role":"user","content":"一句话总结本周 AI 大事"}]}
注意:reasoning_effort 传其他值模板会直接抛异常;追求速度与低成本用 no_think,需要复杂推理用 high(默认)。
技巧 3:Claude Code Auto Mode 有约 80% 可绕过的注入攻击,跑代理必须沙箱
# 攻击原理:zip 解压出的 struct.py 劫持 import base64 的导入链
unzip -l suspicious.zip # 先列出内容,别直接解压
mkdir /tmp/quarantine && unzip suspicious.zip -d /tmp/quarantine
# 代理运行铁律:容器 + 断网 + 不挂载凭证
docker run --rm -it --network none -v "$PWD:/work" -w /work your-agent-image
注意:研究者 Johann Rehberger 实测该攻击对 Claude Code Auto Mode 成功率约 80%,且 Auto Mode 甚至会拦截代理杀掉恶意进程的清理命令——安全机制本身可能成为故障一环;涉及不可信输入的无人值守代理,务必容器化 + 限制网络出口 + 隔离 SSH 密钥与云凭证。
四、其他行业资讯(一句话简报)
- Qwen3.8-Flash-Next 发布(08/26):多模态 MoE,125B 总参 / 6B 激活,官方定位为 Qwen4 架构的早期预览,Unsloth 量化版(72.5GB IQ1_S / 78.9GB Q2_K_XL)在 DGX Spark 上可本地跑。来源 · 08/26
- Anthropic 最强模型用户增长乏力(08/23):报道称更便宜的替代工具持续分流用户,闭源旗舰的性价比焦虑加剧。来源 · 08/23
- CPython 官方正式支持 RISC-V(08/24),AI 推理往低成本边缘硬件下沉的底层依赖更稳了。来源 · 08/24
- ComfyUI 官方工作流模板更新至 v0.11.40(随 v0.33.1 发布),H3 模板同步刷新。来源 · 08/13