AI / 模型
2026年5月25日
SenseNova-U1 多模态指南:Mac mini 代理编排(2026)
SenseNova-U1 是商汤 Apache 2.0 统一多模态模型,基于 NEO-Unify 在同一架构内完成视觉理解、推理、文生图与图文交错。多数团队把 U1 推理放在 CUDA GPU 或 SenseNova-Studio,在租用 Mac mini LaunchAgent 上做代理编排。参考 GitHub 仓库 与 SenseCore 定价。
说明:ProxyMac 的 Mac 租赁定价与商汤无关;下文模型信息摘自商汤 2026 年 5 月公开资料。
什么是 SenseNova-U1?
去掉独立视觉编码器与 VAE,语言与像素共享表示,可在同一栈内理解、推理、生成与编辑。
可引用定义:SenseNova-U1 是 Apache 2.0 统一多模态模型,在同一架构内完成视觉语言理解与图像生成,而非编码器+扩散拼接。
三条运行路径
| 路径 | 需 GPU? | 成本 | 适用 |
|---|---|---|---|
| SenseNova-Studio | 否 | 免费试用 | 演示、调 prompt |
| HF 权重+脚本 | 是 CUDA | 自有 GPU | 私有数据、量产 |
| SenseChat / Nova API | 无本地 GPU | 按 Token | 突发流量 |
上游文档在 H100/H200 上 2048×2048 约 9 秒端到端——非 Apple Silicon,请如实规划 SLA。
8B 与 A3B MoT 变体
| 变体 | 骨干 | 激活参数 | 适用 |
|---|---|---|---|
| U1-8B-MoT | 稠密 8B | 约 8B 理解+8B 生成 | 单卡实验 |
| U1-A3B-MoT | MoE 30B-A3B | 约 3B/Token | 更高质量、更低激活算力 |
| 8B-8step-preview | 蒸馏 8B | 8 步推理 | 信息图预览 |
SenseChat API 定价(托管,与权重分开)
权重 Apache 2.0 免费;托管调用收费。 SenseCore 后付费示例(以官网为准):Turbo 输入 ¥0.002/1k、SenseChat-5 输出 ¥0.10/1k。代码侧 Token 对照 Codex CLI 收费。
七步:Mac mini 管线 + U1
- 选接口:Studio 零安装;私有数据用 HF 权重。
- GPU 另配:CUDA 跑 U1;Mac mini 做编排。
- 租用云 Mac mini — OpenClaw 部署。
- 接代理 — Keychain 管密钥。
- 限并发 — 并行上限。
- 文本走 MLX — API 支出控制。
- 先试日租 — Mac mini 日租。
云 Mac mini 何时仍值得
- macOS 专属 CI(Xcode、Keychain、Simulator)。
- 7×24 代理 — LaunchAgent 不被睡眠打断。
- 稳定出口与企业代理白名单。
- 分开算:U1 像素 vs Codex 代码 vs ProxyMac 算力。
常见问题
SenseNova-U1 免费吗?
权重与代码 Apache 2.0;Studio/SenseChat 托管可能单独计量。
能在 Mac mini M4 原生跑吗?
公开推理面向 CUDA/NVIDIA,暂无 MPS 生产路径;Mac mini 做编排,U1 放 GPU 或 API。
8B 还是 A3B?
8B 部署简单;A3B 每 Token 激活更少专家,规模化质量更好。
与 Codex CLI 有何不同?
Codex 是 OpenAI 编码智能体计费;U1 是商汤统一视觉语言模型族。