Tenstorrent推出了TT-QuietBox 2(Blackhole),这是一款液冷式AI工作站,旨在完全在桌面上运行参数量高达120亿的模型。该系统结合了完全开源的软件栈和基于RISC-V的芯片,定位为无需机架、服务器机房或专用电源的万亿次浮点运算级推理平台。
推理作为主要的人工智能工作负载
QuietBox 2 的目标用户是希望直接掌控自身基础设施的开发者和组织,包括能够从编译器和运行时层面了解芯片架构的用户。它适用于实验室、办公室以及中小型企业等需要高端推理能力但又不想占用机架级空间的本地部署环境。
Tenstorrent 首席执行官 Jim Keller 将这项举措描述为旨在打造一个开放的、万亿次浮点运算级别的开发系统,该系统适用于实验室或办公环境。他强调,该平台从底层到底层,包括机械设计,都是完全开放的。Keller 拥有令人瞩目的资历,曾担任 AMD Zen、Apple A4/A5 和 Tesla 全自动驾驶芯片的架构师。
面向开发人员的预集成工作负载
QuietBox 2 附带一系列真实的工作负载,可立即部署到语言、多模态和科学领域。
对于 LLM 和编码,GPT-OSS 120B 完全在设备端运行,将一个完整的 120 亿参数模型驻留在桌面,用于私密的本地推理。Llama 3.1 70B 的运算速度为每秒 476.5 个 token,对于交互式工作负载、代码辅助和代理流水线而言,这是一个显著的数字。Qwen3-32B 被描述为一个本地编码代理,能够推理整个代码库,不受云 token 限制,为离线开发辅助和受限环境部署提供了途径。
在创意和多模态方面,Flux 负责本地图像生成,而 Wan 2.2 则提供设备端视频合成。这两种用例都将媒体资源和提示信息保留在本地,这对于有严格知识产权和数据驻留要求的团队来说极具吸引力。
该系统针对科学研究,专门针对Boltz-2等生物分子机器学习工作负载等特定模型。Tenstorrent报告称,在单个Blackhole处理器上,Boltz-2仅需49秒即可预测一个686个氨基酸的蛋白质结构,而现代CPU则需要大约45分钟。这一结果使QuietBox 2的性能与旗舰工作站GPU相媲美,同时兼顾了成本和能效。在单个系统上并行预测四个蛋白质结构的能力,使其吞吐量约为单任务运行的4倍,这对于实验室和生物技术工作流程至关重要。
对于预装目录之外的模型,Tenstorrent 的开源 AI 编译器 TT-Forge 可接受来自 PyTorch、ONNX、TensorFlow、JAX 和 PaddlePaddle 的图,并将其直接编译到硬件上。其设计原则很简单:如果一个模型可以在标准框架上运行,那么它就应该能够在 QuietBox 2 上编译和运行。
RISC-V 硅和存储器架构
在硬件层面,QuietBox 2 采用四颗 Blackhole ASIC 芯片,它们以统一的网状结构集成在一个便于携带的机箱内。这四颗芯片共提供 480 个 Tensix 核心,并声称在 BlockFP8 精度下可实现 2,654 TFLOPS 的运算能力,同时配备 128 GB GDDR6 高速内存和 256 GB DDR5 系统内存。
该架构将计算和高密度SRAM集成在单个芯片上,采用数据流方法,优先保证张量在片上内存中的高效传输。通过利用SRAM和GDDR6,该系统旨在规避传统DRAM带宽瓶颈,从而提高传统CPU和GPU平台的持续吞吐量。Tenstorrent还特意避免依赖高带宽内存(HBM);由于未使用HBM,QuietBox 2免受目前影响GPU级加速器的部分供应和价格压力的影响。
该工作站运行Ubuntu 24.04操作系统,可直接插入标准的120V电源插座,无需专用电源、机架或受控的服务器机房。这种配置使其更接近高端专业台式机,而非数据中心硬件,尽管其推理性能目标是满足机架级应用场景的需求。
从编译器到内核的开源
QuietBox 2 的核心设计理念之一是其软件栈完全开源。Tenstorrent 认为这能为需要了解和审核系统各个层级行为的团队提供全栈可见性。
TT-Forge 提供对图降阶、转换和优化流程的控制,并公开模型如何映射到底层硬件。TT-Metalium 作为底层 AI SDK,为需要调优性能或实现自定义运算符的开发人员提供内核级控制和确定性执行。TT-LLK 处理底层内核软件,扩展了对工作负载在 Tensix 内核上执行方式的可见性。
这种结构允许开发者检查从模型图到内核执行的整个流程,在硬件边界进行调试,创建或修改单个组件,并使堆栈适应特定的工作负载。对于受监管行业、主权人工智能计划以及必须记录基础设施如何管理数据和执行模型的研究机构而言,这种透明度是平台的核心组成部分,而非可选的附加功能。
QuietBox 2 预装了 Ubuntu 24.04 操作系统,以及完整的开源软件栈和 Tenstorrent 的开发环境 TT-Studio。其目标是使系统开箱即用,既可用于实验,也可用于生产级推理。
电源、散热和桌面部署
第二代 QuietBox 机箱着重提升了功耗和声学效率。Tenstorrent 公司表示,与前几代产品相比,工程改进使待机功耗和发热量降低了约 50%。这款全新的液冷机箱专为桌面环境而非专用机房而设计,可在高负载下实现安静、持续的运行。
除了硬件方面的改进,Tenstorrent 还扩展了文档和开发者工具,旨在加快系统启动速度,缩短达到可用性能所需的时间。对于中小型企业而言,单 120V 电源插座、液冷散热和预装堆栈的组合,旨在提供机架级推理能力,而无需增加服务器机房建设或 IT 人员配置。
可用性
TT-QuietBox 2 计划于 2026 年第二季度在全球范围内发售,起价为 9,999 美元。感兴趣的组织可以通过 Tenstorrent 的网站www.tenstorrent.com/waitlist/tt-quietbox加入候补名单。




Amazon