ITBEAR科技资讯
网站首页 科技资讯 财经资讯 分享好友

AMD出手收购Taalas:解锁模型刻进硅片 摆脱HBM束缚

时间:2026-08-07 09:37:40来源:快科技编辑:快讯

8月7日消息,AMD正式宣布收购AI芯片初创公司Taalas,进一步强化其在AI推理领域的战略布局。

Taalas成立于2023年,总部位于加拿大多伦多,其核心技术路线与主流GPU、Groq LPU及Cerebras晶圆级加速器等数据流架构存在本质区别。

该公司并非依赖传统的高带宽内存(HBM)存储模型权重,而是将权重直接蚀刻进硅片之中,形成模型专用集成电路。

芯片主要由两个功能区域构成:用于存储模型权重的掩膜ROM召回结构,以及用于存放KV缓存和微调适配器的SRAM召回结构。这一方案有望将推理性能提升一个数量级甚至更多。

今年2月,Taalas发布了首款测试芯片HC1,采用台积电6纳米工艺制造。初步基准测试显示,该芯片运行meta Llama 3.1 8B模型时,速度达每秒16,960个token——这一成绩在当时约为英伟达GPU的48倍、Cerebras加速器的8.5倍。

尽管Llama 3.1以当前标准已非最新模型,但该光罩尺寸芯片的主要目的在于验证技术概念的可性行。

Taalas计划于今年夏季推出第二代HC2芯片,目标将单芯片支持的参数量提升至200亿。虽然这一数值本身并不算庞大,但通过类似GPU的流水线并行方式,权重可分布在多颗加速器上协同运行。

以单芯片200亿参数计算,仅需50颗加速器即可支撑万亿参数级别的大模型,而AMD拥有机架级计算平台与内部系统设计团队,足以承接这一需求。

作为对比,英伟达近期发布的LPX系统在运行同等规模模型时,需数十颗GPU与至少2000颗Groq LPU配合,Taalas方案在空间占用与功耗效率方面具备显著优势。

据知情人士透露,AMD计划将Taalas技术芯片与Instinct系列的Helios机架配对使用,构建分离式架构:计算密集型的提示词处理由GPU负责,token生成任务则卸载至Taalas加速器。

另一种部署模式为,客户先在Instinct加速器上部署和验证模型,待效果确认后再迁移至Taalas加速器,形成类似“tick-tock”的迭代节奏。

此前,AMD在AI领域持续加码并购:2024年以6.65亿美元收购AI模型开发商Silo AI,随后以49亿美元收购服务器厂商ZT Systems,为Helios机柜产品线奠定基础;公司还收购了包括推理软件开发商MK1在内的多家AI初创企业,加速完善其AI全栈生态。

更多热门内容
科技巨头争相布局:机器人“大脑”成新风口,未来价值几何?
公司以具身智能大模型为技术原点,向本体设计、数据采集与场景应用反向延伸,形成“大模型—本体—数据”三者相互驱动的全栈闭环:大模型牵引本体架构与数据需求,本体提供物理载体与实时反馈,数据则为模型迭代提供持续养料…

2026-08-07

爆料称小米18标准版或延续左上角方形Deco设计 镜头排列有新变化
作为对比,去年发布的小米 17标准版手机便采用了左上角方形 Deco 设计,不过镜头为对称排列。小米 17 标准版为经典直屏设计,采用19.6:9 全新比例、超大 R 角设计,机身为同色玻璃镜组,搭配四微…

2026-08-07

小米8月新机亮点多:玄戒O3芯片+澎湃OS4,小米平板8S Pro价格亲民引期待
除了外观,该机还将首发小米自研的第三款Soc,玄戒O3! 其实在小智看来,目前高通的芯片涨得那么离谱,如果小米自研的玄戒O3能把成本压下来,而且性能也够劲,那么用在小米数字系列上定价也会比友商更具优势,同时也…

2026-08-07

具身智能迈向规模化交付新阶段 业界共探场景落地与产业协同新路径
“2026年,具身智能正处于产业拐点,已从技术迭代走向场景落地、从单点创新走向多元共生,全行业需要共同回答‘资本如何穿越周期、中国产业如何构筑长期竞争力’的时代命题。产业繁荣不能依靠单点突破,需要跨界共生;…

2026-08-07