原声.
6 篇深读 信源 RSS

世界太吵,来原声听播客

TechTechPotato

Ian Cutress 谈芯片与数据中心,常带一手厂商访谈

本站已深读6 / 15 集
更新节奏约 2.6 天一集
最新一集2026-08-25
分类AI / 技术
优先级T2
31:10
TechTechPotato 0825

自研芯片百倍领先?基准选择与商业筹码才是关键

OpenAI 首颗自研芯片 Jalapeno 在自选基准上把 GB200 甩开 100 倍,但那是专用芯片、专用模型、专用软件栈的结果;真正的护城河是系统集成和定价权。

8 要点 6 金句 芯片设计OpenAI
21:44
TechTechPotato 0825

下一代 Xeon 把宝押在 1.2GB 末级缓存上

Diamond Rapids 预计 2027 年发布,最高 256 个 P-core、1.2GB 末级缓存、16 通道 DDR5;用可裁剪的 compute building block 和 UCIe 互连取代 EMIB,大缓存是它对抗 AI 时代的关键。

8 要点 6 金句 CPU 架构数据中心
TechTechPotato 0823

Etched的芯片,可能解决的是带宽而不是算力

Etched用0.45伏的超低电压晶体管加跨芯片SRAM直连,把transformer焊进硬件,但主持人怀疑真正被解决的其实是带宽问题,而不是算力问题。

8 要点 8 金句 AI芯片transformer专用芯片
23:20
TechTechPotato 0819

推理速度才是新护城河:Cerebras 机架化再提速

Cerebras 的 WSE 3.5 把单芯片速度推到 4400 tok/s,CS4 机架把三片晶圆塞进 120kW 机柜。核心理由:推理要拆成 prefill 和 decode,速度才是护城河。

8 要点 7 金句 推理芯片Cerebras
30:20
TechTechPotato 0810

超大规模自研芯片:不只为省钱,更怕被 Nvidia 绑架

超大规模厂商自研芯片的真正动机不是省钱,而是控制权:避免被 Nvidia 的代际节奏绑架,同时靠规模压缩网络和计算成本。Broadcom 税比 Nvidia 税更便宜,但只有最大玩家玩得起。

8 要点 7 金句 超大规模厂商自研芯片
16:08
TechTechPotato 0806

AMD收购Talus:押注模型定制芯片的未来

AMD收购了Talus,一家为特定AI模型定制芯片、实现每秒17,000 tokens的初创公司。这标志着AI推理走向非可编程、模型专用芯片的方向。

6 要点 5 金句 AI芯片AMD