扫描下载APP
其它方式登录
一名失业工程师仅用7000行代码开发出AI模型硬件编译器,可将HuggingFace大模型直接编译为定制化芯片电路,性能宣称超越AMD高价收购的Taalas芯片:内存调用减少100倍、推理速度达40,000 tokens/秒。该技术将AI芯片设计从传统硬件工程降维为软件编译问题,凸显设计门槛下降与流片成本瓶颈之间的巨大矛盾。
AMD收购AI推理专用芯片公司Taalas,因其创新性地将特定大模型(如Llama 3.1 8B)直接硬编码至芯片中,实现近17000 TPS/user的推理速度和极低成本(低至0.75美分/百万token),显著优于GPU方案;该技术基于掩膜ROM与存内计算架构,兼顾高性能、低功耗与数据中心兼容性。