← 返回论文列表 📄 下载原文 PDF  ISSCC 2025 · 16.2
ISSCC 2025Session 16 · HIGHLIGHTED CHIP RELEASES: DIGITAL AND MACHINE LEARNING PROCESSORSAI / ML5nm

RNGD: A 5nm Tensor-Contraction Processor for Power-Efficient Inference on Large Language Models

⚡ 本页包含 AI 生成的分析内容,仅供参考

📋 论文概要

本文提出了一款面向大语言模型(LLM)推理的5nm张量收缩处理器RNGD,通过结合高内存带宽与高密度计算,实现了显著的能效提升。该芯片旨在解决LLM推理中计算密集与功耗高昂的矛盾,提供低功耗的加速方案。

💡 主要创新点

工艺节点
5nm
重要性
发表年份
ISSCC 2025

🏷 关键词

大语言模型张量收缩处理器低功耗推理

📄 原文摘要

Byeongwook Bae1, Yojung Cha1, Wooyoung Choe1, Jonguk Choi1, Younggeun Choi1, Ki Jin Han2, Seokha Hwang1, Kiseok Jang1, Jaewoo Jeon1, Hyunmin Jeong1, Yeonsu Jung1, Hyewon Kim1, Sewon Kim1, Suhyung Kim1, Won Kim1, Yongseung Kim1, Youngsik Kim1, Hyukdong Kwon1, Jeong Ki Lee1, Juyun Lee1, Kyungjae Lee1, Seokho Lee1, Minwoo Noh1, Junyoung Park1, Jimin Seo1, June Paik1 FuriosaAI, Seoul, Korea Dongguk University, Seoul, Korea 1 2 There is a need for an AI accelerator optimized for large language models (LLMs) that combines high memory bandwidth and dense compute power while minimizing power consumption. Traditional architectures [1-4] typically map tensor contractions, which is the core computational task in machine learning models, onto matrix multiplication units. However, this approach often falls short in fully leveraging the parallelism and data locality inherent in tensor contractions. In this work, tensor contraction is used as a primitive instead

👥 作者与机构

Sang Min Lee1, Hanjoon Kim1, Jeseung Yeon1, Minho Kim1, Changjae Park1,

分类:AI / ML · 年份:ISSCC 2025