| 中国“光筹算芯片”降维冲击英伟达GPU ?中国研究团队回应 |
文|《中国科学报》记者 赵广立
不久前,上海交通除夜学集成电路学院张文军院士团队的光筹“全光筹算芯片”最新下场在《科学》(Science)杂志在线宣布并掉落踪掉落踪编辑部Highlight重点推荐。在这篇题为《除夜局限智能语义视觉生成全光芯片》的算芯事科论文中 ,研究团队提出的片降全光除夜局限语义生成芯片“LightGen”,被认为是维冲伟达一把破解人工智能(AI)对算力黑洞般需求的钥匙 。它在某些特定使射中的击英究团筹算速度 、能效 ,研应旧比顶尖数字芯片(如英伟达A100芯片)超出超出起码2个数量级。学网

相干论文截图
对该下场 ,中国上海交通除夜学集成电路官网给以了高度评价 :LightGen为新一代算力芯片助力前沿人工智能“斥地了新路途”,光筹也为试探更高速 、算芯事科更高能效的片降生成式智能筹算“供给了新的研究标的方针”。
权力巨擘期刊背书、维冲伟达官方认证 ,击英究团媒体也纷纷予以存眷和报导,研应旧“降维冲击”“换道超车”等论调甚嚣尘上 。可是,对多么一款尚存在于论文中的芯片,它可否抵达人们对“下一代算力芯片”的预期?它在特定使射中所揭显露来的对顶尖数字芯片的“降维冲击”,可否真的兑现?
为此 ,论文作者、上海交通除夜学传授翟广涛不日领受《中国科学报》专访,并对相干疑问作出了回应。

翟广涛课题组合影
《中国科学报》 :请用深化的话,诠释一下光筹算芯片与电子芯片有何不合?
翟广涛:
可以从筹算编制的不合来邃晓。电子芯片的信息载体是电旗子记号,次要靠晶体管开体恤换来筹算,局限越除夜就越随便被功耗、迟误、发烧这些理论问题“拖住”;光筹算是把信息编码到光上,经由过程光场撒播把除夜量运算并行地筹算出来,在速度和能耗上有很强的埋伏优势。可以类比为,电芯片就像是铜线德律风传消息 ,以电旗子记号为载体;而光筹算芯片则像光纤宽带 ,速度更快 、能耗更低。
举个例子,我们的眼睛可以近似邃晓为复杂纯真的光筹算:它可以将物体的“像”从一个职位成像到视网膜上。我们研发的光筹算芯片则比这宏壮良多,经由过程光的振幅、相位、频率、偏振等搭载信息 ,完成更宏壮义务 ,如除夜局限AI和端侧高速AI筹算等 。
《中国科学报》:为甚么光芯片在AI筹算使射中,比照传统电子芯片有更除夜优势?
翟广涛:
起首,光子的物理特点,生成适配AI对筹算“高速+低耗”的需求 。光子撒播速度是光速(约3×10?m/s) ,而电子在芯片中的迁徙速度仅为光速的千分之一。AI筹算(不凡是生成义务)需求除夜量数据的传输与运算 ,光子的高速撒播能除夜幅促进“数据搬运迟误”。同时,电子在导体中行动时会因电阻而产热 ,这是电子芯片能耗高的一除夜次要启事(比如GPU运转时需求除夜型散热设备);而光子撒播过程中几近能干量破钞 。
其次,AI模型(不凡是生成式AI)的中心是“除夜局限并走运算”,比如措置512×512像素图象时 ,需求同时对几十万级像素点举办特点提取 、矩阵运算 。电子芯片受“冯?诺依曼架构”限制 ,数据需在存储器和运算器之间往来交往传输,并行度经常被硬件筹划制约 ,而光子可以“多通道自力撒播” ,可促进分批次运算,光筹算芯片的并行性相较电子芯片更具埋伏优势。
同时 ,光筹算芯片的优势,本质是“光子的物理特点与AI筹算的中心需求高度契合”——AI需求“高速并行、低能耗、高算力密度” ,而光子的“光速撒播、极低破钞 、天然并行”特点,正好精准婚配这些需求。传统电子芯片则受限于“电旗子记号传输迟误、能耗与发烧束厄狭隘、集成极限”,难以在这些维度打破 。这也是为甚么光筹算芯片能在AI筹算中揭显露数量级的功用优势的启事。
《中国科学报》 :既然光芯片在速度和能耗方面有天然优势,为何畴昔它没能在筹算芯片中“挑除夜梁” ?
翟广涛 :
这几年除夜模型和生成模型展开很快 。模型局限较着添加后 ,算力和能耗需求带来的压力就愈加较着 。传统芯片架构的功用添加快度 ,跟这类需求之间展示了更除夜的缺口,所以大年夜师最早存眷新的筹算范式 。
在这个除夜布景下,光筹算等新架构也会被几回说起。可是,传统全光筹算芯片更多勾留在小局限、分类义务;一旦引进光电级联或复用,速度会被减弱,放到宏壮生成义务上 ,就更难闪现端到端的速度和能效优势 。
换言之,此前光筹算芯片之所以未被除夜局限独霸、没能成为中默算力芯片 ,本质是三除夜瓶颈的叠加——集陋习模撑不起算力、维度改削适配不了义务、操练算法对接不上需求。这三除夜问题让光子筹算的“高速低耗”优势只能勾留在考验考验室的复杂使射中 ,没法转化为支撑除夜局限AI的理论算力 ,幻想下场只能“边沿化”,难以“挑除夜梁” 。

翟广涛
《中国科学报》 :你们团队的这项研究 ,针对你上述提到的光筹算芯片的瓶颈 ,有哪些打破?
翟广涛 :
论文的中心亮点就是同时打破下场限内三个公认的瓶颈:百万级光学神经元集成 、全光维度转换、无真值光芯片操练算法 。
我们采取高度集成的衍射超外不雅技能 ,经由过程对多层超外不雅举办纳米级深度刻蚀的筹划筹划以完成对光的精准调控 ,成功在芯片中集成了数百万个光子神经元,为生成义务需求重除夜的神经元局限问题供给了筹划。
同时 ,团队还研发出一种专为生成式光子筹算琐细量身打造的操练算法,不依托预定义真值的操练算法,措置了生成式光子芯片若何操练的问题。
《中国科学报》 :论文中提到,LightGen在端到端的筹算速度和能效上远超英伟达A100图形措置器。有不雅不雅不雅不雅不雅不雅不美不雅不雅不雅不雅念认为 ,将还没有产品化的光子芯片与成熟的GPU横向比照意义无穷 ,且如今的优胜性更多表示在幻想层面,还未能在财富中证实本身。你和团队对此作何评价?
翟广涛 :
对这类构和,我们邃晓其严谨立场。光子芯片仍处于从考验考验验证走向更成熟琐细的阶段 ,与成熟GPU举办横向斗劲时,外界更严谨是正常的 。
我们论文采取的是端到端耗时与耗能的直接测量口径:在生成质量与前沿电子神经群集邻近的同时,斗劲琐细层面的速度与能效。需求朴实的是 ,除夜局限生成式义务本身经常较慢,对端到端时延与能耗出格敏感,良多真实场景也切实其实会受这两点制约 ,是以下一代算力芯片可否有效支撑这类义务具有理论意义 。
从这个角度看 ,论文下场是在端到端口径下 ,展示了全光线路在除夜局限生成式义务上的可行性与潜力;同时也说了然若干很多若干关头难点打破对全光片上完成除夜局限生成式群集的次要意义,为下一代算力芯单方面向生成式智能筹算供给了一条可延续试探的路途。
《中国科学报》:比来几年来,光子芯片局限经常给人“雷声除夜雨点小”的印象 ,对此你若何看?
翟广涛 :
前沿标的方针在从定见走到可验证 、再到可用琐细的过程中,外界会有“雷声除夜雨点小”的忧虑,这个我们邃晓。光子芯片这条路畴昔经常被几回构和,主假定因为良多全光筹算芯片勾留在小局限 、分类义务上。面对宏壮的义务 ,光电级联或复用带来的速度能效优势丧损掉落踪落会更较着,与除夜局限生成式义务另有距离。
而像LightGen这类前瞻性的工作,打破性在于将全光芯片的合用局限拓展到了除夜局限生成式神经群集 。我们更希看用经久的视角往看它的价值 。
《中国科学报》 :LightGen措置了一个甚么层面的问题 ,它最除夜的理论意义是甚么?
翟广涛:
从近几年除夜模型的展开节拍看,模型身手延续加强,独霸也在加快走向解缆糊口 。与之相伴的是,除夜局限模型带来的端到端时延与能耗压力不竭凸显 。良多生成式义务对这两点高度敏感,经常也会是以受限。
在多么的布景下 ,学术界和财富界才会更普及地存眷下一代算力芯片 。中心诉求很了了:芯片要可以奉行真实全国需求的义务,不凡是除夜局限生成模型相干义务 。
LightGen对准的恰是这一层面——面向除夜局限生成式智能筹算给出一条新的路途,使新一代算力芯片更切近前沿人工智能的理论需求,同时为更高速 、更高能效的生成式智能筹算拓展了新的研究标的方针 。
《中国科学报》 :你们是若何想到这个措置筹划的 ?研究中最艰苦的中心是甚么 ?
翟广涛 :
早在2019年 ,我们的助理传授陈一彤(此次论文第一作者)就最早思虑若何故全光完成生成式模型,并在Science Advances宣布了国际首个全光生成式群集。思虑这个设法时,往后风行的生成式模型还没有除夜举走进群众视野,也未激起普及的存眷。

陈一彤(右)带争师长教师
在进一步鞭挞时我们创作创造 ,真正艰苦的处地址于,下一代算力芯片可否奉行真实全国所需的义务,不凡是除夜局限生成模型这类对端到端时延与能耗很敏感的义务 。
旋绕“让下一代算力光芯片支撑宏壮生成模型”这个公认艰苦,我们一步步鞭挞,幻想下场构成了全光除夜局限语义生成芯片LightGen,这也是国际初度完成的除夜局限全光生成式AI芯片 。
这个过程不是灵光一现。我们把问题拆开慢慢措置 ,先确认关头瓶颈,然后几回思虑 ,中心也踩过良多坑,末尾慢慢迭代才构成如今的下场。
《中国科学报》:与过往一些光筹算芯片比照,你们有哪些不合 ?
翟广涛 :
畴昔良多全光筹算芯片严惩法域于小局限、分类义务 ,光电级联或复用又会严重减弱光筹算速度 ,所以若何让下一代算力光芯片能运转宏壮生成模型不时是一个艰苦 。
我们这项工作则是面向真实全国所需的义务 ,将全光芯片的合用局限拓展到了除夜局限生成式神经群集 。这是业内初度完成的除夜局限全光生成式AI芯片,考验考验袒护了高分辨率(≥512×512)图象语义生成 、3D生成、高清视频生成及语义调控、往噪 、部分及全局特点迁徙等多项除夜局限生成式义务。
更关头的是,我们不是用电赞助光生成的编制 ,而是让全光芯片无缺走完输进图象 、邃晓语义、语义操控、生成全新媒体数据的端到端过程,让光具有“邃晓”和“认知”语义的身手 。
《中国科学报》:从这项下场解缆,团队将来在技能线路和产品化思路上有哪些筹算?
翟广涛:
技能上,我们会延续沿着新一代算力芯片这条主线鞭挞,旋绕除夜局限模型相干义务在端到端时延与能耗上的真实需求上延续深切。我们认为 ,LightGen有看率先在内容花费流程中完成独霸,照及时预览 、极速出图等最“吃”算力且最需务及时回响的环节。
财富化层面 ,我们已与财富界合作展开独霸幻想,后续将延续与财富方密吻合作 ,使研究更严密对接真实需求 。
演习生张昊睿对本文亦有供献
相干论文信息:
science.org/doi/10.1126/science.adv7434
出格声明 :本文转载仅仅是出于撒播信息的需求 ,真实不虞味着代表本网站不雅不雅不雅不雅不雅不雅不美不雅不雅不雅不雅念或证实其内容的真实性;如其他媒体、网站或小我从本网站转载独霸 ,须保管本网站注明的“本源” ,并自卑大年夜大年夜大年夜版权等功令义务;作者假定不盼看被转载或联络转载稿费等义务,请与我们联络 。