现金巴黎人娱乐城app平台视频编解码和AI推理中存在大齐细粒度并行操作-冰球突破九五至尊(官方)下载网站IOS/安卓版/手机版APP下载
发布日期:2026-07-23 09:00    点击次数:193

7月18日至20日,第三届中国计较机学会芯片大会(CCF Chip 2026)在江苏无锡举行。会场会聚了国内芯片规模稠密两院院士与科研院所、企业的人人,运筹帷幄直指底层架构的“根底事”改动错杂。在大会展览展示区域,数据流架构视频智能AIGC芯片“金刚GC3”眩惑了很多与会者的眷注。

“金刚GC3”展览展示区域

视频智能成算力消费主力,通用架构遇结构性瓶颈

现时,视频智能正成为东谈主工智能规模增长最快的算力专揽场景。从文生视频、及时视频分析,到灵巧城市视频结构化、工业视觉质检,视频数据承载了绝大部分AI计较负载。中科通量总工程师罗鑫先容,与文本、静态图像计较不同,视频任务具备高并发码流、相连帧流式运算、编解码与AI推理深度耦合等特征,传统CPU、GPU截至流架构的适配短板握续突显。

“视频数据婉曲量极大,传统架构下数据在内存与计较单位之间常常搬运,搬运能耗相同数倍于计较自身。”罗鑫默示。此外,视频编解码和AI推理中存在大齐细粒度并行操作,但截至流架构受限于教唆窗口,难以充分挖掘教唆级并行性;而视频智能专揽对端到端延伸的明锐性,也使得截至流架构中的缓存未射中、分支推断失败等支出成为不成薄情的问题。

多位业内东谈主士以为,当视频AI从诚心诚意走向基础按次化,面向视频流式计较的规模专用架构探索,已成为业界眷注的地点之一。

数据流架构:自然契合视频场景的本事阶梯

在大会数据流计较分论坛上,数据流架构的本事阶梯激发了与会者的蛮横运筹帷幄。

CCF芯片大会数据流分论坛主席、中国科学院计较本事推断所推断员、高通量计较机推断中心主任叶笑春默示,与传统CPU、GPU革职的截至流模子不同,数据流架构遗弃了“枢纽计数器”和“固定教唆序列”的主见,其脱手革职“数据就绪即奉行”的原则:一条操作惟一当其总共输入数据准备就绪时,才会被触发奉行。这种形状下,计较节点间按数据依赖相干告成传递中间斥逐,无需反复拜谒全局内存。

“数据流架构在挖掘教唆级并行、裁汰访存支出方面具有表面上风,尤其稳健视频这类高并发、流式计较场景。”叶笑春默示。不外,也有参会不雅众现场指出,数据流架构的编译器优化、软件生态竖立以及大规模工程落地,已经需要握续错杂的课题。

国产芯片探索视频专用算力旅途

据现场展示信息,“金刚GC3”芯片由国内深耕视频智能规模的智算企业中科通量打造。该芯片基于RISC-V数据流架构,搭载12核RISC-V中枢,主频2.0GHz,单芯片AI算力达到200 TOPS(INT8)和32 TFLOPS(FP16),配备128GB LPDDR5 ECC长入内存。在视频编解码才智上,扶植H.264/H.265硬件编解码,可收尾128路1080P@30fps解码和64路编码。

“金刚GC3”芯片

“从规格来看,这颗芯片在视频AI推理任务上具备与主流GPU同台竞技的峰值才智,而128路及时解码的硬才智,在同等功耗下的视频惩办密度方面有其特色。”上海交通大学线路注解闲适文在中科通量展位现场疏导后默示。

据了解,该芯片主要面向AIGC视频生成、灵巧城市视频分析、工业坐褥视频感知等场景。在大模子惩办长视频、多模态通晓等新兴需求下,面向视频场景优化的专用芯片探索,为国产算力在细分规模的互异化发展提供了一种可能旅途。

从跟班适配到场景界说的行业趋势

在现时国外本事竞争配景下,国产算力在架构层面的改动探索受到学界眷注。有参会人人在论坛发言中指出,面向特定专揽场景的规模专用架构,是错杂通用算力能效瓶颈的困难地点之一,而视频智能恰是历练这类架构后劲的环节战场。

这次CCF芯片大会时分,多款国产芯片新品聚集亮相,反应放洋内芯片狡计正从跟班适配向场景界说转化的行业趋势。闲适文默示,“金刚GC3”的亮相,不仅是一次家具首秀现金巴黎人娱乐城app平台,更开释出一个明晰信号:在AI走向视频时间的波涛中,算力后果的最优解能够不再属于通用架构的缝补缀补,而属于从数据流动的骨子开赴、为场景量身定制的专用芯片。这也记号着中国算力产业的改动正参加架构改动的深水区,专注于细分场景的原生专用芯片,正成为下一阶段算力升级的中枢引擎。(立羽)

着手:中国钞票网