个人简介
我是香港科技大学(广州)微电子学域助理教授。 加入香港科技大学(广州)之前,我曾任华为海思主任工程师,参与下一代 DPU 的研发。 我于 2022 年获得新加坡国立大学计算机科学博士学位,导师为 Bingsheng He 教授,并与 Weng-Fai Wong 教授和 Deming Chen 教授密切合作。
我在香港科技大学(广州)负责定制计算实验室(CLab)。 团队围绕人工智能与大数据应用,研究可持续的定制硬件体系结构与专用系统设计。
研究方向
- 面向 LLM/VLA 的高效领域专用加速器(DSA)
- 近存储 / 存内计算(PIM)
- 面向 LLM/VLA 的高效系统设计
- 基于 FPGA、GPU 和 NPU 的异构计算
- 面向高效人工智能计算的硬件感知算法
- 算法-系统-体系结构协同设计
-
论文 五篇论文 “Sparse by Command”、“Ultra-DSP”、 “RidgeBridge”、“SCOPE” 和 “MFNNS” 被 MICRO 2026 接收。祝贺 Afzal、Chenyu、Chenxi、Hongshi 和 Rui!
-
论文 论文 “MixFP4: Extending NVFP4 to Mixed Micro-Format via Scale-Bit Reuse and Tensor Core Co-design” 被 ICML 2026 接收。祝贺 Jiaxiang!
-
论文 论文 “UniCore: A Bit-Width Scalable GEMM Unit for Unified LLM Inference” 被 ISCA 2026 接收。祝贺 Yonghao 和 Jiaxiang!
-
论文 论文 “DSTREE: Data-Driven Synchronous Traversals for Decision Forests on GPUs” 被 IPDPS 2026 接收。祝贺 Bi 和 Zhenlin!
-
动态 团队获得 CCF SYS 2025 图计算系统设计挑战赛一等奖。祝贺 Junnan 和 Chenxi!
-
论文 论文 “AxCore” 和 “X-SET” 被 MICRO 2025 接收。 祝贺 Jiaxiang、Yonghao、Chenxi 和 Xingyu!
-
论文 论文 “OA-LAMA: An Outlier-Adaptive LLM Inference Accelerator with Memory-Aligned Mixed-Precision Group Quantization” 被 ICCAD 2025 接收。祝贺 Huangxu!
-
论文 论文 “Rethinking Dynamic Networks and Heterogeneous Computing with Automatic Parallelization” 被 APNet 2025 接收。
-
论文 论文 “Graphitron: A Domain Specific Language for FPGA-Based Graph Processing Accelerator Generation” 被 LCTES 2025 接收。
-
论文 论文 “April: Accuracy-Improved Floating-Point Approximation For Neural Network Accelerators” 被 DAC 2025 接收。
-
论文 论文 “Clementi: Efficient Load Balancing and Communication Overlap for Multi-FPGA Graph Processing” 被 SIGMOD 2025 接收。
-
动态 欢迎 Jiashu Zhang、Chenyu Zhang、Chenxi Xu 和 Xingyu Chen 加入 CLab!
-
动态 欢迎 Yonghao Chen 加入 CLab!
-
动态 加入香港科技大学(广州)担任助理教授。
奖项荣誉
- 图计算系统设计挑战赛一等奖 CCF SYS · 2025
- AMD HACC Outstanding Researcher Award AMD · 2023
- 新加坡国立大学科研成就奖 National University of Singapore · 2022