论文发表

† 表示由我指导的学生;* 表示共同第一作者;# 表示通讯作者。

2026

  1. Accepted [MICRO'26] Chenyu Zhang† ,  Chenxi Xu† ,  Jiaxiang Zou† ,  Yonghao Chen† ,  and  Xinyu Chen #
    SCOPE: Array-Native Nonlinear Acceleration for LLM Inference via Shape-Constrained Neural Approximation
    The 59th IEEE/ACM International Symposium on Microarchitecture (MICRO), 2026
  2. Accepted [MICRO'26] Rui Meng† ,  Yonghao Chen† ,  Jiaxiang Zou† ,  Jingyu Guo† ,  Chenyu Zhang† ,  and  Xinyu Chen #
    MFNNS: A Multiplier-Free Near-Memory Accelerator for Graph-based ANNS
    The 59th IEEE/ACM International Symposium on Microarchitecture (MICRO), 2026
  3. Accepted [MICRO'26] Chenyu Zhang† ,  Chenxi Xu† ,  Jiaxiang Zou† ,  Jingyu Guo† ,  Rui Meng† ,  and  Xinyu Chen #
    Ultra-DSP: A Universal Lossless DSP Overpacking Framework for Low-Bit LLM Inference
    The 59th IEEE/ACM International Symposium on Microarchitecture (MICRO), 2026
  4. Accepted [MICRO'26] Afzal Ahmad ,  Gaoyu Mao ,  Shoubo Hu ,  Hui-Ling Zhen ,  Mingxuan Yuan ,  Xinyu Chen ,  and  Wei Zhang
    Sparse by Command: Task-Conditional Compute Skipping for Multi-Task Inference Accelerators
    The 59th IEEE/ACM International Symposium on Microarchitecture (MICRO), 2026
  5. Accepted [MICRO'26] Hongshi Tan ,  Yao Chen ,  Xinyu Chen ,  Qizhen Zhang ,  Weng-Fai Wong ,  and  Bingsheng He
    RidgeBridge: Random Access Optimized Interconnect Architecture for Scalable Graph Random Walks
    The 59th IEEE/ACM International Symposium on Microarchitecture (MICRO), 2026
  6. [ISCA'26] Yonghao Chen†* ,  Jiaxiang Zou†* ,  Xingyu Chen† ,  Chenxi Xu† ,  Jingyu Guo† ,  and  Xinyu Chen #
    UniCore: A Bit-Width Scalable GEMM Unit for Unified LLM Inference
    International Symposium on Computer Architecture (ISCA), 2026
  7. [ICML'26] Jiaxiang Zou† ,  Yonghao Chen† ,  Ruilong WU ,  and  Xinyu Chen #
    MixFP4: Extending NVFP4 to Mixed Micro-Format via Scale-Bit Reuse and Tensor Core Co-design
    International Conference on Machine Learning (ICML), 2026
  8. [IPDPS'26] Bi Zeng†* ,  Zhenlin Wu†* ,  Hongyuan Liu ,  and  Xinyu Chen #
    DSTREE: Data-Driven Synchronous Traversals for Decision Forests on GPUs
    IEEE International Parallel and Distributed Processing Symposium (IPDPS), 2026
  9. [HPCA'26] Hongshi Tan ,  Yao Chen ,  Xinyu Chen ,  Qizhen Zhang ,  Cheng Chen ,  Weng-Fai Wong ,  and  Bingsheng He
    RidgeWalker: Perfectly Pipelined Graph Random Walks on FPGAs
    IEEE International Symposium on High Performance Computer Architecture (HPCA), 2026

2025

  1. [MICRO'25] Jiaxiang Zou†* ,  Yonghao Chen†* ,  Xingyu Chen† ,  Chenxi Xu† ,  and  Xinyu Chen #
    AxCore: A Quantization-Aware Approximate GEMM Unit for LLM Inference
    IEEE/ACM International Symposium on Microarchitecture (MICRO), 2025
  2. [MICRO'25] Chenxi Xu† ,  Tianhui Shi ,  Shixuan Sun ,  Jidong Zhai ,  and  Xinyu Chen #
    X-SET: An Efficient Graph Pattern Matching Accelerator With Order-Aware Parallel Intersection Units
    IEEE/ACM International Symposium on Microarchitecture (MICRO), 2025
  3. [ICCAD'25] Huangxu Chen† ,  Yingbo Hao ,  Yi Zou ,  and  Xinyu Chen #
    OA-LAMA: An Outlier-Adaptive LLM Inference Accelerator with Memory-Aligned Mixed-Precision Group Quantization
    IEEE/ACM International Conference on Computer-Aided Design (ICCAD), 2025
  4. [TACO'25] Zhenlin Wu† ,  Tianao Ge ,  Jiajia Li ,  Xinyu Chen ,  and  Hongyuan Liu
    Advancing Matrix Operations for High-Performance and Memory-Efficient Automata Processing on GPUs
    ACM Transactions on Architecture and Code Optimization (TACO), 2025
  5. [LCTES'25] Xinmiao Zhang ,  Zheng Feng ,  Shengwen Liang ,  Xinyu Chen ,  Lei Zhang ,  and  Cheng Liu
    Graphitron: A Domain Specific Language for FPGA-Based Graph Processing Accelerator Generation
    ACM SIGPLAN/SIGBED International Conference on Languages, Compilers, and Tools for Embedded Systems (LCTES), 2025
  6. [APNet'25] Ruilong WU ,  Xinjiao Li ,  Yisu Wang ,  Xinyu Chen ,  and  Dirk Kutscher
    Rethinking Dynamic Networks and Heterogeneous Computing with Automatic Parallelization
    The 9th Asia-Pacific Workshop on Networking (APNet), 2025
  7. [DAC'25] Yonghao Chen† ,  Jiaxiang Zou† ,  and  Xinyu Chen #
    April: Accuracy-Improved Floating-Point Approximation For Neural Network Accelerators
    ACM/IEEE Design Automation Conference (DAC), 2025
  8. [SIGMOD'25] Feng Yu ,  Hongshi Tan ,  Xinyu Chen ,  Yao Chen ,  Bingsheng He ,  and  Weng-Fai Wong
    Clementi: Efficient Load Balancing and Communication Overlap for Multi-FPGA Graph Processing
    Proceedings of the ACM on Management of Data (SIGMOD), 2025

2023

  1. [SIGMOD'23] Hongshi Tan ,  Xinyu Chen ,  Yao Chen ,  Bingsheng He ,  and  Weng-Fai Wong
    LightRW: FPGA Accelerated Graph Dynamic Random Walks
    Proceedings of the ACM on Management of Data (SIGMOD), 2023

2022

  1. [MICRO'22] Xinyu Chen ,  Yao Chen ,  Feng Cheng ,  Hongshi Tan ,  Bingsheng He ,  and  Weng-Fai Wong
    ReGraph: Scaling Graph Processing on HBM-enabled FPGAs with Heterogeneous Pipelines
    IEEE/ACM International Symposium on Microarchitecture (MICRO), 2022
  2. [TRETS'22] Xinyu Chen ,  Feng Cheng ,  Hongshi Tan ,  Yao Chen ,  Bingsheng He ,  Weng-Fai Wong ,  and  Deming Chen
    ThunderGP: Resource-efficient graph processing framework on FPGAs with HLS
    ACM Transactions on Reconfigurable Technology and Systems (TRETS), 2022

2021

  1. [FPGA'21] Xinyu Chen ,  Hongshi Tan ,  Yao Chen ,  Bingsheng He ,  Weng-Fai Wong ,  and  Deming Chen
    ThunderGP: HLS-based graph processing framework on FPGAs
    ACM/SIGDA International Symposium on Field-Programmable Gate Arrays (FPGA), 2021
  2. [DAC'21] Xinyu Chen ,  Hongshi Tan ,  Yao Chen ,  Bingsheng He ,  Weng-Fai Wong ,  and  Deming Chen
    Skew-oblivious data routing for data intensive applications on FPGAs with HLS
    ACM/IEEE Design Automation Conference (DAC), 2021
  3. [SC'21] Hongshi Tan ,  Xinyu Chen ,  Yao Chen ,  Bingsheng He ,  and  Weng-Fai Wong
    ThundeRiNG: generating multiple independent random number sequences on FPGAs
    ACM International Conference on Supercomputing (SC), 2021

2020

  1. [CIDR'20] Xinyu Chen ,  Yao Chen ,  Ronak Bajaj ,  Jiong He ,  Bingsheng He ,  Weng-Fai Wong ,  and  Deming Chen
    Is FPGA useful for hash joins?
    Conference on Innovative Data Systems Research (CIDR), 2020
  2. [VLDB'20] Husong Liu ,  Shengliang Lu ,  Xinyu Chen ,  and  Bingsheng He
    G3: when graph neural networks meet parallel graph processing systems on GPUs
    Proceedings of the VLDB Endowment (VLDB), 2020

2019

  1. [CIKM'19] Xuntao Cheng ,  Bingsheng He ,  Eric Lo ,  Wei Wang ,  Shengliang Lu ,  and  Xinyu Chen
    Deploying hash tables on die-stacked high bandwidth memory
    International Conference on Information and Knowledge Management (CIKM), 2019
  2. [FPL'19] Xinyu Chen ,  Ronak Bajaj ,  Yao Chen ,  Jiong He ,  Bingsheng He ,  Weng-Fai Wong ,  and  Deming Chen
    On-the-fly parallel data shuffling for graph processing on OpenCL-based FPGAs
    International Conference on Field Programmable Logic and Applications (FPL), 2019
  3. [JCST'19] Chuang-Yi Gui ,  Long Zheng ,  Bingsheng He ,  Cheng Liu ,  Xinyu Chen ,  Xiao-Fei Liao ,  and  Hai Jin
    A survey on graph processing accelerators: Challenges and opportunities
    Journal of Computer Science and Technology, 2019
  4. [FPT'19] Cheng Liu ,  Xinyu Chen ,  Bingsheng He ,  Xiaofei Liao ,  Ying Wang ,  and  Lei Zhang
    OBFS: OpenCL based BFS optimizations on software programmable FPGAs
    International Conference on Field-Programmable Technology (FPT), 2019