Close

Session

Event Type
Research Manuscript
TimeMonday, July 2712:30pm - 1:00pm PDT
LocationMtg Room 102
Topics
AI
Tracks
DES5. Emerging Device and Interconnect Technologies
Tags
AI4-I. AI/ML Architecture Design; EDA
EDA5. RTL/Logic Level and High-level Synthesis; Security
SEC1. AI/ML Security/Privacy; AI
AI1. AI/ML Frontiers for Hardware Design; Design
DES2A. In-memory and Near-memory Computing Circuits; EDA
EDA3. Timing Analysis and Optimization; Design
Presentations
12:30pm - 12:30pm PDTFusedot: A Multiplication-Fused Dot Product Accelerator for Efficient LLM Inference
12:30pm - 12:30pm PDTCHiRM-DSE: CodeLLM-Based Hierarchical and Rule-Mining Guided DSE for FPGA Accelerators
12:30pm - 12:31pm PDTSecurerouter: Encrypted Routing for Efficient Secure Inference
12:31pm - 12:31pm PDTShortcircuit: Alphazero-Driven Generative Circuit Design
12:31pm - 12:32pm PDTS2CIM: A Secure-Computation and Secure-Storage Compute-in-Memory Architecture with Circuit-Algorithm Co-Design for Efficient and Trustworthy Edge Inference
12:32pm - 12:32pm PDTPath-Based Timing Analysis Acceleration via Segment-Level Timing Arc Reuse
12:32pm - 12:33pm PDTMETRIC: An MDS-Analog ECC with Minimum Two-Column Redundancy for Fault-Tolerant, Layer-Aware IMC Architecture
12:33pm - 12:33pm PDTTDH-GNN: An Efficient Topology-Driven Accelerator for Dynamic Heterogeneous GNN
12:33pm - 12:34pm PDTIntegrating LLMs into a Two-Tier Traditional Methodology for Automated Verilog Code Generation
12:34pm - 12:34pm PDTTT-SEAL: TTD-Aware Selective Encryption for Adversarially-Robust and Low-Latency Edge AI
12:34pm - 12:35pm PDTBeyond Flat Netlist: Hierarchical Graph Representation Learning for Scalable Analysis of Sequential Circuits
12:35pm - 12:35pm PDTHYPER-CIM: Hierarchical Predictive Exploration and Realizable Design Flow for High-Efficient Digital CIM
12:35pm - 12:36pm PDTDisentangled Differentiable Timing-Power Co-Optimization with Quad-Gradient Gate Sizing
12:36pm - 12:36pm PDTSTEM-CAM: Segmented Thermometer-Encoded Multibit CAM with Wildcard Matching for Efficient Arbitrary-Order Minkowski Distance Metrics
12:36pm - 12:37pm PDTMASQ: Accelerating Masked Diffusion via Stage-Wise Multi-Precision Quantization
12:37pm - 12:37pm PDTLLM-Based Automatic Architecture Optimization for AI Model HLS Implementation on FPGA
12:37pm - 12:38pm PDTFBS: Accelerating CNN Inference over RNS-CKKS with Fewer Bootstrapping Sparsity
12:38pm - 12:38pm PDTCapbench: A Multi-PDK Dataset for Machine-Learning-Based Post-Layout Capacitance Extraction
12:38pm - 12:39pm PDTNoisexplore: A Device-Aware Hierarchical Noise Modeling and DTCO Framework for Analog In-Pixel Computing Architectures
12:39pm - 12:39pm PDTRTL-3D: Timing-Aware Tier Partitioning for 3D ICs Using Pre-Synthesis Timing Analysis
12:39pm - 12:40pm PDTJsplace: A Shape-Controllable and Length-Matching Placement for Rapid Single-Flux-Quantum Circuits
12:40pm - 12:40pm PDTTAG: A Topology-Aware Architecture for Configurable and Memory-Efficient GNN Acceleration
12:40pm - 12:40pm PDTInsights from Verification: Training a Verilog Generation LLM Using Reinforcement Learning with Testbench Feedback
12:40pm - 12:41pm PDTRuntime-ADAR: Runtime Anomaly Detection and Attack Recovery in Encrypted DNNs
12:41pm - 12:41pm PDTTOPCELL: Topology Optimization of Standard Cell via LLMs
12:41pm - 12:42pm PDTDIA-CIM: A Dynamic Iterative Aggregation Graph Neural Network and Its Hardware Co-Design for Energy-Efficient Graph Processing
12:42pm - 12:42pm PDTPowerpath: Internal-Probe-Free Search Interval Reduction for Efficient Statistical Sequential Constraint Characterization
12:42pm - 12:43pm PDTGwrite: Offloading Replication in Disaggregated Memory Systems
12:43pm - 12:43pm PDTFlorella: Accelerating Graph Neural Networks by Sliding Reduction Convention and Flexible Architecture
12:43pm - 12:44pm PDTUnlocking Automated Datapath Gating via Machine Learning Power Prediction
12:44pm - 12:44pm PDTHolocode: Hybrid Optical-Electronic Edge Encoding for Privacy-Preserving Cloud Training
12:44pm - 12:45pm PDTNeural Domain Decomposition for Scalable Multi-Physics: Chip-Scale Thermal-Stress Analysis
12:45pm - 12:45pm PDTNASiC: 3D NAND-Based CAM-Selected Multibit CIM Architecture for Efficient On-Device Mixture-of-Experts LLM Inference
12:45pm - 12:46pm PDTRTL-Sequencer: Towards Scalable RTL Timing Prediction with the Sequence-Based Paradigm
12:46pm - 12:46pm PDTRememtier: Rethinking Memory Tiering for CXL-Based SSD via Large Granularity Memory Access
12:46pm - 12:47pm PDTAMBER: A Unified Accelerator for Multi-Precision LLM Inference Exploiting Bit-Level Redundancy and Reconfigurability
12:47pm - 12:47pm PDTSoberdse: Sample-Efficient Design Space Exploration via Learning-Based Algorithm Selection
12:47pm - 12:48pm PDTPLONK-Hammer:breaking Input Privacy of PLONK Proving Systems via Rowhammer
12:48pm - 12:48pm PDTCircuitdiff: Bridging Netlist Knowledge with RTL Based on Graph Denoising Diffusion
12:48pm - 12:49pm PDTKCD-CAM: A K-Nearest-Neighbor Accelerator Based on Charge-Domain Content-Addressable-Memory for Point Cloud Processing
12:49pm - 12:49pm PDTiPCL-M: Pre-Training of Chip Layout for Metrics Evaluation and Optimization
12:49pm - 12:50pm PDTTierANNS: Scalable Graph-Based ANNS with CXL-Enabled Tiered Data Placement
12:50pm - 12:50pm PDTDSPE: An Energy-Efficient Edge Processor for Deepseek Inference with Merkletree-Based Incremental Pruning, Multi-Stage Boothing Lookup and Dynamic Adaptive Posit Processing
12:50pm - 12:50pm PDTEfficient HLS Accelerator Floorplan on Multi-Die FPGA Aided by Graph Neural Networks
12:50pm - 12:51pm PDTMACH: Memory-Aware Configuration Generation for Homomorphically Encrypted Neural Networks
12:51pm - 12:51pm PDTXsearch: Exploring Microarchitecture Design Space Through Bayesian Optimization and Cross Evaluation on Multi-Fidelity Simulators
12:51pm - 12:52pm PDTProbabilistic Memory Design for Efficient Trustworthy Edge Intelligence
12:52pm - 12:52pm PDTWarp-STAR: High-Performance, Differentiable GPU-Accelerated Static Timing Analysis Through Warp-Oriented Parallel Orchestration
12:52pm - 12:53pm PDTDesign Technology Co-Optimization for Network on Chip in High Performance CPUs at 3nm Node Using Monolithic 3D and Backside Interconnect Technologies
12:53pm - 12:53pm PDTFSGen: Agile Fused and Sparse Accelerator Generator with Accurate Power Model for LLM Applications
12:53pm - 12:54pm PDTB-Flex: Exploration of Broader Flip-Flop Design Space Based on FSM Exhaustive Search
12:54pm - 12:54pm PDTIcarus's Wings: Disabling MoE Offloading Acceleration via a Universal Hidden Prefix Attack
12:54pm - 12:55pm PDTWeak-Form Physics-Informed Neural Network for Self-Supervised Learning in Semiconductor Device Simulation
12:55pm - 12:55pm PDTREPAIR: Reliability Enhancement of NVM FPGAs Through Lifetime-Aware Differential Partial Reconfiguration
12:55pm - 12:56pm PDTPG-GNN: Physics-Guided Graph Neural Network for Cell Timing Library Characterization
12:56pm - 12:56pm PDTLightningfno: Ultra-Fast Modeling and Inverse Design for Photonic Matrix-Vector Multiplication Computing Units
12:56pm - 12:57pm PDTDM-MARK: Software and Hardware Co-Design of Watermarking Accelerator for Authorized Diffusion Model Usage on Edge Devices
12:57pm - 12:57pm PDTHierarchical Boundary Recovery: Overcoming Synthesis Obscurity via SAT Sweeping
12:57pm - 12:58pm PDTMulti‑GPU Tensor‑Level Fusion and Adaptive Memory Management for Private Inference
12:58pm - 12:58pm PDTFrom Fluid Dynamics to Chip Design: PDE Foundation Model Address Data Bottleneck in 3D-ICs Thermal Simulation
12:58pm - 12:59pm PDTDRCA: Reliable Bitwise Logic in DRAM via Dual-Rail Compute and Access
12:59pm - 12:59pm PDTCrosstalk Timing Prediction via Graph Prompt Learning in Aggressor-Victim RC Networks
12:59pm - 1:00pm PDTHyperwafer: Communication-Aware Sparse Matrix Multiplication on Wafer-Scale Chips