0

0

电子科技大学“网络与分布式系统”实验室连续在计算机系统结构CCF A类会议和期刊发表论文

爱谁谁

爱谁谁

发布时间:2025-01-04 14:32:31

|

1042人浏览过

|

来源于php中文网

原创

电子科技大学计算机科学与工程学院(网络空间安全学院)“网络与分布式系统”实验室科研团队取得重大突破,两篇论文分别被计算机体系结构领域顶级会议ppopp和期刊tpds录用,电子科技大学均为第一单位和通讯单位。

PPoPP 2025录用论文:GPU架构下三对角化性能优化

由2023级博士生王瀚生领衔的论文“Improving Tridiagonalization Performance on GPU Architectures”被PPoPP 2025收录。该论文针对矩阵特征值分解中耗时最长的三对角化步骤,深入分析了现有算法(如cuSOLVER和MAGMA库)在英伟达H100 GPU上的性能瓶颈,发现其主要在于矩阵秩2k更新和Bulge Chasing。

论文创新性地提出了双分块算法,显著提升了矩阵秩2k更新效率,达到硬件峰值性能的70%以上,远超传统单分块算法的30%。同时,论文还充分挖掘了Bulge Chasing的并行性,通过高效的CUDA算子实现,性能提升高达12.5倍,推翻了此前Bulge Chasing难以GPU加速的论断。最终,该算法在三对角化和整体特征值分解上分别实现了10.1倍和6.1倍的性能提升。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

电子科技大学“网络与分布式系统”实验室连续在计算机系统结构CCF A类会议和期刊发表论文

PPoPP(ACM SIGPLAN Symposium on Principles and Practice of Parallel Programming)是计算机体系结构领域CCF A类会议,2025年仅录用38篇论文,王瀚生团队的论文是近五年西南地区唯一一篇被PPoPP录用的论文。该论文将于2025年3月1日至5日在拉斯维加斯进行宣讲。

电子科技大学“网络与分布式系统”实验室连续在计算机系统结构CCF A类会议和期刊发表论文

TPDS录用论文:基于Tensor Cores的高性能Householder QR分解

笔启AI论文
笔启AI论文

专业高质量、低查重,免费论文大纲,在线AI生成原创论文,AI辅助生成论文的神器!

下载

另一篇由2022级硕士生冷玉含为第一作者的论文“High Performance Householder QR Factorization On Emerging GPU Architectures Using Tensor Cores”被TPDS录用。该论文针对英伟达Tensor Cores硬件单元,提出了一种针对不同精度(FP16、FP32、FP64)的Householder QR分解优化方法。

论文针对高瘦矩阵的计算效率瓶颈,采用内部二次分块计算,优化矩阵形状,提升计算访存比。同时,该算法在保证高性能的同时,有效降低了QR分解中的正交性损失。与cuSOLVER库相比,该算法在A100和RTX GeForce 3090 GPU上实现了最高8.67倍的加速比。

电子科技大学“网络与分布式系统”实验室连续在计算机系统结构CCF A类会议和期刊发表论文

TPDS(IEEE Transactions on Parallel and Distributed Systems)是IEEE主办的并行与分布式计算领域顶级期刊,为中国科学院/JCR一区和CCF A类期刊。

这两项研究成果标志着电子科技大学在高性能计算领域取得了显著进展,为未来高性能计算应用提供了新的思路和方法。

相关专题

更多
什么是分布式
什么是分布式

分布式是一种计算和数据处理的方式,将计算任务或数据分散到多个计算机或节点中进行处理。本专题为大家提供分布式相关的文章、下载、课程内容,供大家免费下载体验。

323

2023.08.11

分布式和微服务的区别
分布式和微服务的区别

分布式和微服务的区别在定义和概念、设计思想、粒度和复杂性、服务边界和自治性、技术栈和部署方式等。本专题为大家提供分布式和微服务相关的文章、下载、课程内容,供大家免费下载体验。

231

2023.10.07

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

399

2023.08.14

PHP 高并发与性能优化
PHP 高并发与性能优化

本专题聚焦 PHP 在高并发场景下的性能优化与系统调优,内容涵盖 Nginx 与 PHP-FPM 优化、Opcode 缓存、Redis/Memcached 应用、异步任务队列、数据库优化、代码性能分析与瓶颈排查。通过实战案例(如高并发接口优化、缓存系统设计、秒杀活动实现),帮助学习者掌握 构建高性能PHP后端系统的核心能力。

98

2025.10.16

PHP 数据库操作与性能优化
PHP 数据库操作与性能优化

本专题聚焦于PHP在数据库开发中的核心应用,详细讲解PDO与MySQLi的使用方法、预处理语句、事务控制与安全防注入策略。同时深入分析SQL查询优化、索引设计、慢查询排查等性能提升手段。通过实战案例帮助开发者构建高效、安全、可扩展的PHP数据库应用系统。

72

2025.11.13

JavaScript 性能优化与前端调优
JavaScript 性能优化与前端调优

本专题系统讲解 JavaScript 性能优化的核心技术,涵盖页面加载优化、异步编程、内存管理、事件代理、代码分割、懒加载、浏览器缓存机制等。通过多个实际项目示例,帮助开发者掌握 如何通过前端调优提升网站性能,减少加载时间,提高用户体验与页面响应速度。

25

2025.12.30

Java 项目构建与依赖管理(Maven / Gradle)
Java 项目构建与依赖管理(Maven / Gradle)

本专题系统讲解 Java 项目构建与依赖管理的完整体系,重点覆盖 Maven 与 Gradle 的核心概念、项目生命周期、依赖冲突解决、多模块项目管理、构建加速与版本发布规范。通过真实项目结构示例,帮助学习者掌握 从零搭建、维护到发布 Java 工程的标准化流程,提升在实际团队开发中的工程能力与协作效率。

10

2026.01.12

c++主流开发框架汇总
c++主流开发框架汇总

本专题整合了c++开发框架推荐,阅读专题下面的文章了解更多详细内容。

102

2026.01.09

c++框架学习教程汇总
c++框架学习教程汇总

本专题整合了c++框架学习教程汇总,阅读专题下面的文章了解更多详细内容。

60

2026.01.09

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PostgreSQL 教程
PostgreSQL 教程

共48课时 | 7万人学习

Django 教程
Django 教程

共28课时 | 3万人学习

Bootstrap 5教程
Bootstrap 5教程

共46课时 | 2.9万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号