30000+ 条结果
-
Shared Memory 与矩阵乘法分块优化实验_使用shared memory 优化全局内存-CSDN博客
Michael阿明
michael.blog.csdn.net › article › details › 160904614
文章浏览阅读484次,点赞6次,收藏10次。本文围绕 CUDA 矩阵乘法中的 Shared Memory 优化展开,通过 Naive 矩阵乘法与 Shared Memory Tiled 矩阵乘法的对比实验,分析不同TILE大小对kernel 性能的影响。实验基于 Tesla T4,测试矩阵规模包括TILE包括8、16、32、64。结果表明,Shared Memory 在大多数有效配置下能够明显加速矩阵乘法。_使用shared memor…
-
基于智能状态检测的超音速旋流净化系统_天津大学
云上高博会
www.heecshop.cn › school › science-project › 1725.html
摘要 超音速旋流净化技术是湿烟气经超音速分离器绝热膨胀至超音速,降温50-100℃后,其中夹带的水蒸汽、SOx与溶解性盐、凝胶粉尘、微尘等成分发生非均质凝结后予以分离的一种新型气体净化技术,脱除效率最高可达90%,能够高效地实现烟气脱白。该技术同时借助多传感器融合方法智能诊断和动态测量流场数据,优化烟气“脱白”过程,必要时辅以高压微雾增强技术,强化分离净化效果。相较于传统的电磁法、烟气加热法、烟气…
-
ICLR'25 Spotlight | 少样本场景下的分子性质预测任务新解_DAMO开发者矩阵-DAMO开发者矩阵
DAMO开发者矩阵
damodev.csdn.net › 692fea30791c233193d22417.html
作者|李瑞凤,浙江大学博士生 【ICLR 2025预讲会】系列内容 ICLR 2025预讲会系列文章来源于 DAMO 开发者矩阵与 AI Time 联合举办 ICLR 2025预讲会整理成稿,旨在帮助大家率先了解深度学习领域的最新研究方向和成果。本文为文章作者的观点/研究数据,仅供参考,不代表本账号的观点和研究内容,版权归分享人所有。 摘要 分子性质预测是药物研发工作中非常重要且基础的任务。当前的 DAMO开发者矩阵 DAMO开发者矩阵
-
什么是 Chrome Finch 实验? | Web Platform | Chrome for Developers
Chrome 开发者版
developer.chrome.com › docs › web-platform › chrome-finch
了解 Chrome 如何安全地发布新功能。
-
什么是 Chrome Finch 实验? | Web Platform | Chrome for Developers
Chrome 开发者版
developer.chrome.google.cn › docs › web-platform › chrome-finch
了解 Chrome 如何安全地发布新功能。
-
AI Coding Token 效率分析:从大盘指标到自动优化 | 阿里云可观测
Aliyun sls.aliyun.com › doc › ai_coding › token_efficiency.html
阿里云可观测案例中心
-
浅谈一下 近期状况 | 天空的小窝
天空的小窝
blog.baka233.top › archives › qian-tan-yi-xia
写这篇文章没什么 就是想要聊一下近期的状况 生物实验考试 --让我最懵逼的一次实验考试 我们学校的生物基本都停留在表面,很少真动手实践。平时见到的显微镜,不是像清朝老视频里那样古董级,就是初一
-
团队可持续发展-GMTC北京2023 专题
Infoq
gmtc.infoq.cn › 2023 › beijing › track › 1314
GMTC北京2023 专题:团队可持续发展。作为一个 Leader,你要为项目结果负责,也要为团队成员的成长负责。在行业人才竞争加剧的情况下,如何找到靠谱的人,为团队注入新血?管理是科学,也是哲学。
-
需求挖掘广告-全新AI赋能广告系列 | 易歌课堂
品牌建站
www.yige-tech.com › article › xingyezixun_128.html
什么是需求挖掘广告?通过AI赋能覆盖30亿用户,优化转化与流量!了解更多广告策略,立即咨询易歌科技!
-
DeepSeek-V3.2-Exp 发布,训练推理提效,API 同步降价 | DeepSeek API Docs
DeepSeek 文档
api-docs.deepseek.com › zh-cn › news › news250929
今天,我们正式发布 DeepSeek-V3.2-Exp 模型,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,V3.2-Exp 在 V3.1-Terminus 的基础上引入了 DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行了探索性的优化和验证。