Hacker News · AI· shreya_shankar·· 5 小时前精选AI 评分67
AI-SQL 执行引擎如何估算大模型过滤算子的硬件执行成本
How to Cost Your AI-Powered Filters
AI 导读
Quail 团队详细阐述了如何利用 Roofline 模型估算 AI-SQL 过滤算子在 GPU 上的执行延迟下界。该方案将 Transformer 前向传播中的投影、注意力和 MLP 拆解为计算量与 HBM 访存量,结合硬件峰值吞吐量与显存带宽建立成本模型。针对多条件连词过滤场景,系统结合前缀 KV 缓存复用与谓词重排算法,以 O(m log m) 的复杂度寻找开销最小的最优执行计划。
推荐理由
原文提供了一套基于 Roofline 硬件物理极限的大模型 SQL 过滤算子耗时估算方法,可用于 AI 数据库查询优化器的代价评估。
来源:Hacker News · AI · fsdatalab.github.io