AIDC
DC AI 热点

全部 AI 动态

全部语言仅中文348 条动态
来源筛选
全部来源AITNT · AI头条(网页)Buzzing HN · 中文精选C114 通信网 · AI与算力(网页)DeepSeek 公众号IDC 圈·云与算力(网页)IT168 服务器存储 · AI与算力(网页)IT之家 · AI 筛选InfoQ · 架构与云计算Solidot · AI 筛选少数派 · AI 筛选智谱 公众号月之暗面 Kimi 公众号爱范儿 · AI 筛选腾讯混元 公众号通义实验室 公众号量子位阮一峰 · AI 筛选阶跃 StepFun 公众号AI Roundup · X AI coding圈日报AWS ArchitectureAWS HPCAWS News · 云基础设施AWS 机器学习Anthropic News(RSS)Apple Machine Learning ResearchArs Technica · AI 筛选Azure Blog · 云基础设施CNCF BlogCerebras 官方博客(网页)Claude Code 更新Claude 官方博客(网页)Cloudflare Blog · 网络基础设施Data Center DynamicsData Center KnowledgeEngineering at MetaEquinix Blog · 互联基础设施Gary MarcusGitHub Blog · AI 与安全Google AIGoogle DeepMindGoogle Developers · AI 筛选Google InfrastructureGoogle ResearchHacker News · AIHugging FaceKubernetes BlogLangChain 官方博客(网页)Last Week in AILlamaIndex 官方博客(网页)MIT News · AIMIT Technology Review AIMicrosoft ResearchNVIDIA Developer BlogNVIDIA · AI 筛选Ollama 更新OpenAI 官方动态OpenStack BlogSebastian RaschkaSemiAnalysis · 算力产业ServeTheHomeSimon WillisonTechCrunch AIThe Batch · DeepLearning.AIThe DecoderThe Next PlatformThe Verge · AI 筛选Transformers 更新Transluce 研究(网页)Vertiv 官方新闻arXiv 人工智能arXiv 机器学习arXiv 自然语言处理vLLM 官方博客(网页)vLLM 更新施耐德电气博客
9月28日2026-09-28
arXiv 人工智能AI 评分 58/10012:00

用于评估可解释AI方法的合成真实基准框架

评估可解释人工智能(XAI)方法一直面临缺乏可靠评估程序及真实解释基准(ground truth)的挑战。现有评估通常仅测量解释与黑盒模型预测之间的忠实度(fidelity),但这仅量化了解释复现模型输出的程度,无法确保其真实反映底层的决策过程。为此,该研究提出了一个合成真实基准框架,旨在解决不同解释方法难以进行客观真实度评测的难题。

阅读原文 ↗推荐理由:针对XAI评测缺乏真实标注痛点提出的合成基准方案,具有一定学术参考价值,但属于常规理论探讨。# 可解释性# 评测# 前沿研究
arXiv 人工智能AI 评分 58/10012:00

基于3D结构与全原子GNN预测跨膜蛋白拓扑结构

本研究提出了一种基于图神经网络(SchNet)预测跨膜蛋白拓扑结构的新方法。与传统仅依赖蛋白序列或α-碳骨架特征的方法不同,该模型直接利用全原子级嵌入特征进行拓扑推断。在与DeepTMHMM相同的基准数据集上进行5折交叉验证,研究表明在不使用任何预训练权重的情况下,GNN在该任务上表现出良好潜力,展示了3D结构信息在蛋白拓扑预测中的应用价值。

阅读原文 ↗推荐理由:将全原子GNN应用于跨膜蛋白拓扑预测的学术探索,属于常规生物AI前沿研究论文。# 医疗AI# 前沿研究与模型架构
arXiv 人工智能AI 评分 62/10012:00

用于蛋白质扩散模型测试时对齐的谱反馈算法

针对离散扩散模型在奖励最大化对齐中主要依赖单向引导逆过程、缺乏回溯修正机制的问题,研究人员提出了 Spectral Feedback(谱反馈)算法。该方法在反馈循环中自适应选择编辑位置,利用离散扩散模型的掩码结构进行重新掩码和重采样,使模型能够在推理阶段迭代修正自身生成结果,有效提升了蛋白质设计等任务中的对齐表现。

阅读原文 ↗推荐理由:提出了一种针对蛋白质离散扩散模型的测试时迭代自纠错对齐方法,对生成生物学与推理时计算研究具有一定参考价值。# 对齐# 医疗AI# 推理# 前沿研究
arXiv 自然语言处理AI 评分 62/10012:00

基于大模型的因果感知同传语音翻译框架

大语言模型在离线翻译中表现出色,但在同传语音到语音翻译(Simul-S2ST)中,因缺乏高质量且因果对齐的跨语言说话人保真训练数据,且现有方案依赖固定策略或置信度启发式方法,导致翻译质量欠佳且延迟较高。研究团队提出了一种因果感知Simul-S2ST框架,通过新型数据流水线生成高保真、因果对齐的语音片段,以改善同传中的声音迁移和实时翻译效果。

阅读原文 ↗推荐理由:针对大模型在实时同声传译语音翻译中的因果对齐和音色保留难题提出了改进方案,属于常规前沿学术成果。# 语音# 多模态# 大模型# 自然语言处理
arXiv 自然语言处理AI 评分 62/10012:00

基于语音大模型的推理期目标说话人遗忘识别技术

该研究针对多说话人场景提出了目标说话人遗忘自动语音识别(TSU-ASR)任务,以满足特定用户不希望自身语音被转录的隐私需求。系统需转录未退出的说话人内容,同时仅标记退出者的发音区间而不转录其文本。研究团队设计了一种轻量级的注册条件门控(ECG)模块,可直接附加到冻结的双流语音大模型上,在推理阶段动态实现对新增退出说话人的选择性遗忘与转录过滤。

阅读原文 ↗推荐理由:提出了一种在语音大模型推理期实现特定说话人隐私擦除的轻量级方案,兼具隐私保护与工程实用性。# 语音# 大模型# 隐私计算
arXiv 人工智能AI 评分 68/10012:00

BioEVAL:面向生物工程领域的大语言与多模态模型评测基准

来自全球22个研究团队联合推出了BioEVAL基准,旨在评估大语言模型和多模态模型在生物工程领域的实验推理能力。该基准覆盖11个主要生物工程子领域,重点突破以往评测偏重事实召回的局限,提供达到博士水平的复杂实验与前沿任务推理评估。

阅读原文 ↗推荐理由:多机构联合打造的生物工程高难度评测基准,有助于衡量大模型在专业科研场景下的实验推理能力。# 评测# 医疗AI# 大模型# 多模态
arXiv 人工智能AI 评分 60/10012:00

Benchy:面向任务型AI基准评测的通用语义语言与执行引擎

本文提出了Benchy,一个用于AI程序基准评测的语义规范语言与执行引擎。Benchy将基准测试形式化定义为由程序、评分函数和数据集构成的三元组B=(P,S,D),实现评测套件与被测AI系统的解耦。基准采用规范YAML编写,基于共享的任务/领域本体,可确定性编译为规范JSON中间表示并由引擎执行,为任务型AI评测提供了标准化、可复现的通用基础设施。

阅读原文 ↗推荐理由:提出了一种面向AI任务评测的规范化DSL与执行引擎,对解决大模型与Agent评测碎片化及复现难题具有参考价值。# 评测# 智能体# 大模型# 开源
arXiv 自然语言处理AI 评分 62/10012:00

基于检索的长文本医疗事实核查为何失效?错误归因分类体系研究

在大模型高风险临床应用中,基于检索的事实核查已成为检测模型幻觉的主流范式。然而现有系统多依赖F1等汇总指标,遮蔽了核查失败的具体环节与原因,且传统RAG诊断往往依赖昂贵的标准答案或人工标注证据。针对长文本医疗问答的事实核查场景,该研究通过自动归纳构建了双重错误分类体系,能够细粒度剖析检索增强评估系统的具体失效模式,为提升医疗AI可解释性与评测可靠性提供了新工具。

阅读原文 ↗推荐理由:针对医疗大模型事实核查中宏观指标难以诊断具体失效环节的痛点,提出了细粒度错误分类体系,对优化医疗RAG系统评测具备参考价值。# 医疗AI# RAG# 评测# 大模型# 可解释性
arXiv 人工智能AI 评分 58/10012:00

基于教师引导排序近似的TinyML神经架构搜索框架TGL-NSGA-II

针对微型机器学习(TinyML)神经架构搜索计算开销巨大的难题,论文提出低保真度评估框架TGL-NSGA-II。该方法基于进化搜索仅需可靠比较候选模型优劣而非精确适应度值的洞察,利用预训练教师模型根据样本难度与类别进行分层抽样,再通过短周期的轻量知识蒸馏(KD-Lite)在压缩数据集上快速训练候选网络并排序评估,大幅降低了端侧资源受限环境下的搜索成本。

阅读原文 ↗推荐理由:提出利用相对排序替代绝对精度评估的TinyML架构搜索方案,为高算力消耗的进化优化算法提供了实用的降本思路。# 端侧AI# 蒸馏# 模型压缩
arXiv 人工智能AI 评分 58/10012:00

研究发现直觉式提示可提升LLM智能体模拟个体社交媒体反应的保真度

一篇arXiv预印本论文探讨了LLM智能体在模拟个体社交媒体反应时的保真度问题。研究通过问卷调查、深度访谈和书面自述对8名塞尔维亚受试者进行画像构建,记录了他们对68条社交媒体帖子的真实反应,并测试了4个语言模型预测这些反应的能力。研究指出,相比过度复杂的推理,“少思考”的直觉式提示(Intuitive Prompting)反而有助于智能体更好地契合设定画像并模拟个体社交反应。

阅读原文 ↗推荐理由:探讨大模型智能体用户画像模拟保真度的实验研究,样本量较小但对社交网络模拟与提示设计有一定参考价值。# 智能体# 大模型# 提示词工程# 评测
arXiv 自然语言处理AI 评分 62/10012:00

打破大模型同质化:通过多样化角色设定激发创意输出

针对大语言模型在开放式任务中输出趋同、易陷入“群体思维”的问题,该研究将角色多样化形式化为集合级条件生成任务。研究探讨了“角色选择与生成”及“空间填充与边界探索多样性”两个核心设计维度,提出了覆盖子集选择、均匀覆盖采样及进化角色生成等四种方法。实验表明,结构化的多样化角色设定能有效打破模型生成的单一性,显著提升发散式思考与创意任务中的输出多样性与质量。

阅读原文 ↗推荐理由:系统性研究了通过角色集合多样化打破LLM输出同质化的问题,对大模型创意激发与提示词工程具有实用参考价值。# 大模型# 提示词工程# 自然语言处理# 评测
arXiv 人工智能AI 评分 68/10012:00

HARDEN:通过约束进化搜索生成高难度且保真答案的大模型评测用例

针对现有基准测试难以反映企业实际部署复杂度的问题,研究人员提出了 HARDEN 方法。该方法利用约束进化搜索技术,在保持预期输出答案不变的前提下,沿特定领域复杂度维度对评估输入进行改造,同时严格遵循任务语义、真实性与执行有效性约束。在 FinQA、PubMedQA、ContractNLI 基准及不同规模 Qwen3.5 模型上的实验表明,该方法能有效提升评测难度并暴露模型在复杂场景下的局限性。

阅读原文 ↗推荐理由:提出了一种自动生成高难度评估样本的进化搜索方法,对大模型企业级落地评测具有一定参考价值。另有 1 家信源报道# 评测# 大模型# 自然语言处理# 合成数据
arXiv 自然语言处理AI 评分 62/10012:00

研究发现语码转换课程训练可促进小语言模型的跨语言表征对齐

一项最新学术研究探讨了语码转换(在单句中混合多种语言)对小型语言模型跨语言对齐的影响。研究人员在包含英文、荷兰文和中文的1亿词多语言语料库(基于BabyBabelLM数据集)上预训练小型Decoder-only Transformer模型,并通过大模型生成词级和句级语码转换数据。实验发现,在语码转换数据上训练能够显著对齐平行文本的特征表征,尤其是在不同文字系统之间效果明显。

阅读原文 ↗推荐理由:探索了多语言混合预训练对表征对齐的影响机制,对多语言小模型训练策略有一定参考价值。另有 1 家信源报道# 自然语言处理# 大模型# 对齐# 合成数据
arXiv 人工智能AI 评分 62/10012:00

T-RoPE:面向序列推荐的时间感知旋转位置编码

随着大语言模型架构在序列推荐中的广泛应用,原本用于文本处理的旋转位置编码(RoPE)也被引入。然而,NLP 中的 RoPE 仅基于 token 索引编码相对次序,无法反映推荐交互中实际流逝的时间、多尺度行为周期及日历相位。为此,研究人员提出 T-RoPE(时间感知 RoPE),将传统基于索引的相对位置替换为显式的时间维度建模,以增强生成式推荐模型捕捉用户随时间变化兴趣演进的能力。

阅读原文 ↗推荐理由:针对推荐系统对时间动态的高敏感度,将大模型标准 RoPE 改造成时间感知版本,对生成式推荐架构有实用参考价值。# 大模型# 时间序列
arXiv 人工智能AI 评分 63/10012:00

研究探讨音频大模型对其转录可靠性的自我感知能力

该论文研究了音频大语言模型(Audio LLMs)在输入语音严重失真时,能否识别出自身转录结果不可靠。实验发现,如果直接通过提示词让模型评估自身转录的可靠性,模型的判断表现很差,在绝大多数情况下都会盲目自信地预测转录是可靠的,这揭示了语音交互大模型在面对低质量输入时存在自我认知盲区的问题。

阅读原文 ↗推荐理由:探讨语音大模型在退化音频输入下的自我可靠性评估能力,揭示了模型过度自信的盲区,对语音对齐与可靠交互有参考价值。另有 1 家信源报道# 多模态# 语音# 大模型# 评测# 对齐
arXiv 自然语言处理AI 评分 72/10012:00

利用策略内自蒸馏实现推理能力的递归自我提升

该研究探讨了大模型推理能力的递归自我提升方法。针对传统的策略内蒸馏(OPD)依赖外部教师模型提供密集的token级监督,研究提出了策略内自蒸馏(OPSD)机制。该机制通过复制一份冻结的学生模型,并在其上下文中提供真实标签作为特权教师模型,引导仅接收问题的学生模型进行模仿学习,从而在无需更强外部教师的情况下实现模型的自主迭代强化。

阅读原文 ↗推荐理由:探索了摆脱外部强教师模型的模型自我演化与推理蒸馏路径,对LLM自训练与强化学习研究具参考价值。# 大模型# 推理# 蒸馏# 强化学习
arXiv 人工智能AI 评分 72/10012:00

思考的代价:大模型测试时推理在金融交易中划算吗?

大模型在推理阶段的“测试时思考”虽能提升决策逻辑,但其激增的算力成本能否转化为实际经济效益仍存疑。最新arXiv论文从经济学投入产出视角,对DeepSeek、GPT和Gemini系列模型展开了为期一年的受控交易实验。在固定信息、提示词和投资组合策略的前提下,研究通过调节推理算力预算,量化评估了扣除交易成本与推理开销后,长思考链能否真正带来更优的投资回报。

阅读原文 ↗推荐理由:跳出基准测试分数,从真实场景下的经济ROI和算力成本视角评估测试时推理,选题切中落地痛点。# 推理# 评测# 大模型# 金融科技# 算力
arXiv 自然语言处理AI 评分 62/10012:00

流式视频理解新基准TRACE:引入时序审计与条件感知评测框架

针对流式视频理解评估中忽视证据生效时机、视觉历史维护机制及响应触发条件等问题,研究人员提出了条件感知基准与评测框架 TRACE。该框架结合了带有时序审计的视觉任务,将证据时机与指令依赖条件显式化,从而精准区分模型在不同工作负载和运行机制下的真实表现与失败模式,为流式多模态模型提供了更严格、细致的动态评估标准。

阅读原文 ↗推荐理由:针对流式视频理解中时序与触发机制评估缺失的痛点提出了标准化基准,具有一定学术参考价值。# 多模态# 评测# 计算机视觉# 前沿研究
arXiv 人工智能AI 评分 62/10012:00

LAVOIR:通过均摊信息价值让单次前向决策编码器学会主动提问

针对“系统一”单次前向决策模型(如 Laya)在面对信息缺失时倾向于盲目猜测的问题,研究人员提出了 LAVOIR(带信息价值路由的 Laya)。该方法将候选缺失信息槽位直接置于输入端与选项并列,使得模型在单次前向传播中不仅能输出决策分布,还能同时计算每个槽位对正确决策概率的预期增益,从而教会模型在何时以及主动询问何种关键信息。

阅读原文 ↗推荐理由:针对快速决策模型在信息不全时盲猜的痛点,创新性地实现了单次前向计算信息价值增益的交互决策机制。# 前沿研究与模型架构# 推理# 自然语言处理# 大模型
arXiv 自然语言处理AI 评分 62/10012:00

面向东南亚语言的轻量图文嵌入模型SEA-CLIP-Tiny推出,参数量不足50M

针对东南亚语言多样性强但多模态数据与算力资源匮乏的问题,研究人员推出了专为该地区设计的紧凑型多模态图文嵌入模型SEA-CLIP-Tiny。该模型参数量不足5000万,采用类似CLIP-KD的知识蒸馏框架,结合区域数据整理与多语言教师模型指导,在7种东南亚语言的跨语言图文检索实验中展现出高效的嵌入表现。

阅读原文 ↗推荐理由:针对低资源语言的多模态轻量化嵌入研究,实用性较强但属于细分领域的常规学术成果。# 多模态# 计算机视觉# 自然语言处理# 蒸馏# 模型压缩
arXiv 机器学习AI 评分 62/10012:00

HybridInfer:面向端、边、云协同大模型推理的热感知强化学习分层路由

该研究探讨了端侧小模型在连续推理时面临的硬件限制。作者在旗舰骁龙设备上发现,端侧持续生成不仅会导致降温降频,还因现有工具链(移动GPU上的OpenCL内核编译与长Prompt预填充)缺陷,导致GPU运行时在连续查询后崩溃或静默卡死。为此,研究提出了HybridInfer,采用热感知的强化学习策略,在端侧、边缘和云端之间进行动态分层路由,以兼顾本地隐私、成本与系统稳定性。

阅读原文 ↗推荐理由:揭示了端侧LLM推理中移动GPU运行时崩溃的实际工程痛点,并提出了端边云动态路由解法,具备一定参考价值。# 端侧AI# 推理# 大模型# 强化学习# 芯片
arXiv 自然语言处理AI 评分 62/10012:00

基于随机引导优化串联语音对话模型的自然交互能力

在串联式端到端语音模型(如KAME架构)中,大语言模型作为异步后端,在用户说话期间向响应前端提供候选回复作为引导。然而,常规对话数据缺乏这种实时中间引导信号,若用模拟器大模型生成会带来巨大的数据准备开销。论文提出了“随机中间引导”训练方法,有效解决了全双工自然人机语音交互中的中间上下文对齐与训练成本问题。

阅读原文 ↗推荐理由:针对串联式实时语音对话大模型训练开销过大的技术痛点提出了轻量化引导方案,属于有价值的学术进展。# 语音# 大模型# 自然语言处理# 多模态
arXiv 机器学习AI 评分 58/10012:00

预条件指数为负时的优化器特性:学习率耦合与跨环境泛化研究

该研究针对自适应优化器中二阶矩估计的预条件指数展开探索。现有部分自适应方法通常研究动量更新与标准Adam平方根之间的指数设定,但该指数与全局学习率之间的耦合作用尚不明确。研究人员构建了包含稳定稀疏特征、环境相关伪稀疏特征、密集特征及高维噪声的四环境分类控制实验,覆盖21种预条件指数配置,系统分析了非常规负指数对跨环境泛化能力的影响。

阅读原文 ↗推荐理由:聚焦深度学习自适应优化算法底层机制的基础理论研究,对探索模型跨分布泛化具有一定参考价值。# 大模型# 前沿研究与模型架构
arXiv 自然语言处理AI 评分 62/10012:00

探究提示词模板在知识蒸馏安全对齐中的作用机制

已有研究表明在监督微调(SFT)阶段选择的提示词模板会显著影响模型后续安全对齐的鲁棒性,但知识蒸馏(KD)过程中模板选择对学生模型安全性的影响尚未得到充分探讨。本研究分析了教师向学生模型蒸馏时不同模板配置对既有安全对齐的作用,发现不当的聊天模板会导致原本经过指令微调且对齐的基座模型出现显著的安全对齐退化,为蒸馏过程中的安全性保持提供了新视角。

阅读原文 ↗推荐理由:探讨知识蒸馏过程中提示词模板导致安全对齐退化的微观机制,对模型蒸馏落地中的安全防御有一定工程参考价值。# 安全# 对齐# 蒸馏# 大模型# 提示词工程
arXiv 机器学习AI 评分 60/10012:00

利用离线策略评估指导自适应实验设计

该研究探讨了如何利用固定随机实验(A/B 测试)的历史数据来辅助部署基于上下文老虎机(Contextual Bandits)的自适应实验。研究提出将离线策略评估(OPE)与受控热启动模拟相结合的方法,从存在异质性处理效应的 A/B 测试日志数据中估计干扰成分,并利用双重稳健估计器对候选自适应策略进行排序与评估,从而判断自适应策略在何种条件下优于原始静态实验设计。

阅读原文 ↗推荐理由:聚焦强化学习离线策略评估在 A/B 测试自适应改造中的实际应用,方法严谨但属于常规算法优化研究。# 强化学习# 评测
arXiv 自然语言处理AI 评分 68/10012:00

I-Parakeet:在手机NPU上实现纯整型Conformer语音识别

针对现代Conformer语音识别(ASR)模型因计算敏感算子依赖浮点回退而难以充分利用端侧整数加速器的问题,研究人员提出了I-Parakeet。该工作实现了英伟达0.6B参数Parakeet-CTC模型的纯整型部署,使其能够完全运行在智能手机NPU上,无需任何浮点算子或CPU回退。核心贡献包括推导了相对位置自注意力的纯整数计算公式,为大参数量语音模型在边缘设备的高效部署提供了新路径。

阅读原文 ↗推荐理由:实现了0.6B参数Conformer ASR模型在手机NPU上的纯整型无回退部署,对端侧语音AI落地具有实用工程参考价值。# 端侧AI# 语音# 模型压缩# 推理# 芯片
arXiv 机器学习AI 评分 68/10012:00

余弦相似度并非证据:量化下可解释性迁移的底噪测量研究

该研究针对AI安全与可解释性领域的一种常见做法提出质疑:研究人员常在全精度权重上校准可解释性特征,并部署于量化模型,随后仅凭未报告底噪的尺度不变统计量(如余弦相似度、相关系数等)便宣称特征成功迁移。论文以均值差方向估计器为例,推导了由无量纲数决定的底噪基准,揭示了忽略噪声基准会导致对可解释性在量化模型中有效性的误判。

阅读原文 ↗推荐理由:指出了量化模型可解释性评估中常见的度量陷阱并提供了数学基准,对模型安全与机制可解释性研究具有扎实的参考价值。另有 1 家信源报道# 可解释性# 安全# 模型压缩# 评测# 大模型
arXiv 人工智能AI 评分 58/10012:00

ACV-Gate:面向视觉Token通信的全预算反事实推理选择性摊销框架

在有限带宽预算下的生成式图像通信中,Token选择直接决定解码后的重建质量,但准确评估每个候选Token的终端价值需反复模拟接收端重建,导致编码端计算开销巨大。为此,研究团队提出ACV-Gate自适应候选评估框架,通过学习近似全预算反事实评估,并仅对最具信息量的候选Token进行精确评估,有效平衡了传输优化与计算成本。

阅读原文 ↗推荐理由:针对语义通信与视觉Token传输开销痛点提出的算法级优化,属于细分技术领域的常规前沿研究成果。# 计算机视觉# 多模态# 模型压缩
arXiv 机器学习AI 评分 60/10012:00

理论解析:为何梯度裁剪对 AdaGrad 优化算法至关重要

该研究在广义光滑性与重尾噪声假设下分析了经典逐坐标 AdaGrad 算法。研究指出,未引入梯度裁剪的 AdaGrad 会出现“各向异性失准”问题:在重尾噪声冲击下,其自适应学习率分母容易记录罕见噪声的几何特征而非目标函数的真实局部曲率,进而导致持久的方向性失真。该理论成果为自适应优化器中梯度裁剪的必要性提供了高概率理论支撑。

阅读原文 ↗推荐理由:针对深度学习自适应优化器中梯度裁剪机制的理论分析,对大模型底层训练优化有一定理论参考价值。# 前沿研究与模型架构# 大模型
arXiv 人工智能AI 评分 62/10012:00

HCOE:基于双曲空间的生物医学语言模型临床本体嵌入

现有生物医学语言模型虽能编码文本语义,但难以显式保留医学代码的层级结构。研究团队提出HCOE(双曲临床本体嵌入)方法,将冻结的BioBERT特征映射至庞加莱球空间,结合双向本体引导的对比学习与粗细粒度本体路径聚合,有效融合了ICD疾病代码与ATC药物分类等层级关系,提升了临床概念表征的层次感知能力。

阅读原文 ↗推荐理由:提出利用双曲几何映射解决医疗语言模型缺乏代码层级结构感知的方案,具备一定垂直领域学术参考价值。# 医疗AI# 自然语言处理