AIDC
DC AI 热点

精选

当前热点完整榜单 →
1AMD以82亿美元收购李飞飞创办的空间智能公司World Labs121 热度 ⌁2Anthropic IPO招股书曝光:营收激增但亏损巨大,计划未来投入千亿美元级算力101 热度 ⌁3英伟达推出新软硬件安全平台,旨在约束失控AI智能体93 热度 ⌁4欧盟要求开放安卓系统及搜索数据,谷歌以隐私安全为由提起上诉89 热度 ⌁5OpenAI与Anthropic高管联合Hinton等专家发文,警示AI自我改进或引发“智能爆炸”88 热度 ⌁
全部语言仅中文8 条动态
来源筛选
全部来源AITNT · AI头条(网页)Buzzing HN · 中文精选C114 通信网 · AI与算力(网页)DeepSeek 公众号IDC 圈·云与算力(网页)IT168 服务器存储 · AI与算力(网页)IT之家 · AI 筛选InfoQ · 架构与云计算Solidot · AI 筛选少数派 · AI 筛选智谱 公众号月之暗面 Kimi 公众号爱范儿 · AI 筛选腾讯混元 公众号通义实验室 公众号量子位阮一峰 · AI 筛选阶跃 StepFun 公众号AI Roundup · X AI coding圈日报AWS ArchitectureAWS HPCAWS News · 云基础设施AWS 机器学习Anthropic News(RSS)Apple Machine Learning ResearchArs Technica · AI 筛选Azure Blog · 云基础设施CNCF BlogCerebras 官方博客(网页)Claude Code 更新Claude 官方博客(网页)Cloudflare Blog · 网络基础设施Data Center DynamicsData Center KnowledgeEngineering at MetaEquinix Blog · 互联基础设施Gary MarcusGitHub Blog · AI 与安全Google AIGoogle DeepMindGoogle Developers · AI 筛选Google InfrastructureGoogle ResearchHacker News · AIHugging FaceKubernetes BlogLangChain 官方博客(网页)Last Week in AILlamaIndex 官方博客(网页)MIT News · AIMIT Technology Review AIMicrosoft ResearchNVIDIA Developer BlogNVIDIA · AI 筛选Ollama 更新OpenAI 官方动态OpenStack BlogSebastian RaschkaSemiAnalysis · 算力产业ServeTheHomeSimon WillisonTechCrunch AIThe Batch · DeepLearning.AIThe DecoderThe Next PlatformThe Verge · AI 筛选Transformers 更新Transluce 研究(网页)Vertiv 官方新闻arXiv 人工智能arXiv 机器学习arXiv 自然语言处理vLLM 官方博客(网页)vLLM 更新施耐德电气博客
7月20日2026-07-20
7月15日2026-07-15
7月6日2026-07-06
通义实验室 公众号✦ 精选规则精选14:10

🔥Fun-ASR-Realtime发布:语音识别再升级!

➡️单模型支持30种语言 + 16种方言,识别准确率全面领先☝️ 针对东亚、东南亚地区重点优化,全球多语言识别准确率取得极佳表现。 在工业级方言测评 inhouse 上,以87.8%的语义准确率大幅领先,多地方言接近人工水平。 ➡️针对复杂场景,引入上下文理解,实现语义消歧 支持在识别过程中动态注入热词与对话上下文,实现同音词、品牌名、领域词等语义消歧。 ➡️流式实时识别,与非流式语音识别一体化训练,保障流式效果 首字延迟控制在百毫秒级别,流式识别准确率接近离线水平,同时支持多语言无缝切换。 API现已上线阿里云百炼平台 欢迎体验~

6月24日2026-06-24
6月18日2026-06-18
6月16日2026-06-16
6月11日2026-06-11
通义实验室 公众号✦ 精选规则精选19:44

端侧 AI 提速 80%?如何让 Qwen3-VL 在手机起飞

原创 王召德、潘逢治 2026-06-11 19:44 浙江 当我们谈论“把大模型跑在手机上”时,速度始终是绕不开的核心问题。模型越大、参数越多,推理时的矩阵乘法运算量就越大。 随着 Arm 第二代可伸缩矩阵扩展 (SME2) 技术的普及,以及 MNN 推理引擎的深度适配,我们找到了一把打开端侧性能天花板的钥匙。只需在编译时开启一个开关,就能让 Qwen3-VL-4B 这样强大的多模态模型,在支持 SME2 的旗舰手机(如 vivo X300 等)上实现实时流畅推理。 本文,我们直接从工程落地的角度,手把手带你完成从引擎编译、模型部署到 APP 构建的完整流程,并用实测数据告诉你: 为什么这套组合拳能让 Qwen 在端侧起飞。 什么是 SME2? SME2 是 Armv9 架构中的一组高级 CPU 指令,它基于 SME 升级,核心突破在于引入了 ZA 矩阵累加器寄存器 和流式模式。传统 Neon 做矩阵乘需要手工将外积拆成向量乘再累加,而 SME2 中的 FMOPA 等指令可以一条指令完成一个矩阵 tile 的外积累加。 通过引入 SME2 指令集,Armv9 架构 CPU 能够在 AI 异构计算框架下,高效支持大语言模型推理、图像处理、自然语言处理、语音生成等实时移动端推理任务。 认识我们的工具箱 在开始实战前,我们先了解一下本次部署的核心组件: MNN : 阿里巴巴开源的端侧推理引擎,具备高性能、轻量级、高通用性的特点。支持 CNN、Transformer、LLM、扩散模型等

6月9日2026-06-09