大模型
-
紫光天际发布“天衡”智能飞控与多模态AI大模型,让无人机自主决策、开放搜索
2026年5月22日,在深圳世界无人机大会(UASE 2026)现场,紫光天际(南京)科技有限公司正式发布了两项重磅技术产品——“天衡”新一代智能飞控以及面向低空场景的多模态AI大模型。两项发布标志着紫光天际在无人机“大脑”与“视觉”核心技术上实现了代际跨越,为低空经济的全场景智能化提供了坚实底座。 紫光天际
-
浪潮计算机新一代AI服务器正式发布,10U空间释放万亿参数大模型训推极限效能
当AI大模型迈入万亿参数时代,算力、能效与生态开放成为企业智能化转型的核心命题。浪潮计算机重磅推出全新一代开放加速计算服务器CS5998H3,以C86 CPU与国内BMC芯片为核心,突破性实现10U空间集成8颗开放加速模块(OAM),凭借高性能、高扩展、高能效与开放生态四大核心优势,为金融、能源、科研等行业客户提供从大
-
蚂蚁灵波开源具身大模型LingBot-VLA,推动“一脑多机”走向可规模化落地
继昨日开源高精度空间感知模型 LingBot-Depth后,蚂蚁集团旗下灵波科技今日宣布全面开源具身大模型 LingBot-VLA。作为一款面向真实机器人操作场景的“智能基座”,LingBot-VLA 实现了跨本体、跨任务泛化能力,并大幅降低后训练成本,推动“一脑多机”走向工程化落地。 在上海交通大学开源的具身评
-
昇腾赋能 TransMLA:无需重训突破架构壁垒,助力主流大模型高效适配 MLA
MLA(Multi-head Latent Attention多头潜在注意力架构)凭借低秩压缩KV缓存设计,实现长上下文推理的显存与带宽双重优化,其有效性已在 DeepSeek-V2 等模型中得到了验证。但主流预训练模型如LLaMA、Qwen千问等多基于GQA构建,企业已投入大量工程优化,复用MLA需重训,成本极高。为
-
闪迪参展CPSE2025:破解智能家居、无人机与大模型训练的存储密码
CPSE(China Public Security Expo)安防展会,作为全球领先的安防行业盛会之一,每次举办都吸引着全球数以千计的安防科技企业与行业精英。自创办以来,CPSE已成为展示最新安防技术和产品的平台,涵盖了智慧视频、智能安防、公共安全、大数据分析、人工智能等多个领域。展会吸引了来自全球的专业观众和媒体,
-
京东11.11直播技术全面升级,立影3D技术、JoyAI大模型重构沉浸式购物体验
随着京东 11.11 大促的火热进行,京东直播再度升级技术布局,以 “立影 3D 技术”“JoyAI大模型”等创新技术,打破传统直播边界,为用户带来更具沉浸感、趣味性的购物体验,引领直播电商技术创新新方向。 立影 3D 技术:在直播间360° 还原实体货架体验 作为京东全球首发的裸眼 3D 商品营销方案,“
-
人工智能拥抱稀疏化:DeepSeek v3.2-Exp & UCM先后开源助力大模型“轻装上阵”
DeepSeek于9月29日发布V3.2-Exp最新版本,介绍了其稀疏化技术的应用效果,而同样应用稀疏化技术的华为Unified Cache Manager(简称UCM),也在9月30日正式开源上线。稀疏化趋势正从技术探索演变为产业刚需,助力大模型“轻装上阵”。 DeepSeek V3.2-Exp最重要的更新是提
-
亚信科技、阿里云达成“能力中心”合作,联办大模型论坛
9月25日,2025阿里云栖大会期间,亚信科技与阿里云签署合作协议,亚信科技正式成为阿里云“能力中心”。双方共同举办了“打造可持续运营的大模型交付体系”专题论坛,亚信科技执行董事、首席执行官高念书,阿里云智能集团政企事业部副总裁李力,中国经济改革研究基金会理事长石明磊,中国通信标准化协会副秘书长王雪飞,中国信通院云计算
-
破解 AI “安全与性能” 难题!DeepSeek-R1-Safe 基础大模型在华为全联接大会2025正式发布
9 月 18 日,华为全联接大会 2025 在上海盛大开幕。会上,华为技术有限公司与浙江大学联合发布了国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型。在中国工程院院士陈纯、华为昇腾计算业务总裁张迪煊的见证下,浙江大学计算机科学与技术学院院长、区块链与数据安全全国重点实验室常务副主任任奎携手华为
-
小度智能摄像机C800:AI大模型加持,开启“超能感知”新时代
在AI大模型与智能硬件深度融合的趋势下,小度科技持续拓展产品边界。9月17日,小度旗下首款多模态智能摄像机——小度智能摄像机C800 视频通话版正式开售。作为小度在家庭陪伴与看护场景的产品矩阵延伸,该新品不仅是“以AI为核心,硬件为载体”战略的进一步开拓,也标志着小度从语音交互到多模态交互的系统性落地应用。
-
大模型正在为产业发展提供有力支撑
大模型正在为产业发展提供有力支撑
-
昇腾助力中科大团队实现MoE 稀疏大模型并行推理提速超30%
随着人工智能技术的飞速发展,大模型参数量激增。MoE 稀疏大模型因能在提升容量的同时保持训练计算量,成为了当下的研究热点,但推理时的性能瓶颈仍制约着其进一步发展。在此背景下,中国科学技术大学人工智能与数据科学学院执行院长张燕咏率领团队,在中国科学技术大学 鲲鹏昇腾科教创新卓越中心的算力支持下,成功研发出了基于专家选择分
-
手机也能跑大模型,腾讯混元推出多款小尺寸开源模型
8月 4 日,腾讯混元宣布开源四款小尺寸模型,参数分别为 0.5B、1.8B、4B、7B,消费级显卡即可运行,适用于笔记本电脑、手机、智能座舱、智能家居等低功耗场景,且支持垂直领域低成本微调。这四款模型的推出,是腾讯混元大模型持续开源的一大举措,也进一步丰富了混元开源模型体系,可为开发者和企业提供更多尺寸的模型选择。目
-
聚焦大模型训练效率提升 北大依托昇腾突破细粒度混合并行技术
在人工智能大模型迅猛发展的当下,大模型参数和计算量呈指数级增长,大规模深度学习模型的训练离不开多硬件设备的分布式计算。在鲲鹏昇腾科教创新卓越中心的算力支持下,北京大学计算机学院崔斌教授团队创新研发了面向大模型的高效分布式训练框架,大幅提升了大规模分布式训练模型的效率。 针对模型训练任务的多样性和复杂性所带来的负载
-
北大张牧涵团队依托昇腾突破推理效率瓶颈 大模型推理百万tokens 成本仅 1 元
在人工智能领域,大语言模型的训练与推理成本一直是限制技术普及的关键因素之一。近日,北京大学人工智能研究院助理教授张牧涵团队在鲲鹏昇腾科教创新卓越中心(简称“卓越中心”)提供的算力支持下,成功研发出一套高效的大模型训练推理架构,实现了百万tokens输入成本低至1元,为产业提供了高效能、低成本的解决方案。 此研究成






