模型

  • AMCAP开门节节高、优化AI大模型部署

    text/html; charset=utf-8"/> AMCAP开门节节高、优化AI大模型部署

    2025-02-26
  • 行业首批!腾讯云TI平台支持DeepSeek全系模型精调与推理

    近日,DeepSeek全系列模型在腾讯云TI平台上第一时间上架,并在业内率先实现企业级精调与推理全链路功能。此次支持精调的模型涵盖了满血版DeepSeek V3、R1以及六款蒸馏版模型,为金融、医疗、制造、零售等多个行业提供了更高效、便捷的AI模型构建及应用方案,进一步降低企业在大模型应用中的技术门槛和研发成本。

    2025-02-21
  • 通义灵码全新上线模型选择功能,新增支持 DeepSeek-V3 和 DeepSeek-R1 满血版模型

    近期,阿里云百炼平台重磅推出 DeepSeek-V3、DeepSeek-R1、DeepSeek-R1-Distill-Qwen-32B 等 6 款模型,进一步丰富其 AI 模型矩阵。与此同时,通义灵码也紧跟步伐,全新上线模型选择功能,支持基于百炼的 DeepSeek-V3 和 DeepSeek-R1

    2025-02-13
  • DeepSeek推理型AI尽显高效训练的小模型之威

    ——在IBM院士Kush Varshney看来,全球AI竞赛中的地缘政治差异,可能没有人们想象的那么重要,他说:

    2025-02-12
  • VAST Data:客户在用对象存储训练模型

    VAST Data 联合创始人 Jeff Denworth 在 X上发文表示: “AI 训练根本不需要文件系统……更具体地说,没有人需要一个仅仅是文件系统的系统。当 HPC 存储行业向世界宣称并行文件系统对 AI 至关重要时,客户实际上已经开始在训练环境中部署 S3 检查点和 S3 数据加载器(这些也可以

    2025-02-11
  • 腾讯云上线DeepSeek模型API接口,率先支持联网搜索!

    2月8日,腾讯云宣布上线DeepSeek-R1及V3原版模型API接口,通过强大的公有云服务,腾讯云可以为用户提供稳定优质的服务。同时,腾讯云旗下大模型知识应用开发平台知识引擎也接入了这两款模型,并率先支持联网搜索,结合知识库和RAG能力,开发者可以借助该平台实现分钟级搭建基于DeepSeek大模型的联网应用。腾讯云成

    2025-02-10
  • DeepSeek 大模型 API 硬盘缓存技术对存储系统的挑战

    随着网络带宽和存储性能的不断提升,数据中心的资源利用模式正面临新 的挑战。传统的以 CPU 为中心的处理架构在处理网络和存储协议时,需要占用 服务器主机约 30%的资源。这种资源占用被形象地称为“数据中心税”,它不仅 增加了存储服务器的资源开销,还限制了存储系统的整体性能表现。 此外,随着 CP

    2025-02-08
  • 中国电子云上线DeepSeek-R1/V3全量模型 开启私有化部署新篇

    近日,中国电子云CECSTACK智算云平台正式上线MoE架构的671B全量DeepSeek-R1/V3模型,以及DeepSeek-R1的蒸馏系列Qwen/Llama模型,并提供私有化部署方案,为党政、央国企以及关键行业用户提供安全可靠、智能集约的智能化解决方案。 DeepSeek系列大模型凭借其国产、开源

    2025-02-08
  • 腾讯云TI平台上架DeepSeek系列模型,支持免费体验和一键部署 

    近日,腾讯云TI平台宣布上架DeepSeek系列模型,包括“满血”的V3、R1原版模型,参数量达到671B;以及基于DeepSeek-R1蒸馏得到的系列模型,参数规模从70B到1.5B不等。 TI平台全面支持DeepSeek系列模型的一键部署。此外,为便于开发者零门槛开箱,TI平台也限时开放了R1 模型的免费在线

    2025-02-04
  • 英特尔Gaudi 2D可推理DeepSeek Janus Pro模型

    近日,DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注。英特尔 Gaudi 2D AI加速器现已针对该模型进行优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化,有效满足行业应用对于推理算力的需求,为AI应用的落地和规模化发展提供强有力的支持。 作为一款创新性

    2025-02-02
  • 英特尔Gaudi 2D AI加速器深度优化,高效运行DeepSeek Janus Pro模型

    近日,DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注。英特尔® Gaudi 2D AI加速器现已针对该模型进行优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化,有效满足行业应用对于推理算力的需求,为AI应用的落地和规模化发展提供强有力的支持。 作为一款创新

    2025-02-02
  • 蚂蚁集团:构筑完善的安全治理体系,推进模型能力快速提升

    1月8日,北京智源人工智能研究院从Scaling Law、基础模型、具身智能、超级应用、AI安全等关键方向发布了覆盖从基础设施到产品应用场景的“2025十大AI技术趋势”,针对每个趋势观点,给出其可成为2025年度趋势的论证逻辑。其中在AI安全趋势方面,智源研究院认为,模型能力提升与风险预防并重,AI安全治理体系持续完

    2025-01-13
  • 英伟达将打造桌面级超级电脑,可推理2000亿参数大模型

    CES上,英伟达宣布将打造桌面级的个人超级计算机,让AI研发者,数据科学家,学生和开发者都可以在桌子上摆放一台超级计算机。一台这样的个人超级计算机可以推理2000亿参数的大语言模型。 英伟达宣布启动名为DIGITS(Deep learning gpu intelligence training syste

    2025-01-08
  • Meta AI推出LIGER混合检索AI模型,计算效率与推荐精度兼得

    Meta AI 的研究人员提出了一种名为 LIGER 的新型 AI 模型,巧妙地结合密集检索和生成检索的优势,显著提升了生成式推荐系统的性能。 LIGER 有效地解决了传统推荐系统在计算资源、存储需求和冷启动项目处理上的难题,为构建更高效、更精准的推荐系统提供了新的思路。 项目背景 想要把用户与相关内

    2025-01-04
  • 智源发布FlagEval“百模”评测结果 丈量模型生态变局

    2024年12月19日,智源研究院发布并解读国内外100余个开源和商业闭源的语言、视觉语言、文生图、文生视频、语音语言大模型综合及专项评测结果。 相较于今年5月的模型能力全方位评估,本次智源评测扩展、丰富、细化了任务解决能力内涵,新增了数据处理、高级编程和工具调用的相关能力与任务;首次增加了面向真实金融量化交易场

    2024-12-20