当前位置:首页 > 芯闻号 > 美通社全球TMT
[导读]作者: IBM watsonx.ai 产品主管Maryam Ashoori; IBM AI平台(watsonx.ai 和 watsonx.governance)产品管理副总裁Armand Ruiz; IBM watsonx.ai 产品经理Nisarg Patel 北京2025年...

作者: IBM watsonx.ai 产品主管Maryam Ashoori; IBM AI平台(watsonx.ai 和 watsonx.governance)产品管理副总裁Armand Ruiz; IBM watsonx.ai 产品经理Nisarg Patel

北京2025年2月11日 /美通社/ -- IBM日前宣布,DeepSeek-R1 的 Llama 3.1 8B 和 Llama 3.3 70b 蒸馏版本现已在 IBM 的企业级 AI 开发平台 watsonx.ai 上提供

IBM在watsonx.ai 上提供DeepSeek R1 蒸馏模型,增强企业规模化AI应用及其安全与治理能力

IBM在watsonx.ai 上提供DeepSeek R1 蒸馏模型,增强企业规模化AI应用及其安全与治理能力

DeepSeek-R1到底是啥?

DeepSeek-R1 是中国人工智能(AI)初创公司 DeepSeek 的推理大语言模型(LLM),是世界上最强大的开源模型之一,甚至可以与 OpenAI 的 o1 相媲美。DeepSeek-R1 在 MIT 许可证下发布,主要是通过在基础模型 DeepSeek-V3 上直接使用强化学习 (RL) 开发的,这是微调 LLM 的一项重大创新。

DeepSeek 还使用了一种称为知识蒸馏的技术,使用较大的 R1 模型生成的数据来微调多个 Llama 和 Qwen 模型。用户可以通过两种方式在 watsonx.ai 上访问 DeepSeek 蒸馏模型:

  • IBM 通过 "按需部署目录"在 watsonx.ai 中提供两种 Llama 蒸馏变体,允许用户部署专用实例进行安全推理。
  • 用户还可以使用自定义基础模型导入功能导入 DeepSeek-R1 模型的其他变体,如 Qwen 蒸馏模型。

DeepSeek-R1 支持哪些类型的用例?

DeepSeek-R1 是一种先进的 AI 模型,以其卓越的推理能力而著称,支持各行各业的广泛应用:

  • 规划:DeepSeek-R1 专注于思维逻辑链,能够执行需要逐步推理的任务,因此非常适合为智能体(代理)应用程序提供支持。
  • 编码: DeepSeek-R1擅长编码任务,提供代码生成、调试辅助和优化建议。
  • 数学问题解决: 该模型强大的推理能力使其善于解决复杂的数学问题,这对学术研究、工程和科学计算大有裨益。

开发人员可在 IBM watsonx.ai 中使用 DeepSeek-R1 等已部署的模型和解决方案功能构建人工智能解决方案:

  • 以易于理解的格式和用户界面测试和评估模型输出
  • 通过连接各种向量数据库和嵌入模型来构建 RAG 管道
  • 与 LangChain、CrewAI 等流行框架和连接器协同工作

为何要在 watsonx.ai 上使用DeepSeek蒸馏模型?

IBM watsonx.ai 使客户能够定制实施 DeepSeek-R1 等开源模型,从部署环境的完全灵活性到智能体(代理)开发、微调、RAG、提示工程和与企业应用程序集成的直观工作流,用户可以利用watsonx.ai的内置护栏来保护他们的应用程序

当然,数据安全和AI治理是客户最关心的问题。除防护栏外,在 watsonx.ai 上部署时,这些模型将成为专用实例,这意味着除平台外,不会在其他任何地方共享数据。此外,与 IBM watsonx.governance这一功能强大的治理、风险和合规性(GRC)工具包的无缝集成,可确保客户的AI在整个AI生命周期内都是负责任、透明和可解释的。

开始在 IBM watsonx.ai 上使用 DeepSeek

支持 DeepSeek-R1 的蒸馏变体是 IBM 致力于AI开源创新的一部分。DeepSeek Llama 的两个蒸馏模型都以纳入 IBM watsonx.ai 上按需部署目录,能够在专用 GPU 上按小时部署。

如何从watsonx资源中心按需部署R1模型

从资源中心按需部署基础模型,请完成以下步骤:

  1. 从导航菜单打开资源中心。
  2. 从 "按小时付费 "部分,找到要按需部署的 DeepSeek 模型。
  3. 从模型详细信息页面,单击 "Deploy(部署)"
  4. 从基础模型磁贴中单击 "Deploy(部署)",然后选择要部署基础模型的部署空间。
  5. 单击"Create(创建)"。
  6. 通过 Prompt Lab 或 API/SDK 开始使用模型。

IBM watsonx.ai 在这里会用斜体显示模型的思维过程,而最终输出则用非斜体显示。正如你所见,只需一个简单的提示,模型就能推理并规划出响应中需要包含的各个部分。

如何通过 REST API 在 watsonx 上部署 R1 模型

或者, 您也可以使用 REST API 来部署模型

当然,您必须将 bearer token 和 space-id 等信息替换为相应的凭证。模型部署完成后,您可以从 Prompt Lab 或 watsonx.ai API 提示基础模型。

通过让用户访问 watsonx.ai 上同类最优的开源模型(包括第三方模型和 IBM Granite),我们以期能够塑造协作和知识共享的文化。

即刻试用watsonx.ai™中的DeepSeek-R1精馏模型 → 了解更多

关于IBM
IBM 是全球领先的混合云、人工智能及企业服务提供商,帮助超过 175 个国家和地区的客户,从其拥有的数据中获取商业洞察,简化业务流程,降低成本,并获得行业竞争优势。金融服务、电信和医疗健康等关键基础设施领域的超过 4000 家政府和企业实体依靠 IBM 混合云平台和红帽 OpenShift 快速、高效、安全地实现数字化转型。IBM 在人工智能、量子计算、行业云解决方案和企业服务方面的突破性创新为我们的客户提供了开放和灵活的选择。对企业诚信、透明治理、社会责任、包容文化和服务精神的长期承诺是 IBM 业务发展的基石。 

IBM Corporation logo.

IBM Corporation logo.

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

9月2日消息,不造车的华为或将催生出更大的独角兽公司,随着阿维塔和赛力斯的入局,华为引望愈发显得引人瞩目。

关键字: 阿维塔 塞力斯 华为

加利福尼亚州圣克拉拉县2024年8月30日 /美通社/ -- 数字化转型技术解决方案公司Trianz今天宣布,该公司与Amazon Web Services (AWS)签订了...

关键字: AWS AN BSP 数字化

伦敦2024年8月29日 /美通社/ -- 英国汽车技术公司SODA.Auto推出其旗舰产品SODA V,这是全球首款涵盖汽车工程师从创意到认证的所有需求的工具,可用于创建软件定义汽车。 SODA V工具的开发耗时1.5...

关键字: 汽车 人工智能 智能驱动 BSP

北京2024年8月28日 /美通社/ -- 越来越多用户希望企业业务能7×24不间断运行,同时企业却面临越来越多业务中断的风险,如企业系统复杂性的增加,频繁的功能更新和发布等。如何确保业务连续性,提升韧性,成...

关键字: 亚马逊 解密 控制平面 BSP

8月30日消息,据媒体报道,腾讯和网易近期正在缩减他们对日本游戏市场的投资。

关键字: 腾讯 编码器 CPU

8月28日消息,今天上午,2024中国国际大数据产业博览会开幕式在贵阳举行,华为董事、质量流程IT总裁陶景文发表了演讲。

关键字: 华为 12nm EDA 半导体

8月28日消息,在2024中国国际大数据产业博览会上,华为常务董事、华为云CEO张平安发表演讲称,数字世界的话语权最终是由生态的繁荣决定的。

关键字: 华为 12nm 手机 卫星通信

要点: 有效应对环境变化,经营业绩稳中有升 落实提质增效举措,毛利润率延续升势 战略布局成效显著,战新业务引领增长 以科技创新为引领,提升企业核心竞争力 坚持高质量发展策略,塑强核心竞争优势...

关键字: 通信 BSP 电信运营商 数字经济

北京2024年8月27日 /美通社/ -- 8月21日,由中央广播电视总台与中国电影电视技术学会联合牵头组建的NVI技术创新联盟在BIRTV2024超高清全产业链发展研讨会上宣布正式成立。 活动现场 NVI技术创新联...

关键字: VI 传输协议 音频 BSP

北京2024年8月27日 /美通社/ -- 在8月23日举办的2024年长三角生态绿色一体化发展示范区联合招商会上,软通动力信息技术(集团)股份有限公司(以下简称"软通动力")与长三角投资(上海)有限...

关键字: BSP 信息技术
关闭