IBM Watsonx.ai 平台新增 DeepSeek R1 蒸馏模型,助力企业级 AI 开发

人工智能1个月前发布 AI之家
3 0 0

IBM 近日宣布,其企业级 AI 开发平台 watsonx.ai 现已上线 DeepSeek-R1 蒸馏版 Llama 3.1 8B 和 Llama 3.3 70B 模型

IBM Watsonx.ai 平台新增 DeepSeek R1 蒸馏模型,助力企业级 AI 开发

据官方介绍,DeepSeek 还借助知识蒸馏技术,利用 R1 模型生成的数据对多个 Llama 和 Qwen 变体进行了优化。用户可通过以下方式在 watsonx.ai 上使用 DeepSeek 蒸馏模型:

  • IBM 在 watsonx.ai 的“按需部署”目录中提供 Llama 蒸馏版,用户可部署专用实例以进行安全推理。
  • 用户还可通过“自定义基础模型”导入功能,上传 DeepSeek-R1 的其他变体,例如 Qwen 蒸馏模型。

DeepSeek-R1 具有强大的推理能力,适用于多个领域:

  • 规划:其“链式思维”逻辑有助于处理需要逐步推理的任务,尤其适用于智能体应用。
  • 编程:可用于代码生成、调试和优化,从而提升开发效率。
  • 数学问题求解:具备处理复杂数学问题的能力,在科研、工程和科学计算等领域表现突出。

开发者可在 watsonx.ai 上利用 DeepSeek-R1 进行 AI 解决方案的开发,并使用以下功能:

  • 直观地测试和评估模型输出
  • 通过连接向量数据库和嵌入模型构建 RAG(检索增强生成)管道
  • 支持 LangChain、CrewAI 等主流 AI 框架

IBM watsonx.ai 提供灵活的开源模型定制选项,支持 DeepSeek-R1 在不同环境下的部署,并简化智能体开发、微调、RAG、提示工程等工作流程。此外,watsonx.ai 内置安全机制,保障用户应用的安全。

据 AI 工具库此前报道,IBM 首席执行官本月初曾发表长文表示,DeepSeek 仅使用约 2000 枚英伟达芯片,以大约 600 万美元的成本训练了最新的模型,远低于行业预期。这再次证明,小型、高效的模型也能带来实际成果,而无需依赖庞大而昂贵的专有系统。

© 版权声明

相关AI热点

暂无评论

none
暂无评论...