logo 智能机器人开发者大赛社区

智能机器人开发者大赛社区
首页2025 Robo Mind 冬令营资料中心讨论广场精彩内容
去全站搜索看看?
赛队注册

登录社区云

登录社区云,与社区用户共同成长

智能机器人开发者大赛社区

邀请您加入社区

欢迎加入社区

欢迎加入社区

DeepSeek
  • 从0到1微调DeepSeek大模型,LoRA+4位量化让24GB显卡也能玩转

    本文介绍了如何利用LoRA技术和4位量化方法在24GB显存的普通GPU上微调DeepSeek大模型。DeepSeek凭借高效的MLA架构和低显存占用优势,成为开发者微调的热门选择。文章系统讲解了从理论原理到实战操作的全流程,包括交叉熵损失函数、数据子集策略等核心概念,重点解析了LoRA技术如何通过低秩矩阵分解将可训练参数压缩至1%以下,以及4位量化如何将内存需求降至1/8。通过IMDB情感分类任务

    陈敬雷-充电了么-CEO兼CTO
    2025-10-06 20:47:59
     3443 
     122 
    #人工智能#科技#自然语言处理 +1
  • 还在羡慕别人的DeepSeek?手把手教你在GpuGeek搭建专属大模型

    本文手把手教你在 GpuGeek 平台搭建 DeepSeek 大模型服务。先介绍选择 GpuGeek 的原因,其有多种高性能 GPU、弹性计费,性价比高,还说明 DeepSeek 大模型特性与应用场景。接着阐述搭建前的准备,包括注册账号、选模型与镜像。然后讲解实战部署步骤,如创建 GPU 实例、SSH 连接与环境验证。

    Alex
    2025-05-17 02:05:00
     4.3w 
     66 
    #人工智能#AI#DeepSeek
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号