logo 智能机器人开发者大赛社区

智能机器人开发者大赛社区
首页2025 Robo Mind 冬令营资料中心讨论广场精彩内容
去全站搜索看看?
赛队注册

登录社区云

登录社区云,与社区用户共同成长

智能机器人开发者大赛社区

邀请您加入社区

欢迎加入社区

欢迎加入社区

科技
  • 超详细!大模型面经指南(附答案)

    LLM(Large Language Model,大型语言模型)是指基于大规模数据和参数量的语言模型。Transformer架构:大模型LLM常使用Transformer架构,它是一种基于自注意力机制的序列模型。Transformer架构由多个编码器层和解码器层组成,每个层都包含多头自注意力机制和前馈神经网络。这种架构可以捕捉长距离的依赖关系和语言结构,适用于处理大规模语言数据。自注意力机制(Se

    AI程序猿人
    2024-06-04 11:47:11
     3584 
     57 
    #人工智能#语言模型#dubbo +2
  • 从0到1微调DeepSeek大模型,LoRA+4位量化让24GB显卡也能玩转

    本文介绍了如何利用LoRA技术和4位量化方法在24GB显存的普通GPU上微调DeepSeek大模型。DeepSeek凭借高效的MLA架构和低显存占用优势,成为开发者微调的热门选择。文章系统讲解了从理论原理到实战操作的全流程,包括交叉熵损失函数、数据子集策略等核心概念,重点解析了LoRA技术如何通过低秩矩阵分解将可训练参数压缩至1%以下,以及4位量化如何将内存需求降至1/8。通过IMDB情感分类任务

    陈敬雷-充电了么-CEO兼CTO
    2025-10-06 20:47:59
     3443 
     122 
    #人工智能#科技#自然语言处理 +1
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号