1. 关于DeepSeek长文本处理技术的原生可训练设计,以下哪一项是正确的?——在训练初期就开始学习最优稀疏模式
  2. DeepSeek-R1模型训练过程中,以下哪一项是监督微调阶段的起点?——冷启动推理数据
  3. 在RAG的核心流程中,以下哪项操作不包括索引阶段?——使用嵌入模型将文本块转化为向量表示
  4. 以下哪一项不属于DeepSeek的NSA机制实现突破的关键技术架构?——静态特征映射
  5. 在自然语言理解、文本生成等通用基准测试中,DeepSeek NSA机制与传统全注意力机制相比,以下哪一项是其优点?——首次实现对传统全注意力机制的全面性能反超
  6. 在使用LangChain的RetrievalQA链简化流程的代码中,以下哪个选项不属于ChatOpenAI初始化时的配置?——文档分块大小
  7. 在Result(结果导向)方面,关于DeepSeek的V3模1、以下关于开源基座大型语言模型领域知识缺失的描述,哪一项是正确的?——大语言模型缺乏企业私有数据支持
  8. 在DeepSeek模型部署遇到显存不足问题时,以下哪些选项属于解决措施?——更换模型版本,如从7B降至1.5B、启用FP4量化技术减少显存占用、关闭其他占用显存的后台程序
  9. 以下哪些选项属于昇腾服务器?——Atlas 500 Pro、Atlas 800、Atlas 900 A2 POD
  10. 以下哪些选项属于Atlas 800系列昇腾服务器?——Atlas 800I A2推理服务器、Atlas 800推理服务器、Atlas 800TA2训练服务器
  11. 在向量数据库部署中,以下哪些选项属于ChromaDB的特点?——易于部署、轻量级
  12. 以下哪些选项是RAG技术的优势?——可灵活更新知识、减少大语言模型幻觉问题、能利用最新知识进行回答
  13. 在构建RAG应用的Prompt模板设计中,以下哪些措施可以减少幻觉风险?——
    动态插入检索到的相关文档片段、明确系统指令,要求模型仅基于提供的资料回答
  14. 在DeepSeek长文本处理的稀疏注意力机制NSA的硬件级优化中,以下哪些选项属于采取的措施?——设计内存访问优化器降低显存占用、重构指令流水线提升训练加速、采用解码预测器加快解码速度
  15. RAG技术不能解决LLM的知识时效性问题。——错
Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐