北京智谱华章科技面试题 · 技术原理
北京智谱华章科技相关面试题,按最终去重题目聚合。
共 192 道真题 · 当前筛选命中 146 道 · 更新 2026-08-05
筛选题目已选:技术原理
考察点
技术栈
第 21 题手写代码:删除链表的倒数第 n 个节点。 考察链表操作、双指针技巧与边界处理能力第 22 题3度关系的定义是什么?为什么这样定义? 考察对图论中三度关系概念的准确理解及其设计动机第 23 题请介绍你读过的一两篇大模型数据相关的论文,并谈谈你的理解。 考察对大模型数据领域前沿研究的了解程度与归纳能力第 24 题设计模式了解嘛?说几个你熟悉的。 考察设计模式基础认知与实际运用能力第 25 题LoRA和p-tuning v2的区别,以及初始化方式 考察对两类参数高效微调方法在机制和初始化上的异同理解第 26 题请从你的两个项目中挑选一个你最熟悉的,介绍它的主要功能以及你是如何实现这些功能的。 考察项目理解深度、技术实现能力及沟通表达第 27 题RAG是什么,大模型是怎么检索文档的? 考察对检索增强生成的概念理解与检索流程掌握第 28 题用户相似性匹配功能,你是怎么实现的? 考察推荐或用户画像系统中相似度计算的技术选型、实现细节与业务落地第 29 题请手写二分类模型的前向传播全流程,包括输入处理、embedding层、分类网络、sigmoid激活和交叉熵损失计算,模型结构可用伪函数替代。 考察对二分类模型从数据输入到损失计算的完整实现能力第 30 题DPO解决什么问题,正负样本对很相似会带来提升吗? 考察对DPO算法本质及其对比学习样本构造的理解第 31 题请写出 RAG 的基本流程,可用伪代码表达。 考察对检索增强生成全链路的掌握第 32 题在3D并行(数据并行、张量并行、流水线并行)中,ZeRO优化器的并行策略最多能开到什么程度?如果只开启部分ZeRO级别(如ZeRO-2),会带来哪些影响? 考察对ZeRO优化器与3D并行组合的理解,包括显存节省、通信开销和训练稳定性第 33 题请描述一个完整的预训练数据清洗流程,并说明每一步的作用与质量标准。 考察对大规模预训练数据清洗流程的理解及每一步骤的质量控制第 34 题请在白板/代码中实现Transformer的Decoder Block(含Masked Self-Attention与Cross-Attention)。 考察对Transformer Decoder结构、子层顺序及掩码细节的掌握与编码能力第 35 题请介绍你在项目中训练奖励模型(RM)的具体方式,包括数据、训练流程和涉及的库。 考察对RLHF奖励模型训练方法的理解与实践经验第 36 题TP和DP应用在哪个权重计算的位置,并且两者是如何进行协同的? 考察模型并行策略中张量并行与数据并行的角色定位及协同机制第 37 题Python深拷贝和浅拷贝的区别 考察Python中对象复制的底层机制与边界理解第 38 题LVM 是什么? 考察对 Linux 逻辑卷管理基本概念的理解第 39 题多机多卡和单机多卡在实现上的不同 考察分布式训练中通信架构、同步机制与故障处理的区别第 40 题请说明将最长公共子序列(LCS)问题改编为最长公共子串问题需要修改哪些动态规划条件,并重点分析改写的关键点。 考察动态规划基础及其变体辨析能力