职位描述
岗位职责:
负责大语言模型(LLM)相关算法研发,包括微调、对齐、推理优化、上下文优化等核心技术迭代。
基于开源基座模型开展微调与对齐工作,提升模型指令跟随、逻辑推理、问答准确性。
研究并优化大模型幻觉、上下文遗忘、长文本理解、多轮一致性等核心问题,持续提升模型输出质量。
针对业务场景优化Embedding模型、rerank模型、Query改写、意图识别、歧义消解等算法模块。
与后端、前端等团队协作,完成算法原型、业务落地、上线灰度、效果监控。
沉淀通用大模型算法工具链、最佳实践、技术文档,推动团队技术体系标准化。
任职要求:
1. 学历与专业背景
本科及以上学历,计算机、人工智能、软件工程、数学、统计、自动化等相关专业,硕士优先。
2. 基础能力
扎实的机器学习、深度学习、NLP基础,熟练掌握 Transformer、注意力机制、预训练语言模型核心原理。
熟练掌握 Python,熟练使用 PyTorch,具备独立算法实验、模型训练、数据分析能力。
熟悉常规数据挖掘、特征分析、时序分析、相关性分析、统计建模方法。
熟练掌握 Prompt Engineering、Few-shot、CoT、Self-consistency 等提示词优化方法。
3. 综合素质
具备良好的算法思维、问题拆解能力、数据敏感度,能够独立从0到1完成算法方案设计与落地。具备较强的自驱力,持续跟进生成式AI前沿技术,善于沉淀方法论。沟通协作能力良好,能高效配合跨团队完成项目交付。