职位描述
1.负责LLM相关底层技术的研究与实现,突破GPT相关的生成式大模型。
2.将预训练模型与文本分类、语义检索、NER、对话等多领域实际问题相结合,全面提升搜索、NLP研发任务及创新应用。任职要求
1. 扎实的编程基础,精通python等;
2. 熟悉深度学习以及常见机器学习算法的原理与算法,能熟练运用聚类、分类、回归、排序等模型解决有挑战性的问题;
3. 熟悉文本语义匹配、机器阅读理解、排序模型、推荐系统等方向优先;
4. 有预训练模型研发经验,深入理解Bert和GPT相关原理,如prompt、finetuning、transformer等关键技术,能解决意图理解问题;
5. 有强烈求知欲,对人工智能领域相关技术有热情;
6. 具有良好的数学基础,良好的英语阅读能力和良好的团队合作精神。
如有以下经验者优先:
1.博士优先,有acl/aaai/kdd/nips/cvpr等a类论文者优先;
2.有GPT生成式模型研发经验者优先;