Ivyea Jobs 6511 roles · 88 companies · 刚刚

视觉算法实习生

深圳 实习 研发 多模态 / 视觉 / 语音

职位描述

【岗位职责】 1:负责AI算法的创新研发,包括 2D/3D 视觉感知算法、多模态融合、视觉大模型 pre/post-training 等方向,解决实际工业场景中的实际问题和需求; 2:参与动态视觉网络、时序视觉建模、动态推理网络等方向的研究与算法落地,探索复杂动态场景下的高效视觉感知与理解方法; 3:参与基于 CLIP 等视觉-语言模型的多模态算法研究,包括但不限于开放词汇检测/分割、零样本识别、图文匹配、跨模态检索、提示学习、领域自适应及下游任务微调; 4:跟踪计算机视觉、多模态大模型、动态网络、3D 视觉等方向的前沿进展,进行算法复现、实验分析、性能优化与工程落地; 5:配合团队完成数据构建、模型训练、评测分析、推理部署及业务场景验证等工作。

任职要求

1:国内外重点大学计算机、自动化、机器人、物理、数学等相关专业,具有良好的数学和图像几何基础; 2:具有优秀的学习能力、分析问题和解决问题的能力,具有良好的沟通能力和团队合作能力,在工作中敢于突破与创新,对解决具有挑战性的问题充满激情; 3:在 2D/3D 视觉感知算法、机器学习、机器人、多模态学习等方向有研发经验; 4:精通 PyTorch / TensorFlow 等深度学习框架,熟练掌握 C++ / Python,熟悉 TensorRT / ONNX 等推理部署框架; 5:熟悉常见视觉模型结构,如 CNN、Transformer、ViT、CLIP、Diffusion、NeRF/3D Gaussian Splatting 等,有一定的模型训练、调参和实验分析能力; 6:对以下方向之一有一定了解或研究经验者优先: 动态网络 / 动态视觉建模,包括动态神经网络、时序建模、视频理解、动态推理、动态 Token 选择、动态路由、动态图网络等; CLIP / 视觉-语言模型方向,包括多模态对比学习、开放词汇识别、开放词汇检测/分割、Zero-shot Learning、Prompt Learning、跨模态检索、多模态大模型微调等。 【加分项】 在国际顶级会议或期刊发表相关论文者优先,包括但不限于: NeurIPS / ICLR / ICML / AAAI / CVPR / ICCV / ECCV / TPAMI / IJCAI / SIGGRAPH / IROS / ICRA; 有 CLIP、BLIP、SAM、DINO、Stable Diffusion、LLaVA、Qwen-VL 等视觉大模型或多模态模型相关研究、复现或落地经验者优先; 有动态网络、动态推理、时序视觉建模、视频理解、动态图神经网络等方向研究经验者优先; 有开放词汇检测、开放词汇分割、零样本分类、跨模态检索、图文对齐、Prompt Tuning、Adapter Tuning 等项目经验者优先; AI 开源项目的核心贡献者优先; 编程 / 物理 / 数学大赛奖牌获得者,或有 Hackathon / AI 会议比赛经验者优先;
粤港澳大湾区数字经济研究院 IDEA去官方页面投递 →