职位描述
1. 负责大模型评测体系(Benchmark)在 GitHub、Hugging Face、Discord、知乎、X(Twitter)等国内外技术社区的日常运营与维护。
2. 策划并执行开源项目增长策略,提升项目的关注度、下载量、引用率及活跃贡献者数量。
3. 构建基于 AI Agent 的社区自动化运营工作流,提升社区响应效率与用户体验。
4. 结合评测榜单更新、新功能发布及行业热点,策划高质量的技术博客、Release Notes、使用教程及深度解读文章。
5. 利用 AI 生产力工具(文本/图像/视频生成模型)实现多语言内容的规模化、高质量产出与本地化分发,大幅提升内容运营的杠杆率。
6. 策划并组织线上/线下的技术布道活动,如 Webinar、黑客松(Hackathon)或打榜挑战赛。
7. 利用大模型对海量社区反馈、开发者舆情、竞品动态进行自动化抓取与情感分析,提炼核心洞察,为 Benchmark 的迭代方向提供业务输入。
8. 追踪国内外大模型评测领域的最新动态与竞品动作,输出行业观察报告。
9. 拓展并维护与高校科研院所、AI 头部企业、开源基金会及技术 KOL 的合作关系,推动联合评测或学术引用。
10. 打造该 Benchmark 在大模型领域的权威性和公信力,将其建设为行业标准的评测基座。任职要求
任职资格
1. 本科及以上学历,计算机、人工智能、市场营销或相关专业优先。
2. 3-5年以上技术运营、开发者关系(DevRel)或开源社区运营经验。
3. 有成功的 GitHub 开源项目运营经验,或在 Hugging Face、Kaggle 等 AI 社区有丰富的运营/打榜组织经验。
4. 熟悉大语言模型(LLM)的基本概念、发展趋势及主流生态,了解 Benchmark 在模型研发中的价值与痛点(懂 MMLU, CEval, LMSYS Chatbot Arena 等榜单的运营逻辑)。
5. 具备优秀的技术理解力,能够与算法工程师无障碍沟通,并能将硬核技术转化为易于传播的社区语言。
6. 具备出色的中英文读写能力,能够熟练使用英语在国际社区(如 Hugging Face, X, Reddit)进行内容发布与深度用户互动。
7. 对 AI 领域的最新进展(新模型发布、新架构、新评测维度)有极强的求知欲和敏锐度,是 AI 前沿资讯的“重度消费者”和“尝鲜者”。
8. 熟练掌握并高频使用主流大模型及 AI 生产力工具,具备优秀的 Prompt Engineering 能力。
9. 能够主动用 AI 改造传统的运营、内容创作和数据分析工作流,实现个人与团队产出的指数级跃升。