Ivyea Jobs 11106 roles · 197 companies · 刚刚
智慧芽 · AI 应用

产品运营-大模型评测

苏州 社招 · 全职 运营 / 市场 / 商业化

职位描述

1. 负责大模型评测体系(Benchmark)在 GitHub、Hugging Face、Discord、知乎、X(Twitter)等国内外技术社区的日常运营与维护。 2. 策划并执行开源项目增长策略,提升项目的关注度、下载量、引用率及活跃贡献者数量。 3. 构建基于 AI Agent 的社区自动化运营工作流,提升社区响应效率与用户体验。 4. 结合评测榜单更新、新功能发布及行业热点,策划高质量的技术博客、Release Notes、使用教程及深度解读文章。 5. 利用 AI 生产力工具(文本/图像/视频生成模型)实现多语言内容的规模化、高质量产出与本地化分发,大幅提升内容运营的杠杆率。 6. 策划并组织线上/线下的技术布道活动,如 Webinar、黑客松(Hackathon)或打榜挑战赛。 7. 利用大模型对海量社区反馈、开发者舆情、竞品动态进行自动化抓取与情感分析,提炼核心洞察,为 Benchmark 的迭代方向提供业务输入。 8. 追踪国内外大模型评测领域的最新动态与竞品动作,输出行业观察报告。 9. 拓展并维护与高校科研院所、AI 头部企业、开源基金会及技术 KOL 的合作关系,推动联合评测或学术引用。 10. 打造该 Benchmark 在大模型领域的权威性和公信力,将其建设为行业标准的评测基座。

任职要求

任职资格 1. 本科及以上学历,计算机、人工智能、市场营销或相关专业优先。 2. 3-5年以上技术运营、开发者关系(DevRel)或开源社区运营经验。 3. 有成功的 GitHub 开源项目运营经验,或在 Hugging Face、Kaggle 等 AI 社区有丰富的运营/打榜组织经验。 4. 熟悉大语言模型(LLM)的基本概念、发展趋势及主流生态,了解 Benchmark 在模型研发中的价值与痛点(懂 MMLU, CEval, LMSYS Chatbot Arena 等榜单的运营逻辑)。 5. 具备优秀的技术理解力,能够与算法工程师无障碍沟通,并能将硬核技术转化为易于传播的社区语言。 6. 具备出色的中英文读写能力,能够熟练使用英语在国际社区(如 Hugging Face, X, Reddit)进行内容发布与深度用户互动。 7. 对 AI 领域的最新进展(新模型发布、新架构、新评测维度)有极强的求知欲和敏锐度,是 AI 前沿资讯的“重度消费者”和“尝鲜者”。 8. 熟练掌握并高频使用主流大模型及 AI 生产力工具,具备优秀的 Prompt Engineering 能力。 9. 能够主动用 AI 改造传统的运营、内容创作和数据分析工作流,实现个人与团队产出的指数级跃升。
智慧芽去官方页面投递 →