| 多媒体研究员 | |||
| 发布日期: | 2026/8/5 12:14:56 | 有效日期: | |
| 工作地点: | 内蒙古包头市松石国际城兴旺路S112 浩腾数字、呼和浩特市回民区退役军人创业就业园 | 职位性质: | |
| 学历要求: | 硕士及以上 | 招聘人数: | 10 名 |
| 专业要求: | AI专业+计算机+软件 | 年龄要求: | 23 |
| 工作经验: | 不限 | 性别要求: | 不限 |
职责要求:一、专业基础要求1. 学历与专业背景:计算机科学、人工智能、信号与信息处理、电子信息、数字媒体技术、应用数学等相关专业,硕士及以上学历,博士优先,具备扎实的理工科理论功底。 2. 核心理论基础:精通数字信号处理(DSP)、多媒体信息处理、计算机视觉、计算机图形学、多模态信息融合基础理论;熟练掌握图像、视频、音频、文本等各类多媒体数据的特征原理、采样编码、降噪增强基础技术。 3. 算法基础:深入掌握机器学习、深度学习传统算法,熟悉分类、检测、分割、聚类、特征匹配、时序预测等基础模型原理,精通神经网络、Transformer、扩散模型等主流架构核心逻辑。 二、核心技术能力要求(一)音视频多媒体处理技术1. 熟练掌握主流音视频编解码标准,包括H.264、H.265、AV1、VP9视频编码,AAC、Opus、MP3音频编码,理解编码压缩、码率控制、画质音质优化核心机制。 2. 精通多媒体处理工具与框架,熟练使用FFmpeg、GStreamer完成音视频裁剪、转码、拼接、滤镜处理、格式适配等操作,熟悉主流硬件编解码引擎原理。 3. 掌握流媒体核心技术,熟悉RTMP、RTP/RTCP、HLS、DASH、WebRTC等流媒体协议,具备实时传输、低延迟推拉流、弱网自适应优化研究能力。 (二)计算机视觉与图形渲染技术1. 精通图像增强、超分辨率、图像分割、目标检测与跟踪、视频插帧、防抖、画质修复等视觉算法,可独立完成算法调研、改进与验证。 2. 掌握计算机图形学核心技术,熟悉OpenGL、Vulkan、DirectX渲染管线,具备虚拟场景构建、画面渲染优化、实时仿真等相关研究经验者优先。 3. 了解物理仿真技术,掌握AI赋能仿真、神经物理仿真、场景生成等前沿技术,可结合多媒体场景完成仿真效果优化。 (三)多模态大模型研究能力1. 深入理解多模态大模型技术体系,精通图文对齐、音视频-文本跨模态检索、理解、生成技术,掌握模态融合、模态对齐、多任务联合训练核心方法。 2. 熟悉主流生成式模型,包括文生图(SD系列、PixArt)、文生视频(Wan)、视频生成与编辑模型,具备模型微调、Prompt工程、数据合成研究经验。 3. 掌握大模型优化技术,熟悉模型剪枝、量化、蒸馏、持续学习、RLHF对齐、强化学习优化等技术,具备大模型轻量化、高效推理研究能力。 三、编程与工程技术能力1. 核心编程语言:熟练使用Python开展算法研究、模型训练与实验验证,精通C/C++可完成算法高效落地与性能优化,了解Rust高性能开发优先。 2. 深度学习框架:熟练使用PyTorch、TensorFlow主流框架,精通Hugging Face、DeepSpeed等工具链,可独立完成模型搭建、训练、调优、测试全流程。 3. 工程部署能力:熟悉模型量化、推理加速、分布式训练、混合精度推理技术,掌握ONNX模型转换、推理部署流程,具备端侧、云端多媒体算法部署优化经验。 4. 数据处理能力:熟练掌握多媒体数据清洗、标注、增强、合成技术,可构建高质量多模态数据集,具备数据偏差优化、数据安全合规研究意识。 四、科研创新能力要求1. 独立研究能力:可独立拆解科研课题、调研前沿技术、设计实验方案、攻克技术难点,具备从理论研究、原型开发到效果验证的全流程研究能力。 2. 学术成果输出:具备顶会(NeurIPS、ICML、CVPR、ACM MM等)、核心期刊论文撰写与发表能力,有相关论文、专利、开源项目成果者优先。 3. 技术洞察能力:持续跟踪多媒体、多模态AI、音视频处理、图形仿真领域前沿技术,可结合行业场景输出技术研判、创新方案与研究报告。 4. 原型开发能力:熟练使用Python、MATLAB快速搭建算法原型,可完成技术demo验证、效果对比测试,精准验证算法可行性与先进性。 五、落地优化与项目能力1. 性能优化:针对多媒体算法的帧率、延迟、码率、画质、算力消耗进行专项优化,平衡算法效果与工程落地性能,适配移动端、云端、实时流媒体等不同场景。 2. 场景落地:熟悉短视频、直播、虚拟数字人、沉浸式媒体、多媒体取证、智能画质增强等主流应用场景,具备科研成果产业化落地经验。 3. 项目推进:具备科研项目立项、技术攻关、进度管控、成果复盘能力,可独立承担核心研究课题,配合团队完成技术迭代与产品落地。 六、通用素养与加分项1. 基础素养:具备良好的技术文档撰写、专利申报、研究报告输出能力,逻辑清晰、严谨细致,具备较强的问题分析与攻坚能力。 2. 协作能力:具备跨团队协作沟通能力,可高效对接算法、工程、产品团队,精准落地研究成果,适配高强度科研与项目迭代节奏。 3. 优先加分:拥有多媒体算法落地项目经验、顶会论文/授权专利、开源项目贡献;熟悉端侧多媒体开发、实时AI多媒体系统搭建;具备跨学科融合研究经验者优先。 |
|||