岗位职责
- 数据处理与治理:负责医疗场景下的多模态数据(如医学影像、视频、语音、病历等)的清洗、标准化、标注与增强,构建高质量、符合业务需求的专项数据集;
- OCR技术开发与应用:主导并优化OCR技术,针对医疗文档、报告、表格等复杂版式,实现高精度的文本检测、识别与关键信息的结构化提取;
- 大模型微调与强化:针对具体场景,完成领域大模型的指令微调与强化,优化模型对医疗数据的理解、推理与处理能力;
- 可信AI与评估体系构建:结合知识图谱和询证原则构建模型能力对齐与评估体系,确保模型输出的准确性、安全性与逻辑一致性,推动模型迭代;
- 技术前瞻与创新:跟踪多模态大模型前沿进展,探索其在医疗健康领域的创新应用场景,并推进技术原型验证与落地。
任职要求
- 扎实的代码能力、工程能力、数据结构和基础算法功底;熟练Python或JAVA;
- 熟悉NLP、CV、RL相关的算法和技术,熟悉大模型训练;
- 有医疗大模型经验优先,有参与过大影响力模型项目者优先,ACM、Kaggle等比赛获奖者优先;有顶会论文者优先。
特色标签
DICOM格式、Docker、Elasticsearch、Hadoop、Hive、Java、Java开发、JVM、Kafka、MongoDB、MyBatis、MySQL、NLP、Python、Python开发、Redis、Spark、Spring、云计算经验、人工智能、分布式经验、医疗、医疗逻辑、大数据经验、实体识别、影像分析、效率提升、数据可视化、数据标注、数据监控、数据质量、智能体、架构设计经验、标注、标注平台、流程优化、自动标注、自然语言处理、诊断一致性、质量检测