AI 视角
“找漏洞就是护住系统的最后一道门。”
生成式人工智能系统测试员是专门给能自动生成文字、图片、声音、视频的人工智能系统挑毛病的人,通过设计各种输入条件、运行测试、分析结果,来判断系统生成的内容对不对、稳不稳、安不安全,把问题报给改进的人。
常见叫法:没有特别普及的俗称,同行交流时偶尔简称为'大模型测试',但一般还是叫全称。
就像手机出新系统前要找一群人反复点、反复试,看会不会闪退、会不会乱码,这个工种就是干这个的,只不过对象是那些能写文章、画图的人工智能。
要是少了这帮人,生成式系统上线后可能胡言乱语、泄露隐私、甚至输出有害内容,出了问题再补救代价就大了,用户信任也塌了。
常被误以为就是普通软件测试,或者以为能直接改代码修漏洞,实际上只负责测和报,不动手改模型本身。
主要在写字楼或科技园区的办公位,有时去机房或实验室环境。
周围是多块显示器、测试日志滚动、代码和生成结果并排比对,偶尔有模型训练的低嗡声。
天天和开发工程师、产品经理、安全合规人员打交道,偶尔对接数据标注团队确认样本问题。
一般跟着项目走,正常朝九晚六,发版前集中赶测时会加班到深夜。
节假日按法定休息,但线上系统出问题或紧急发版时得随时响应。
大多数人是从计算机、软件工程相关专业毕业进来的,校招或社招时投测试岗,面试考编程基础和测试思维,有的公司会加考对大模型原理的理解。也有从传统软件测试转过来的,补学生成式系统的特点后上手。入行本身一般不用考特定资格证,但部分大厂或政府项目会要求有软件评测相关的培训证明。对身体没有特殊硬要求,但长时间盯屏幕、高强度集中注意是常态。
这一行的收入多数由基本工资加上项目绩效构成,绩效跟系统测试覆盖的模型数量、上线后的稳定表现挂钩,做得扎实、少返工,拿到的部分就实在一些。
刚开始做基础测试和数据处理,收入平平;能独立盯完整条生成链路、把问题定位到模型和参数层面以后,收入会往上走,再往后带项目、做方案,空间会再拉开一截。
运用生成式人工智能技术及工具,从事生成式人工智能系统设计、调用、训练、优化、维护管理等工作的人员
来源:国家职业分类大典2022版及后续增补版
欲善其事,先利其器。