0

0

AI金字塔的底层:时薪15美元的“数据标注员”

WBOY

WBOY

发布时间:2023-05-25 22:25:22

|

1181人浏览过

|

来源于搜狐

转载

人工智能的应用已经相当火热,chatgpt看起来就像“有求必应的魔法”,但这背后实际上有着劳动密集产业的功劳。

据CNBC和Gizmodo等媒体报道,OpenaAI雇佣了大量外包劳动力协助他们完成“必要的数据标记任务”——也就是给数据打标签,正式一点的名字叫做“数据标注员”、“数据标注师”,或者,“AI训练师”。

所谓打标签,就是给AI将要分析的数据样本打上不同标记(语音/图片/文本等),以帮助AI模型更好地识别数据集中的特定项,从而更快地相应用户的请求。

这是AI模型训练最基础的工作。

但这份工作毫无疑问是枯燥的,它包含着大量重复性的工作,操作者每天只需要辨别数据样本的类型,然后选择不同的标签。

一名接受CNBC采访的数据标注员Alexej Savreux说:

我们是工人,但没有我们就不会有人工智能语言系统。 你可以设计所有你想要的神经网络,你可以让所有你想要的研究人员参与进来,但没有标签,你就没有ChatGPT。你一无所有。

更关键的是,这样一份工作,薪酬是每小时15美元——高于美国各个州的最低工资,但并没有高出太多(Savreux所在的堪萨斯城,最低工资7.25美元)。

目前,国内的AI相关企业也在雇佣着这样的岗位。

科技媒体“鞭牛士”在3月的一篇文章中指出,和AI行业的高薪相比,数据标注员的工资并不高。

“一张图9毛钱,一天做100张。”lili称,如果都合格,一天能赚90块。

“不同的标注价格不一样。”何文新称,他当时的工资在3000左右。基础的数据标注员月薪大部分在2000-4000元之间,但因为标注的速度、质量问题,“很难拿到当时面试跟你承诺的工资。”

在一些招聘网站上,鞭牛士搜索了“数据标注”,并设定了薪资在2000-8000元之间的范围。一些特殊的标注,比如小语种、高精制图等,薪酬会更高。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

AI金字塔的底层:时薪15美元的“数据标注员”

人工智能,重点是人工

将重复劳动外包并不是人工智能行业独有的现象。

CNBC指出,硅谷一直都依靠着这些数以千计的低技能、低工资的外包工人的劳动来建立计算机帝国,但这些工人自始至终都处于“低人一等”的地位

这些工作是不稳定的、按需分配的,人们通过书面合同直接受雇于一家公司或通过专门从事临时工或外包的第三方供应商。

健康保险等福利很少或不存在——这意味着科技公司的成本降低——而且工作通常是匿名的,所有的功劳都归于科技创业公司的高管和研究人员。

飞书多维表格
飞书多维表格

表格形态的AI工作流搭建工具,支持批量化的AI创作与分析任务,接入DeepSeek R1满血版

下载

现在,人工智能行业也在遵循这一游戏规则。而随着人工智能蓬勃发展,越来越多的数据标注员被雇佣,但越来越多这样的基础劳动被忽略。

非营利组织“AI伙伴关系中的AI、劳工和经济”(AI, labor and the economy at the Partnership on AI,PAI)项目负责人Sonam Jindal说:

围绕人工智能的许多讨论都是非常可喜的。

但我们忽略了故事的一个重要部分:这仍然极大地依赖于大量的人类劳动力。

漩涡中的科技巨头

当然,随着数据标注员这样的外包岗位已经被越来越多的组织看到,这也令科技巨头们不得不面对“麻烦”。

今年早些时候,据《时代》杂志报道,OpenAI正在依靠低工资的肯尼亚外包劳工来标记包含仇恨言论或性虐待语言的文本,以便其模型能更好地自行识别“有毒(toxic)”内容。

在肯尼亚内罗毕,150多名曾为Facebook、TikTok和ChatGPT从事AI工作的人投票决定成立工会,理由是工资低和工作的精神负担。

另一媒体Semafor在今年1月报道称,OpenAI在东欧和拉丁美洲等地雇佣了大约1000名远程外包工人,为数据贴标签或对公司软件进行计算机工程任务培训,那里的工资低至2美元/小时。

与此相对的另一个数据是,截至今年1月,OpenAI约有375名员工。

而该公司的一位发言人说,没有人可以回答有关其使用人工智能外包员工的问题。

PAI在2021年的一份报告中警告称,对所谓“数据填充工作”的需求正在激增,该组织建议该行业致力于公平的补偿和其他改进的做法,并在去年发布了供公司遵循的自愿准则。

CNBC指出,谷歌的AI子公司DeepMind是迄今为止唯一公开承诺遵守这些准则的科技公司。

Jindal表示:

很多人已经认识到这是很重要的事情。现在的挑战是如何让公司去做。

这是一个由人工智能创造的新工作,我们有可能让这成为一份高质量的工作,让从事这项工作的工人因其对实现这一进步的贡献而受到尊重和重视。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
ChatGPT注册
ChatGPT注册

ChatGPT注册方法:1、访问OpenAI的官方网站,进入注册页面;2、完成注册后收到一份邮件,打开后点击验证账号;3、选择一个适合您需求的订阅计划;4、获得访问ChatGPT的权限即可。

558

2023.09.12

国内免费ChatGPT大全
国内免费ChatGPT大全

ChatGPT是一种基于深度学习技术的自然语言处理模型,由OpenAI开发。它是GPT的一个变体,专门设计用于生成上下文相关的文本回复。ChatGPT被训练成一个聊天机器人,可以与用户进行对话交互。更多关于ChatGPT的文章详情请查看本专题,希望对大家能有所帮助。

616

2023.10.25

手机安装chatgpt的方法
手机安装chatgpt的方法

手机安装chatgpt的方法:1、在ChatGTP官网或手机商店上下载ChatGTP软件;2、打开后在设置界面中,选择语言为中文;3、在对局界面中,选择人机对局并设置中文相谱;4、开始后在聊天窗口中输入指令,即可与软件进行交互。想了解更多chatgpt的相关内容,可以阅读本专题下面的文章。

3042

2024.03.05

chatgpt国内可不可以使用
chatgpt国内可不可以使用

chatgpt在国内可以使用,但不能注册,港澳也不行,用户想要注册的话,可以使用国外的手机号进行注册,注意注册过程中要将网络环境切换成国外ip。想了解更多chatgpt的相关内容,可以阅读本专题下面的文章。

1099

2024.03.05

C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

74

2026.03.11

Go高并发任务调度与Goroutine池化实践
Go高并发任务调度与Goroutine池化实践

本专题围绕 Go 语言在高并发任务处理场景中的实践展开,系统讲解 Goroutine 调度模型、Channel 通信机制以及并发控制策略。内容包括任务队列设计、Goroutine 池化管理、资源限制控制以及并发任务的性能优化方法。通过实际案例演示,帮助开发者构建稳定高效的 Go 并发任务处理系统,提高系统在高负载环境下的处理能力与稳定性。

38

2026.03.10

Kotlin Android模块化架构与组件化开发实践
Kotlin Android模块化架构与组件化开发实践

本专题围绕 Kotlin 在 Android 应用开发中的架构实践展开,重点讲解模块化设计与组件化开发的实现思路。内容包括项目模块拆分策略、公共组件封装、依赖管理优化、路由通信机制以及大型项目的工程化管理方法。通过真实项目案例分析,帮助开发者构建结构清晰、易扩展且维护成本低的 Android 应用架构体系,提升团队协作效率与项目迭代速度。

83

2026.03.09

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

97

2026.03.06

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

223

2026.03.05

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
麻省理工大佬Python课程
麻省理工大佬Python课程

共34课时 | 5.5万人学习

国外Web开发全栈课程全集
国外Web开发全栈课程全集

共12课时 | 1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号