W.AI工作标准面向AI从业者给我的 Agent
研究预览:任务标准为草案,本站未运行AI实测;外部评测数值不代表本站任务成绩。方法与局限 →

面向AI从业者 · 研究预览

AI岗位的工作,
怎样交付、怎样验收?

覆盖AI开发、AI产品、企业交付、数据分析与内容增长。把一项具体工作拆成AI能推进的步骤、人的判断和验收标准,再交给你的Agent。

5个方向 · 20项标准草案 · 5项完整示例

先找到你要完成的工作

选一个方向,看具体交付

全部任务 →

把一个岗位拆成任务

每项任务,AI参与到哪一步

数据与口径 →

每一行是本站一个方向的参照职业,每一段是它在O*NET中的一项任务。悬停或点击一段查看任务,点击职业名看逐项明细。

软件开发人员17项任务监控设备运行,确保系统符合规格:自动化交互 95% · AI自主度 2.65/5 · 人独立约20分钟,借助AI约2分钟(模型估计)修改现有软件:修复错误、适配新硬件、升级接口或提升性能:自动化交互 69% · AI自主度 2.87/5 · 人独立约5.1小时,借助AI约42分钟(模型估计)分析信息,建议并规划新系统的安装或现有系统的改造:自动化交互 50% · AI自主度 2.92/5 · 人独立约10.5小时,借助AI约61分钟(模型估计)分析用户需求与软件需求,判断设计在时间和成本约束下是否可行:自动化交互 44% · AI自主度 2.94/5 · 人独立约11.2小时,借助AI约58分钟(模型估计)与系统分析师、工程师、程序员等沟通系统设计,了解项目限制、性能要求与接口:自动化交互 41% · AI自主度 2.42/5 · 人独立约7.9小时,借助AI约105分钟(模型估计)撰写关于项目规格、进展或状态的报告与沟通文件:自动化交互 49% · AI自主度 2.5/5 · 人独立约4.5小时,借助AI约54分钟(模型估计)运用科学分析和数学模型设计、开发与修改软件系统,预测并衡量设计的结果:自动化交互 42% · AI自主度 3.1/5 · 人独立约14.7小时,借助AI约63分钟(模型估计)就项目状态、方案或技术问题(如系统设计与维护)与客户或其他部门沟通:自动化交互 47% · AI自主度 2.64/5 · 人独立约5.4小时,借助AI约56分钟(模型估计)制定或指导软件系统的测试与验证流程、编程及文档:该月未公布使用数据(样本未达公布门槛,不等于零)协调软件系统的安装:该月未公布使用数据(样本未达公布门槛,不等于零)存取和处理数据,用于分析系统能力与需求:该月未公布使用数据(样本未达公布门槛,不等于零)确定系统性能标准:该月未公布使用数据(样本未达公布门槛,不等于零)指导程序员、技术人员及其他工程与科研人员的工作:该月未公布使用数据(样本未达公布门槛,不等于零)与数据处理或项目经理沟通,了解数据处理项目的限制与能力:该月未公布使用数据(样本未达公布门槛,不等于零)为程序员、设计师、技术人员等分派并监督工作:该月未公布使用数据(样本未达公布门槛,不等于零)收集并评估报表格式、成本、安全需求等信息,确定硬件配置:该月未公布使用数据(样本未达公布门槛,不等于零)培训用户使用新设备或改造后的设备:该月未公布使用数据(样本未达公布门槛,不等于零)委派 3 · 协作 5 · 未公布 9
IT项目经理21项任务与项目成员沟通,发现并解决问题:自动化交互 95% · AI自主度 2.55/5 · 人独立约8.2小时,借助AI约42分钟(模型估计)监控和跟踪项目里程碑与交付物:自动化交互 100% · AI自主度 3/5 · 人独立约46分钟,借助AI约3分钟(模型估计)制定或更新IT项目计划,包括目标、技术、系统、信息规格、进度、资金与人员:自动化交互 71% · AI自主度 3.06/5 · 人独立约6.6小时,借助AI约43分钟(模型估计)收集、分析和汇总信息与趋势,撰写项目状态报告:自动化交互 67% · AI自主度 3.21/5 · 人独立约5.8小时,借助AI约30分钟(模型估计)制定并管理IT项目的工作分解结构(WBS):自动化交互 58% · AI自主度 3.08/5 · 人独立约7.8小时,借助AI约44分钟(模型估计)发起、审查或批准项目计划的变更:自动化交互 40% · AI自主度 2.88/5 · 人独立约6小时,借助AI约56分钟(模型估计)开展风险评估并制定应对策略:自动化交互 39% · AI自主度 2.89/5 · 人独立约5.5小时,借助AI约30分钟(模型估计)管理项目执行,确保预算、进度与范围达标:该月未公布使用数据(样本未达公布门槛,不等于零)提交项目交付物,确保符合质量标准:该月未公布使用数据(样本未达公布门槛,不等于零)通过直接沟通、调查等方式评估客户当前及未来的需求与优先级:该月未公布使用数据(样本未达公布门槛,不等于零)安排并主持IT项目相关会议:该月未公布使用数据(样本未达公布门槛,不等于零)指挥或协调项目成员的工作:该月未公布使用数据(样本未达公布门槛,不等于零)识别项目初期或追加的资源需求:该月未公布使用数据(样本未达公布门槛,不等于零)制定包含成本收益或投资回报分析的实施计划:该月未公布使用数据(样本未达公布门槛,不等于零)识别、评审或选择满足项目需要的供应商或顾问:该月未公布使用数据(样本未达公布门槛,不等于零)制定并管理IT项目的年度预算:该月未公布使用数据(样本未达公布门槛,不等于零)制定并执行项目沟通计划:该月未公布使用数据(样本未达公布门槛,不等于零)跟踪项目成员的绩效,给出并记录反馈:该月未公布使用数据(样本未达公布门槛,不等于零)协调项目人员的招聘或选拔:该月未公布使用数据(样本未达公布门槛,不等于零)为项目成员分配职责与授权范围:该月未公布使用数据(样本未达公布门槛,不等于零)与项目干系人或供应商谈判,获取资源或物料:该月未公布使用数据(样本未达公布门槛,不等于零)委派 5 · 协作 2 · 未公布 14
计算机系统分析师22项任务排查程序与系统故障,恢复正常运行:自动化交互 90% · AI自主度 2.84/5 · 人独立约6.5小时,借助AI约78分钟(模型估计)帮助员工和用户解决故障、程序问题等计算机相关问题:自动化交互 87% · AI自主度 2.38/5 · 人独立约1.9小时,借助AI约57分钟(模型估计)测试、维护和监控程序与系统,包括协调程序与系统的安装:自动化交互 96% · AI自主度 3.05/5 · 人独立约3.5小时,借助AI约21分钟(模型估计)用计算机分析和解决业务问题,如开发集成的生产、库存控制与成本分析系统:自动化交互 51% · AI自主度 3.03/5 · 人独立约8.8小时,借助AI约63分钟(模型估计)协调并连接组织内的计算机系统,提高兼容性以便共享信息:自动化交互 95% · AI自主度 2.48/5 · 人独立约1.9小时,借助AI约25分钟(模型估计)使用面向对象编程语言,以及客户端与服务端应用开发、多媒体和互联网技术:自动化交互 67% · AI自主度 3.2/5 · 人独立约16.8小时,借助AI约56分钟(模型估计)审查计算机输出和性能指标,定位并修正代码问题:自动化交互 86% · AI自主度 2.93/5 · 人独立约9.1小时,借助AI约89分钟(模型估计)扩展或改造系统,以支持新用途或改进工作流程:自动化交互 69% · AI自主度 3.08/5 · 人独立约8.3小时,借助AI约49分钟(模型估计)培训员工和用户使用计算机系统与程序:自动化交互 62% · AI自主度 2.66/5 · 人独立约6.5小时,借助AI约163分钟(模型估计)评估现成应用软件包的适用性,并适配到用户环境:自动化交互 56% · AI自主度 3.17/5 · 人独立约5.1小时,借助AI约27分钟(模型估计)阅读手册、期刊和技术报告,学习如何开发满足员工和用户需求的程序:自动化交互 60% · AI自主度 2.56/5 · 人独立约3小时,借助AI约15分钟(模型估计)与客户沟通程序要解决的信息处理或计算需求:自动化交互 51% · AI自主度 2.72/5 · 人独立约10.8小时,借助AI约97分钟(模型估计)用结构化分析、数据建模等方法分析信息处理需求,并规划和设计计算机系统:自动化交互 39% · AI自主度 2.97/5 · 人独立约11.1小时,借助AI约64分钟(模型估计)推荐新的设备或软件包:自动化交互 31% · AI自主度 2.66/5 · 人独立约1.7小时,借助AI约24分钟(模型估计)定义系统目标,绘制描述程序逻辑步骤的流程图:自动化交互 44% · AI自主度 3.03/5 · 人独立约6.6小时,借助AI约30分钟(模型估计)与管理层沟通,确保就系统原则达成一致:该月未公布使用数据(样本未达公布门槛,不等于零)确定系统使用的输入,规划结果的分发与使用:该月未公布使用数据(样本未达公布门槛,不等于零)通过访谈、调查、观察或亲自操作,了解处理哪些信息以及如何处理:该月未公布使用数据(样本未达公布门槛,不等于零)指导程序员或其他系统分析师,或担任具体系统项目的负责人:该月未公布使用数据(样本未达公布门槛,不等于零)确定搭建或改造系统所需的软件或硬件:该月未公布使用数据(样本未达公布门槛,不等于零)制定、记录和修订系统设计流程、测试流程与质量标准:该月未公布使用数据(样本未达公布门槛,不等于零)开展成本收益与投资回报分析,辅助系统实施决策:该月未公布使用数据(样本未达公布门槛,不等于零)委派 12 · 协作 3 · 未公布 7
数据科学家16项任务使用统计软件分析、处理大规模数据:自动化交互 50% · AI自主度 3/5 · 人独立约9.8小时,借助AI约61分钟(模型估计)向管理层或最终用户口头或书面汇报建模与数据分析结果:自动化交互 71% · AI自主度 2.79/5 · 人独立约3.6小时,借助AI约16分钟(模型估计)使用统计软件清洗和处理原始数据:自动化交互 59% · AI自主度 2.91/5 · 人独立约7.2小时,借助AI约53分钟(模型估计)用损失函数、解释方差占比等统计指标比较模型:自动化交互 52% · AI自主度 2.81/5 · 人独立约8.6小时,借助AI约72分钟(模型估计)利用数据分析结果为预算、人员配置、营销等业务问题找到方案:自动化交互 61% · AI自主度 2.91/5 · 人独立约6.6小时,借助AI约51分钟(模型估计)用编程语言编写新的函数或应用来开展分析:自动化交互 58% · AI自主度 2.95/5 · 人独立约8小时,借助AI约54分钟(模型估计)运用数学理论与方法为工程、科学等领域提出解决方案:自动化交互 52% · AI自主度 2.6/5 · 人独立约3.3小时,借助AI约30分钟(模型估计)使用专业软件制作图表等可视化,呈现数据分析结果:自动化交互 43% · AI自主度 3.28/5 · 人独立约8.1小时,借助AI约31分钟(模型估计)测试、验证并改进模型,确保对目标结果的预测准确:自动化交互 45% · AI自主度 3.05/5 · 人独立约17小时,借助AI约90分钟(模型估计)向关键干系人提出数据驱动的解决方案:自动化交互 30% · AI自主度 2.71/5 · 人独立约7.1小时,借助AI约56分钟(模型估计)识别可能影响研究结果的关系、趋势或其他因素:自动化交互 35% · AI自主度 2.77/5 · 人独立约7.8小时,借助AI约55分钟(模型估计)识别可以通过数据分析解决的业务问题或管理目标:该月未公布使用数据(样本未达公布门槛,不等于零)对预测销售、流失、医疗使用等结果的模型应用特征选择算法:该月未公布使用数据(样本未达公布门槛,不等于零)阅读论文、会议资料等研究文献,了解新兴的分析趋势与技术:该月未公布使用数据(样本未达公布门槛,不等于零)应用抽样方法确定调查对象,或采用全面普查:该月未公布使用数据(样本未达公布门槛,不等于零)设计调查问卷、民意测验等数据收集工具:该月未公布使用数据(样本未达公布门槛,不等于零)委派 7 · 协作 4 · 未公布 5
市场研究分析师与营销专员13项任务撰写研究结论报告,用图表展示数据,把复杂发现转成文字:自动化交互 60% · AI自主度 3.18/5 · 人独立约11.2小时,借助AI约33分钟(模型估计)收集并分析客户的人口特征、偏好、需求和购买习惯,识别潜在市场与影响需求的因素:自动化交互 40% · AI自主度 2.92/5 · 人独立约4.5小时,借助AI约22分钟(模型估计)收集竞争对手数据,分析其价格、销售以及营销与分销方式:自动化交互 42% · AI自主度 2.97/5 · 人独立约11.3小时,借助AI约51分钟(模型估计)分析收集的数据,预测并跟踪营销与销售趋势:自动化交互 42% · AI自主度 2.93/5 · 人独立约9.8小时,借助AI约42分钟(模型估计)制定并实施识别广告需求的流程:自动化交互 33% · AI自主度 2.93/5 · 人独立约7.6小时,借助AI约50分钟(模型估计)收集并提供信息,帮助公司判断自身的市场定位:该月未公布使用数据(样本未达公布门槛,不等于零)与营销人员、统计人员、调查人员等合作,研究消费者观点与营销策略:该月未公布使用数据(样本未达公布门槛,不等于零)设计和评估问卷、民意调查等数据收集方法,或安排获取现有数据:该月未公布使用数据(样本未达公布门槛,不等于零)衡量和评估客户与员工满意度:该月未公布使用数据(样本未达公布门槛,不等于零)监测行业统计数据,跟踪行业文献中的趋势:该月未公布使用数据(样本未达公布门槛,不等于零)参加内部会议,向管理层提供产品推广、分销、设计和定价的信息与建议:该月未公布使用数据(样本未达公布门槛,不等于零)衡量营销、广告与传播项目及策略的效果:该月未公布使用数据(样本未达公布门槛,不等于零)指导经过培训的调查访问员:该月未公布使用数据(样本未达公布门槛,不等于零)委派 1 · 协作 4 · 未公布 8

宽度:O*NET任务重要度(不是工时);颜色:Anthropic经济指数中2026-05全球Claude聊天里该任务的交互方式。显示人们怎样用AI,不是AI完成率或岗位可替代比例。

每个方向一项完整示例

先走完一项工作,再判断能否委派

完整示例包含输入说明、分工步骤、常见失败和人工构造的产物样例。其余任务是基础草案,可作为起点交给Agent补全。

数据分析DATA-01

核对订单收入,找出差异

标准:订单净额查询与对账

SQL · 逐单对账与数据质量记录

人的责任确认业务口径与来源完整性
完整示例3条验收门槛 · 4组相关来源
AI开发DEV-01

修复重复提交导致的重复写入

标准:受限接口幂等修复

补丁 · 反例与回归 · 影响和恢复说明

人的责任确定业务操作身份与合并决定
完整示例3条验收门槛 · 3组相关来源
企业交付 / FDEFDE-02

连接业务系统,交付可恢复的流程

标准:受限业务系统集成与交接

集成 · 对账 · 故障/撤销 · 运维交接

人的责任客户系统所有者批准上线;FDE负责交付事实
完整示例4条验收门槛 · 7组相关来源
AI产品PM-02

设计AI失败时可恢复、可接管的交互

标准:带失败恢复的人机交互规格

原型 · 验收 · 纠错/撤销/升级说明

人的责任设定用户控制和组织责任
完整示例3条验收门槛 · 2组相关来源
内容与增长GROW-01

按人群制作有事实依据的内容

标准:证据驱动的分群内容

内容草稿 · 主张台账 · 来源与限制

人的责任保证产品事实和发布责任
完整示例3条验收门槛 · 3组相关来源

公开评测覆盖

五个方向,公开评测覆盖到哪里

全部24组来源 →

按本站任务关联的外部评测整理。数值是评测作者在各自任务集上的结果,不是本站任务的成绩。

业务职能方向(销售、客服、财务等)的公开研究见 AutomationBench、Anthropic职业数据与GDPval →

怎样核查

每个判断,都能沿依据往回查

证据方法 →

机构名称仅标识资料出处,不代表对本站背书;来源多也不自动构成交叉验证。同一实验的论文与博客只算一组证据。

  1. 01 任务标准输入、交付与验收门槛
  2. 02 适用性判断覆盖哪些环节,还缺什么
  3. 03 评测条件版本、配置、指标与人的参与
  4. 04 原始资料论文、项目、结果与修订记录
展开6组重点来源与证明方式

最新依据,怎样影响工作

全部变化 →
资料维护

DABstep区分已验证与未验证结果

对工作的影响

使用数据分析证据时,先核对榜单验证状态;继续按本地业务门槛验收,不因榜单维护状态改变委派范围。

资料维护

营销自测保留可复核性缺口

对工作的影响

将营销供应商自测作为补充线索;验收标准不因自报分数而降低。等待可访问的任务和运行记录再评估支持力度。