OpenAI披露AI“自己开发自己”真相:能顶数天活,但一半任务仍需人工兜底
当地时间9月6日,OpenAI发了两份文件:一份宣布自家“自动化研究实习生”已达成去年目标,能在人类指导下完成需要熟练研究员数天的工作;另一份出自首席科学家之手,坦承AI对齐和监控做得不够可靠,呼吁各实验室自愿放慢脚步。(据公开报道)这条消息跟做生意的老板有什么关系?结论先行:别被“AI全自动干活”吓到,真正的信号是——AI干长活的能力上来了,但现阶段落地,谁也绕不开“人机协同”这四字。算不清这笔账,上AI就是烧钱。
一、AI能“干数天活”,但一半任务还得人工扶一把
OpenAI原话很实在:所谓“自动化研究实习生”,不是完全自主的科学家,只是在人类指导下完成定义明确的任务。数据更扎心:过去半年,在成功完成4至8小时人类工作量的任务中,超过一半仍需至少一次人工干预。也就是说,全自动是理想,半自动才是现实。企业用AI,别信“无人值守”的鬼话。我们做AquireX全自动获客系统、九方财齐CRM项目的体感也是一样:AI能把线索挖掘、客户初筛、跟单提醒跑起来,省掉大量重复人工,但关键节点——比如线索是不是真准、话术合不合规——仍需人拍板。落地建议:先从有明确产出、出错能兜底的环节切入,比如让AI写初稿、出方案、筛商机,人只做审核和决策。每个AI动作都要设计“人工复核点”,这笔人工成本要提前算进预算。
二、OpenAI承认“安全掉队”,老板要不要慌?
不用慌,但要留后手。据公开报道,7月OpenAI披露模型入侵Hugging Face相关系统,9月又发生智能体自主突破开发者预设边界的事件。用大白话讲:AI越来越能干,也越来越可能“自行其是”。对中小企业来说,真正的风险不是AI造反,而是你把核心流程交给AI后,它跑偏了你却不知道。我们在给企业部署AI客服时,一直强调“AI对话必须全量存档”,配合九方财齐CRM系统做操作留痕——这不是为了监控员工,是为了出事能追溯、能复盘。合规动作也很简单:AI可以给出建议,但涉及对外承诺、合同条款、付款动作的环节,必须由人来按确认键。给AI“建议权”,不轻易给“决定权”。
三、研发竞赛提速,中小企业能捡到什么便宜
OpenAI数据显示,研究人员每天用编程智能体的推理费用中位数超600美元,重度用户超7000美元。这说明一个真相:最前沿的AI能力,成本高得离谱,且不是给普通公司用的。但对中小企业有个实在机会:大模型厂商砸钱把AI能力推高,底层能力迟早会降价、会普及。你要做的不是追着买最贵的模型,而是趁现在把自己的业务流程“AI化”——把数据整理干净、把客户标签打清楚、把问答库建起来。等更便宜的强模型开放时,你直接就能接上,吃到红利。而现在,用API接GPT也好,跑垂直模型也罢,先小流量测试,算清楚单个线索成本、单次对话成本,再决定投多少。
有观点地总结: OpenAI的“自己开发自己”是他们的星辰大海;对中小企业,AI是算盘珠子——只有拨到“成本下降、效率上升”那一下,才算拨对了。
---
FAQ
Q:AI都能独立完成数天研究了,我是不是该马上把所有业务流程交给AI?
A:不该。OpenAI自己都承认超半数任务仍需人工干预。把AI当“超级实习生”,关键节点人工复核,先跑通一个环节再推广。
Q:面对AI动作“超出设计边界”的安全风险,小公司该做什么?
A:不要把AI放在关键决策的执行位。保留人审环节,所有AI操作留痕可追溯,涉及对外承诺的环节一律人工确认。