【新智元导读】
Anthropic最新报告揭示,AI智能体在软件工程领域的使用量独占鳌头,占据近半壁江山,而其余16个垂直行业的份额则较为分散,每个行业的占比均不足9%。尽管AI已具备连续工作5小时的能力,但用户目前最多只让它跑42分钟,信任远未跟上技术发展的步伐。Y Combinator CEO陈嘉兴断言:在这片几乎空白的行业版图中,隐藏着下一代300个独角兽的机遇。
你所处的行业,或许还未见识过AI智能体的一分钟风采。
这一事实背后,蕴藏着巨大的机遇。
2026年2月18日,Anthropic发布了一份关于AI智能体实际使用情况的大规模研究报告(报告链接:https://anthropic.com/research/measuring...),该报告分析了其公共API上数百万次真实的人机交互数据。
报告的核心发现可以用一张柱状图来概括。
软件工程独占了49.7%的智能体工具调用量,如同一只拔地而起的烟囱。
剩下的16个垂直行业——医疗、法律、金融、教育、客服、物流等,每个行业的份额都是个位数:医疗1%,法律0.9%,教育1.8%,没有超过9%的。
Y Combinator的CEO陈嘉兴(Garry Tan)凝视着这张图,得出了一个让许多创业者坐立不安的结论:那片几乎空白的区域,正是下一代300个独角兽的藏身之地。
他的原话更加直白:「如果我今天创业,我会盯着那张柱状图上那一大片红色区域,直到从中找到自己的未来。」
这份报告里有一组数据,适合贴在每个产品经理的工位上。
根据独立评估机构METR的测试,Claude已经能够独立完成需要人类近5小时才能完成的工作。然而在实际使用中,即便是全球最激进的那批用户(统计意义上的第99.9百分位),单次让AI连续工作的时长也不过42分钟左右。
5小时的能力,却只能授权42分钟。
陈嘉兴将这一巨大的落差称为「部署积压」(deployment overhang)。
用大白话来说就是:AI已经准备好了,但人类还没准备好。
好消息是,人类正在追赶。
从2025年10月到2026年1月,第99.9百分位的会话时长几乎翻了一倍,从不到25分钟涨到了42分钟。
值得注意的是,这条增长曲线非常平滑,并没有因为新模型的发布而出现突然跳升。
换句话说,变化的主要驱动力不是模型变得更聪明了,而是人类在一次又一次的协作中学会了慢慢松手。
Anthropic内部的使用数据也印证了同样的趋势。
从2025年8月到12月,Claude Code在最困难任务上的成功率翻倍了,每次会话中人工介入的次数从5.4次降到了3.3次。
对于正在考虑创业方向的人来说,这意味着一件很具体的事:窗口期还在。
绝大多数行业甚至还没开始认真尝试让AI智能体介入自己的核心工作流。
不是技术不行,而是信任还没到。
关于人和AI如何磨合出默契,这份报告讲了一个很有意思的故事。
刚开始使用Claude Code的人中,只有大约20%的会话选择了「全自动批准」模式——也就是让AI自己跑,无需每一步都等人点头。
累计使用超过750次之后,这个比例上升到40%以上。
信任在日复一日的使用中缓慢增长,这种增长是可以被精确测量的。
一个反直觉的现象是:那些更愿意放手让AI运行的老用户,同时也更频繁地打断它。
新手的打断率大约是5%,而老手则达到了9%。
这看起来矛盾,其实是两种截然不同的工作方式。
新手像是在考场上监考,AI每写一道题都要看一眼;而老手更像是委托了一个信得过的下属,平时不盯着它,一旦感觉方向不对立刻喊停。
从「逐项审批」到「委托+监控」,这种转变对理解人机协作的未来至关重要。
...(内容略)...
本文由主机测评网于2026-07-06发表在主机测评网_免费VPS_免费云服务器_免费独立服务器,如有疑问,请联系我们。
本文链接:https://vpshk.cn/20260748999.html