对157家企业的调查显示,50%的组织在过去一年曾部署通过内部评估但导致客户故障的AI智能体或大语言模型功能,5%的企业完全信任自动化评估,29%认为评估与现实结果对齐不佳是最大局限。
尽管信任度低,66%的企业已允许或正计划在12个月内实现低风险智能体的全自动、无人工干预部署。
157개 기업을 대상으로 한 설문조사에 따르면, 50%의 조직이 AI 에이전트나 내부 평가를 통과했지만 지난 1년간 고객 실패를 초래한 대규모 언어 모델 기능을 배포했고, 5%는 완전 신뢰받는 자동화 평가를, 29%는 평가와 실제 결과 간의 불완전한 정렬을 가장 큰 한계로 꼽았...
157개 기업을 대상으로 한 설문조사에 따르면, 50%의 조직이 AI 에이전트나 내부 평가를 통과했지만 지난 1년간 고객 실패를 초래한 대규모 언어 모델 기능을 배포했고, 5%는
완전 신뢰받는 자동화 평가를, 29%는 평가와 실제 결과 간의 불완전한 정렬을 가장 큰 한계로 꼽았습니다. 신뢰도가 낮음에도 불구하고, 66%의 기업이 12개월 이내에 인간의 개입 없이 저위험 에이전트를 완전 자동화된 상태로 배포할 것을 허용하거나 계획 중입니다.
对157家企业的调查显示,50%的组织在过去一年曾部署通过内部评估但导致客户故障的AI智能体或大语言模型功能,5%的企业完全信任自动化评估,29%认为评估与现实结果对齐不佳是最大局限。
尽管信任度低,66%的企业已允许或正计划在12个月内实现低风险智能体的全自动、无人工干预部署。
一项覆盖157家企业的调查显示,50%的组织曾在过去一年将通过内部评估的AI智能体或大语言模型功能投入生产,随后出现客户故障,反映内部测试结果与真实环境表现存在偏差。
调查中仅5%的企业表示完全信任自动化评估,29%将评估与现实结果对齐不佳视为最大局限。与此同时,66%的企业已允许或计划在12个月内对低风险智能体实行全自动、无人工干预部署。
Aioga判断,材料呈现的核心矛盾并非企业是否开展评估,而是评估结果能否代表生产环境。自动化评估信任度有限与自动部署推进并存,值得关注其风险识别和上线决策是否充分衔接。
这可能意味着,仅以内部评估通过作为部署依据,仍不足以排除客户侧故障。随着低风险智能体自动部署扩大,企业可能需要更谨慎地界定“低风险”,并持续核对评估结果与现实表现。 值得关注企业是否补充生产环境反馈、客户故障记录及人工复核机制,并明确自动部署的适用范围。后续报道还应核查调查对象构成、评估标准和“客户故障”的具体定义。
수집 피드는 제목, 요약, 출처와 원문 링크를 제공합니다. Aioga는 원문 전체를 재게시하지 않습니다.
수집 채널: RSS · 원본 도메인: venturebeat.com
출처: VentureBeat:AI(RSS)
원문 링크: 원문 열기
Aioga 아카이브: 정보 페이지 보기
Content record: summary-fallback · Updated: 2026-07-16T16:40:48.000Z

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。
立即访问 api.w173.comAioga는 전 세계 AI 동향을 집계하고 확인과 인용을 위해 출처 정보를 보존합니다.