1. AI가 저렴해질수록, 경쟁은 ‘일을 끝내는 능력’으로 옮겨간다
상품을 정확하게 찾아낸 AI가 예산을 초과해 결제했다면, 일을 잘한 것일까?
이 질문은 중국 AI 산업을 바라보는 기준이 왜 달라져야 하는지 보여준다.
이제 기업은 답변의 정확성과 함께 실제 업무가 제대로 완료됐는지를 따지기 시작했다.
그동안 중국 AI의 경쟁력은 주로 성능표로 설명됐다. 딥시크와 큐웬이 어떤 평가에서 앞섰는지, 해외 모델보다 얼마나 저렴한지가 관심사였다. 모델의 실력은 여전히 중요하다. 그러나 주문 처리와 자료 검토처럼 여러 단계가 연결된 업무에서는 높은 점수만으로 충분하지 않다.
기업이 원하는 것은 승인된 조건을 지키면서 업무를 끝내는 능력이다.
추론 비용의 하락은 이러한 변화를 뒷받침한다. 즈푸AI의 2026년 상반기 실적 관련 보도에 따르면, 회사는 단위 토큰당 추론 원가가 연초보다 80% 낮아졌다고 밝혔다. 모든 모델의 이용료가 같은 비율로 내려갔다는 뜻은 아니지만, AI를 반복적으로 활용하는 비용 부담이 줄어드는 흐름을 보여준다.
비용이 낮아지면 업무를 나누는 선택지도 넓어진다. 간단한 문서 분류는 가벼운 모델에, 복잡한 검토는 강력한 모델에 맡길 수 있다. 중요한 결과는 사람이 확인하면 된다. 이때 핵심은 모델을 많이 연결하는 것이 아니라, 각 단계의 역할과 검증 절차를 명확하게 만드는 것이다.
구매 업무라면 상품 검색부터 예산 확인, 주문, 배송지 입력까지 이어져야 한다. 어느 한 단계라도 잘못되면 전체 작업이 실패할 수 있다. 그래서 에이전트의 경제성도 토큰 가격만으로 판단하기 어렵다. 시스템 운영비와 사람의 검토 시간, 오류 복구 비용까지 계산해야 한다. 저렴한 AI가 실수를 반복하면 오히려 더 비싼 선택이 될 수 있다.
앞으로 기업이 주목할 숫자는 **‘업무 한 건을 제대로 끝내는 데 드는 총비용’**이다. 비슷한 성능의 모델을 구하기 쉬워질수록 업무 데이터와 시스템 연결, 결과 검증이 서비스의 차이를 만든다.
중국 AI의 다음 경쟁도 여기에 있다.
지능을 저렴하게 공급하는 능력과 함께, 그 지능을 믿고 맡길 수 있는 성과로 바꾸는 능력이 중요해지고 있다.
2. 에이전트를 일하게 만드는 실행 구조의 힘
모델과 에이전트의 차이는 실제 행동에서 드러난다. 모델은 질문을 이해하고 답변이나 계획을 생성할 수 있지만, 업무를 수행하려면 자료를 읽고 도구를 사용하며 작업 상태를 유지하는 기능이 필요하다. 여기에 접근 권한과 승인 절차, 실패 처리까지 더해져야 한다. 이런 실행 환경을 구성하는 하네스는 모델의 능력을 현실의 업무에 연결하는 역할을 한다. 지능을 갖추는 것과 지능에 일을 맡길 수 있는 조건을 만드는 것은 서로 연결된 별개의 과제다.
딥시크 하네스의 공식 안내는 에이전트를 모델과 하네스의 결합으로 설명한다. 모델·도구·스킬·세션·샌드박스·저장소·스케줄링 등을 플러그인으로 구성하고, 실행 과정을 기록해 검토와 재생 등에 활용하도록 설계했다. 현재 공개 제품은 개발자 프리뷰이므로 기능과 인터페이스가 바뀔 수 있다. 그럼에도 모델 공급사가 실행 환경과 기록 체계까지 경쟁 대상으로 삼는다는 점은 주목할 만하다. 딥시크 하네스 공식 안내
하네스의 중요성은 능력과 권한을 구분할 때 분명해진다. 에이전트가 주문 정보를 읽을 수 있다는 사실이 주문 취소까지 허용됐다는 뜻은 아니다. 상품을 비교할 수 있다고 결제할 권한까지 갖는 것도 아니다. 모델은 요청을 해석하고 행동을 제안할 수 있지만, 실제 실행은 사용자의 승인과 조직의 규칙을 충족해야 한다. 이 경계를 관리하지 않으면 높은 추론 능력이 오히려 넓은 범위의 잘못된 행동으로 이어질 수 있다.
사무용품 구매를 맡기는 상황을 생각해 보자. 에이전트는 필요한 품목과 재고, 가격, 배송 일정을 확인해야 한다. 동시에 예산 한도와 허용된 판매자, 대체 상품의 기준도 지켜야 한다. 일부 상품이 품절됐다고 임의로 비싼 제품을 구매하거나 다음 달 예산을 사용하는 것은 적절하지 않다. 안정적인 실행 구조는 이런 예외를 발견했을 때 추가 확인을 요청하고, 승인 전에는 결제를 진행하지 않도록 해야 한다.
기록은 실행 구조의 또 다른 핵심이다. 최종 결과만 남으면 문제가 모델의 해석에서 발생했는지, 도구가 반환한 정보에서 발생했는지, 권한 검사에서 발생했는지 구분하기 어렵다. 입력과 도구 호출, 반환 결과, 승인 과정이 기록되어야 원인을 검토할 수 있다. 다만 기록의 양이 안전성을 보장하지는 않는다. 누락과 변경 가능성, 접근 권한, 보관 기간, 개인정보 처리 방식까지 관리해야 감사와 복구에 활용할 수 있다.
플러그인 방식은 구성 요소를 교체하고 업무에 맞게 조합하기 쉽게 만든다. 그러나 연결되는 도구가 많아지면 검증할 범위도 넓어진다. 각 도구가 어떤 자료에 접근하는지, 외부로 무엇을 전달하는지, 실패했을 때 어떤 상태가 남는지 확인해야 한다. 웹페이지나 문서에 포함된 지시를 사용자의 명령처럼 받아들이는 문제도 고려해야 한다. 정보를 읽는 행위와 실행 지시를 수용하는 행위를 구분하는 설계가 필요하다.
따라서 하네스 경쟁은 화면의 편리함이나 연결 가능한 도구의 수만으로 평가하기 어렵다. 업무 완료율과 권한 관리, 중단 가능성, 복구 능력, 기록의 검토 가능성이 함께 중요하다. 모델이 똑똑해질수록 조직은 더 많은 일을 맡길 수 있지만, 그 범위는 실행 구조가 감당할 수 있는 통제 수준에 맞춰 넓혀야 한다. 중국 AI 산업에서 하네스의 부상은 지능을 만드는 경쟁과 지능을 운영하는 경쟁이 함께 진행되고 있음을 보여준다.
3. 국가의 목표가 산업의 공통 기준으로 이어지다
에이전트가 개별 기업을 넘어 사회 전반에서 활동하려면 공통 기준이 필요하다. 한 조직 안에서는 내부 규칙으로 계정과 권한을 관리할 수 있지만, 기업의 경계를 넘으면 서로 다른 운영 체계가 만난다. 상대방의 능력을 어떻게 평가할지, 어떤 조건에서 업무를 맡길지, 사고가 발생하면 무엇을 확인할지에 대한 합의가 요구된다. 정책은 확산의 방향을 제시하고, 기술 표준은 제품과 서비스를 비교할 기준을 마련할 수 있다.
중국 국무원의 2025년 「‘인공지능+’ 행동의 심화 실시에 관한 의견」은 AI를 생산과 소비, 공공서비스와 거버넌스 등으로 확산하는 방향을 담았다. 2027년까지 차세대 지능형 단말과 에이전트 등 응용의 보급률을 70% 넘게 높이고, 2030년에는 90% 이상으로 확대한다는 목표도 제시했다. 이 숫자는 에이전트만의 보급률이나 현재 실적이 아니다. 여러 지능형 응용을 포괄하는 정책 목표로 읽어야 한다. 국무원의 ‘인공지능+’ 의견
정책 목표가 있다는 사실만으로 성공적인 도입이 보장되지는 않는다. 실제 확산은 비용과 서비스 품질, 이용자의 신뢰, 산업별 규제, 기존 시스템과의 호환성에 영향을 받는다. 기능을 사용할 수 있는 상태와 핵심 업무에 지속적으로 활용하는 상태도 다르다. 따라서 성과를 평가하려면 도입 건수에 더해 어떤 업무를 맡기는지, 어느 정도의 자율성이 허용되는지, 사람의 검토가 얼마나 필요한지를 살펴봐야 한다.
기술 표준은 이러한 평가를 구체화하는 데 도움이 된다. 중국 통신 분야 업계 표준 YD/T 6925-2026은 2026년 6월 1일 발표되어 9월 1일부터 시행됐다. 국가 표준정보 플랫폼은 이 문서가 기초 능력과 계획, 기억, 도구 호출, 실행이라는 다섯 차원을 다룬다고 설명한다. 목적은 제품 개발을 안내하고 도입 조직의 제품 선정과 역량 구축에 참고 기준을 제공하는 것이다. 법적 허가제나 처벌의 직접 근거와는 구분해야 한다. 국가 표준정보 플랫폼의 표준 설명
공통 기준이 필요한 이유는 같은 ‘에이전트’라는 이름 아래 기능과 완성도가 다른 제품이 존재할 수 있기 때문이다. 어떤 제품은 요청에 따라 한 번 도구를 실행하고, 다른 제품은 여러 단계의 작업을 계획해 중간 결과에 따라 행동을 수정한다. 기억 기능도 대화를 저장하는 수준과 장기간의 업무 정보를 관리하는 수준이 다르다. 구매자는 명칭보다 실제 능력과 한계를 확인해야 한다.
기억 능력을 검토한다면 정보의 갱신과 삭제 방식, 사용자별 분리 여부가 중요하다. 도구 호출에서는 실패 처리와 중복 실행 방지, 권한 적용을 살펴볼 필요가 있다. 실행 능력에서는 완료를 어떻게 판단하고 일부 단계만 성공했을 때 어떻게 복구하는지가 핵심이다. 이는 도입 조직이 구성할 수 있는 실무적 질문이다. 표준이 있다는 사실만으로 개별 제품의 안정성이 입증되는 것은 아니므로 실제 환경에서 검증해야 한다.
중국의 움직임은 확산 목표와 기술 기준을 함께 마련한다는 점에서 의미가 있다. 다만 기준의 존재와 현장의 정착은 다른 단계다. 채택 범위와 검증 방식, 호환성, 사고 처리 절차가 뒤따라야 한다. 한국도 에이전트 도입 숫자에 더해 기업이 무엇을 믿고 구매할 수 있는지, 공공기관이 어떤 근거로 도입을 판단할지 고민해야 한다. 산업의 공통 기준은 기술을 제한하는 수단에 머무르지 않고, 도입의 불확실성을 줄이는 기반이 될 수 있다.
4. 서로 연결된 에이전트에 필요한 신뢰의 조건
에이전트가 서로 메시지를 주고받을 수 있다는 사실은 중요한 진전이다. 그러나 통신이 가능하다고 중요한 업무를 믿고 위임할 수 있는 것은 아니다. 상대방의 신원과 권한을 확인하고, 전달된 요청이 사용자의 의도를 유지하는지 검증해야 한다. 여러 서비스를 거치는 과정에서는 작은 누락도 실제 결과를 바꿀 수 있다. 에이전트 네트워크의 과제는 연결을 확대하는 일과 그 연결에서 신뢰를 보존하는 일을 함께 해결하는 것이다.
중국정보통신연구원 산하 타이얼 단말 실험실은 2026년 5월 관련 연합체 및 기업들과 에이전트 안전·신뢰 연결 프로토콜인 ASL을 발표했다. 공식 설명은 이를 MCP와 A2A 등과 상호 보완하는 틀로 소개하며 신뢰할 수 있는 신원·연결·의도·권한을 핵심으로 제시한다. 상대방의 사칭과 통신 내용의 변조, 의도 전달의 왜곡, 다단계 위임에서의 권한 문제를 다루려는 접근이다. 발표만으로 문제가 모두 해결됐다고 볼 수는 없지만, 무엇을 검증해야 하는지 보여준다. 중국정보통신연구원의 ASL 발표
출장 예약을 예로 들면 문제가 구체적으로 드러난다. 사용자가 예약 에이전트에 일정과 예산을 전달하면 항공권과 숙박 서비스를 조회하고 결제 서비스에 구매를 요청할 수 있다. 이때 최초의 예산 제한과 환불 조건이 마지막 단계까지 유지되어야 한다. 중간 서비스가 요청을 다시 표현하면서 조건을 누락하거나 받은 범위보다 넓은 권한을 넘기면, 최종 거래는 사용자의 의도와 달라질 수 있다.
신원 확인과 권한 확인도 분리해야 한다. 특정 기업이 관리하는 에이전트라는 사실이 확인되더라도 그 기업을 대신해 계약을 체결하거나 대금을 지급할 수 있는지는 별개의 문제다. 어떤 작업을 어느 금액까지 수행할 수 있는지, 다른 주체에게 다시 맡길 수 있는지 명확해야 한다. 필요한 업무만 허용하는 방식은 오류나 침해가 발생했을 때 피해 범위를 줄이는 데 도움이 된다.
권한에는 시간과 상태의 조건도 필요하다. 오늘만 유효한 승인을 다음 주 거래에 사용해서는 안 되며, 사용자가 도중에 취소했다면 후속 실행도 변경을 반영해야 한다. 예약 실행과 반복 결제에서는 최초 승인 이후 가격과 이용자의 상황이 달라질 수 있다. 따라서 승인 내용을 저장하는 데 더해 실행 시점에도 유효성을 확인해야 한다. 이런 원칙이 실제 서비스 사이에서 일관되게 작동하는지가 중요하다.
사용자의 의도를 구체화하는 과정 역시 쉽지 않다. “가장 적절한 상품”이라는 표현은 가격과 품질, 배송 속도 가운데 무엇을 우선하는지 불분명하다. 중요한 거래에서는 이런 모호함을 모델의 해석에만 맡기기보다 금액과 대상, 일정, 승인 방식처럼 확인 가능한 조건으로 바꿔야 한다. 에이전트가 스스로 판단할 범위와 사용자에게 다시 확인할 범위를 정하면 효율과 통제를 함께 높일 수 있다.
신뢰 확보가 과도한 정보 공유로 이어져서도 안 된다. 위임을 검증하기 위해 모든 대화와 개인정보를 모든 서비스에 전달할 필요는 없다. 각 주체가 업무에 필요한 정보만 확인하도록 설계하고, 기록의 접근 권한과 보관 기간을 관리해야 한다. 에이전트 사회의 신뢰는 많은 데이터를 모으는 것보다 필요한 사실을 정확히 증명하는 능력에서 형성된다. 앞으로 연결의 규모와 함께 의도와 권한을 보존하는 품질이 경쟁력의 중요한 기준이 될 것이다.
5. KYA가 묻는 질문, 누구의 권한으로 돈을 움직이는가
에이전트의 신뢰 문제가 가장 직접적으로 드러나는 영역은 결제다. 추천이 잘못됐을 때는 사용자가 선택을 바꿀 수 있지만, 결제가 실행되면 돈이 이동하고 계약 관계가 발생한다. 상품 검색을 요청하는 것과 구매를 승인하는 것은 다르며, 구매 승인에도 금액과 수량, 판매자, 실행 시점 같은 조건이 붙는다. 에이전트 결제는 자연어로 전달된 의도를 실제 금융 행위에 적용할 수 있는 권한으로 구체화해야 한다.
중국지급청산협회는 2026년 8월 24일 「에이전트 결제 응용 자율규약」을 발표했다. 공개 규약 제9조는 KYC를 기초로 KYA 체계를 탐색하고 구축하도록 한다. 결제 경로에 접속하는 에이전트의 신원을 식별·검증하고, 이용자를 실명으로 관리하며, 계약 등을 통해 에이전트와 사용자 사이의 관계를 명확히 하라는 내용이다. KYA는 고객 확인을 대체하기보다 고객을 대신해 행동하는 소프트웨어의 확인 절차를 추가하는 접근이다. 에이전트 결제 자율규약 공개본
핵심은 에이전트에게 독립적인 법적 인격을 부여하는 것이 아니라 행동을 기존 책임 주체와 연결하는 데 있다. 사고가 발생하면 계정 명의만 확인해서는 충분하지 않다. 어떤 요청이 전달됐고, 어떤 권한이 부여됐으며, 어느 서비스가 결제를 실행했는지 살펴봐야 한다. 신원 확인은 이런 조사의 출발점이지만, 확인된 에이전트도 잘못된 정보를 해석하거나 승인 범위를 벗어날 수 있으므로 후속 통제가 필요하다.
신호등의 비유를 적용하면 초록불은 에이전트의 전반적인 우수성을 뜻하지 않는다. 현재 거래가 승인 조건을 충족한다는 의미여야 한다. 같은 에이전트라도 소액 구매와 큰 금액의 송금에는 다른 확인 절차가 필요할 수 있다. 사용자가 권한을 철회했다면 과거의 인증만으로 거래를 허용해서는 안 된다. 거래 대상과 금액, 권한의 유효성을 실행 순간에 확인하는 구조가 중요하다.
모든 통제를 언어모델이 맡을 필요도 없다. 금액 한도와 유효기간처럼 명확한 조건은 정해진 규칙으로 검사할 수 있다. AI는 비정상적인 양상을 찾거나 기록을 정리하는 데 활용할 수 있지만, 중요한 판단을 추론 결과에만 의존하면 일관성을 확보하기 어려울 수 있다. 규칙에 따른 검사와 위험 분석, 추가 승인 절차를 업무에 맞게 조합하고 중단과 복구 경로를 마련해야 한다.
자율규약과 법률의 효력은 구분해야 한다. 업계 기준이 계약과 운영에 반영되면 실질적인 영향력이 생길 수 있지만, 모든 규약 위반이 곧 법 위반은 아니다. 공개 규약은 결제 핵심 업무를 인가받은 기관이 수행하고, 결제 서비스 제공자가 안전에 책임을 지는 원칙도 제시한다. 또한 중국 최고인민법원의 2022년 사법 AI 의견은 AI를 참고 수단으로 활용하되 재판과 최종 책임은 인간에게 두고 있다. 거래 차단과 사법적 판단을 동일하게 설명해서는 안 된다. 규약의 기본 원칙, 최고인민법원의 사법 AI 원칙
KYA는 결국 누구의 권한으로 행동하고 누가 책임지는지를 묻는다. 사용자는 승인 범위를 확인하고 철회할 수 있어야 하며, 서비스 제공자는 실행 과정을 설명할 수 있어야 한다. 잘못 차단된 거래에 이의를 제기하고 잘못 실행된 거래의 피해를 처리할 절차도 필요하다. 중국의 움직임은 지능을 개발하는 노력과 사용 조건을 정하는 노력이 함께 진행된다는 점에서 주목할 만하다. 한국 역시 모델의 경쟁력을 높이는 동시에, 그 모델이 실제로 행동할 때 필요한 권한과 기록, 책임의 체계를 준비해야 한다.