연구자료실

설비 연결, 품질 검사, 생산 분석과 제조 업무에 관련된 외부 논문입니다.

연구자료 검색

논문 목록

T05. 사람 검토와 승인 절차 (human in the loop, approval workflow)

  1. T05-22후보2025년 이후

    What You Approve Is What Executes: Consent Integrity for Black-Box LLM Agents

    저자
    Xiaoqi Weng
    연도
    2026
    발표처
    arXiv 사전공개본 2026년 6월 1일 (동료심사 전)
    한국어 검토 보기
    해결 문제
    • 사람이 승인 창에서 보는 요약과 실제로 실행되는 명령이 다를 수 있다. 저자는 이걸 Lies-in-the-Loop 공격이라 부른다.
    핵심 구조
    • 동의 무결성(consent integrity)이라는 개념을 세운다. 에이전트가 만든 설명을 믿지 않는다. 대신 신뢰할 수 있는 중간 계층이 실제 실행 이벤트에서 화면 표시를 만들어 낸다.
    주요 결과
    • 알려진 악용 명령에서 조용히 통과되는 비율이 10.0퍼센트였다. 정상 명령 중 87.0퍼센트가 검사 불가로 표시됐다. 조용한 승인과 과잉 확인 요구 사이의 맞바꿈을 정량으로 보여준다.
    한계
    • 개념 증명 수준이다. 단독 저자 사전공개본이고 동료심사를 안 거쳤다. 경계 정보만 보는 중재자로는 이 맞바꿈을 벗어날 수 없다고 저자도 인정한다.
    우리 기능과의 연결
    • 업무 실행 에이전트의 승인 화면이 실제 실행 내용과 일치하는지 보장하는 설계의 향후 적용 후보다.
  2. T05-23후보2025년 이후

    Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human

    저자
    Emre Turan
    연도
    2026
    발표처
    arXiv 사전공개본 2026년 6월 8일 (동료심사 전)
    한국어 검토 보기
    해결 문제
    • 사람 승인 게이트는 사람의 주의력이 무한하다고 가정한다. 실제로는 검토자가 지치고, 위험 판정도 사람마다 다르다.
    핵심 구조
    • 승인 게이트를 선택적 분류(selective classification) 문제로 본다. 검토자 피로를 모형에 넣는다. 그래서 감시를 자원 배분 문제로 다시 짠다. 게이트 동작을 실제로 재는 공개 시스템도 같이 낸다.
    주요 결과
    • 손으로 이름표를 붙인 위험 행동 125건에서 검토자들의 판정 일치도가 중간 수준이었다(Fleiss 카파 0.52). 정답이 하나로 정해지지 않는다는 뜻이다. 피로를 넣으면 안전도가 승인 요청 비율에 대해 뒤집힌 U자 모양이 된다. 사람에게 너무 많이 올리면 오히려 안전이 나빠진다.
    한계
    • 단독 저자 사전공개본이다. 피로 모형이 시뮬레이션 중심이고 사람 실험은 검증 제안 단계다.
    우리 기능과의 연결
    • 1번 Bainbridge와 5번 Parasuraman이 지적한 감시자의 한계를 수치 모형으로 옮긴 셈이다. 영상 안전 판단에서 사람에게 올리는 알림 비율을 얼마로 잡아야 실제 안전이 최대가 되는지 정하는 향후 적용 후보다.
  3. T05-21유사문제2025년 이후

    Human-In-the-Loop Software Development Agents (HULA)

    저자
    Wannita Takerngsaksiri 외 9인 (Atlassian, Monash University)
    연도
    2024 프리프린트(arXiv 최초 제출 2024년 11월 19일), 2025 학회 게재
    발표처
    ICSE-SEIP 2025
    한국어 검토 보기
    해결 문제
    • 자동 코딩 에이전트가 끝까지 혼자 하면 결과를 믿기 어렵다. 사람이 중간에 계획과 코드를 손볼 수 있어야 한다.
    핵심 구조
    • 계획 수립, 코드 작성, 검토 단계로 나눈다. 각 단계 사이에 사람이 승인하거나 수정하는 지점을 둔다. Atlassian JIRA 안에 실제로 붙여서 운영했다.
    주요 결과
    • 실제 업무에 투입해 평가했다. 개발자들은 계획 초안 잡기와 단순 과제 코드 작성에서 시간과 노력이 줄었다고 봤다. 다만 코드 품질은 일부 사례에서 여전히 문제였다.
    한계
    • 한 회사 환경이다. 정량 지표보다 사용자 인식 조사 비중이 크다. 복잡한 과제에서는 효과가 약하다.
    우리 기능과의 연결
    • 업무 실행 에이전트를 단계로 쪼개고 단계마다 승인 지점을 두는 방식에 대한 유사문제다.
    검토 메모
    • 전체 저자: Wannita Takerngsaksiri, Jirat Pasuksmit, Patanamon Thongtanunam, Chakkrit Tantithamthavorn, Ruixiong Zhang, Fan Jiang, Jing Li, Evan Cook, Kun Chen, Ming Wu

연구에서 제품 적용까지

운영 중인 기능, 시범 적용과 개발 중인 기술을 구분해 정리했습니다.

보유기술 보기