Issue 01중국 AI
AC POST
중국 AI 목록
开源中国2026년 9월 17일 10:30중국어 → 한국어

AIGCPanel v2.4.0, 그린스크린 배경 교체·노래 음색 변환 추가

AI 디지털 휴먼 데스크톱 앱 AIGCPanel v2.4.0이 그린스크린 배경 교체와 노래의 사람 목소리를 자신의 음색으로 바꾸는 두 가지 새 도구를 추가하고 작업 스케줄링 문제도 개선했다.

중국어 원문을 AI로 번역했습니다. 고유명사와 수치는 원문 표기를 우선하며, 중요한 판단에는 아래 출처 원문을 함께 확인하세요.

그린 스크린 배경 바꾸기, 한 곡의 보컬을 내 음색으로 바꾸기. 이 두 가지는 예전에는 편집 소프트웨어를 켜고, 플러그인을 잔뜩 설치하고, 다시 내보내고 불러오기를 반복해야 끝낼 수 있던 일이다. 이제 AIGCPanel에서는 둘 다 "업로드하고, 클릭"하면 된다.

AIGCPanel은 원스톱 AI 디지털 휴먼 데스크톱 애플리케이션으로, Windows / macOS / Linux에서 모두 실행된다. v2.4.0은 두 가지 새 도구를 가져왔고, 겸사겸사 작업 스케줄링의 오래된 문제도 함께 해결했다. 여러 작업을 한 번에 제출할 때, 대기 중인 작업이 더 이상 실패로 잘못 판정되지 않고, 몰래 다시 실행되지도 않는다.

쓰기 좋은 기능은 조작 설명서가 아니라 버튼으로 만들어져야 한다.

그린 스크린 영상 배경 바꾸기: 업로드 상자 두 개로 한 번에 완성

그린 스크린으로 촬영한 영상이 있고 장면을 바꾸고 싶다면, 보통은 키잉, 정렬, 합성의 전체 과정을 거쳐야 한다는 뜻이다. 이제는 두 가지만 올리면 된다. 그린 스크린 영상 한 개, 배경 이미지 한 장.

키잉의 네 가지 파라미터는 모두 명시적으로 드러나 있다. 제거할 색상(기본값은 그린 #00FF00), 색상 유사도, 가장자리 블렌딩, 출력 크기. 유사도는 "얼마나 깔끔하게 따내는지"를 담당하고, 가장자리 블렌딩은 "인물 가장자리가 딱딱하지 않은지"를 담당하며, 출력 크기를 0으로 두면 원본 영상을 따른다.

기술적으로는 프레임별로 크로마 키잉을 수행한다. 모든 픽셀을 대상 색상과 RGB 거리로 비교해서, 거리가 충분히 가까우면 투명하게 처리하고, 전환 대역에 있는 것은 비율에 따라 투명도를 설정해 가장자리가 자연스럽게 전환되도록 한다. 파라미터 조정의 실시간 미리보기와 최종 내보내기는 동일한 applyChromaKey 함수를 사용하므로, 보이는 대로 내보내지고 "미리보기는 괜찮은데 내보내면 망가지는" 일은 생기지 않는다.

이것은 동시에 도구 상자 안의 한 도구이며, 워크플로 노드로 자동화 흐름에 연결할 수도 있다.

노래 커버: 한 곡 전체의 보컬을 지정한 음색으로 바꾸기

v2.4.0은 노래 커버를 새로 추가했다. 한 곡을 고르고 목표 음색을 지정하면 보컬을 원하는 목소리로 교체할 수 있다.

이는 AIGCPanel에 이미 있는 음색 체계를 그대로 따른다. 음색은 음성 복제(참조 오디오 업로드)에서 올 수 있고, 음성 관리에 저장된 음색을 바로 선택할 수도 있다. 커버를 만들거나 2차 창작을 하거나, 혹은 단지 AI가 고정된 음색으로 한 곡을 끝까지 부르게 하고 싶을 때, 이 방법은 수동으로 자르고 구간별로 합성하는 것보다 훨씬 수월하다.

대기 작업이 실패로 잘못 판정되고 중복 실행된다고? 이번에는 스케줄링 저변에서 고쳤다

이것은 v2.4.0에서 가장 "눈에 띄지 않지만" 가장 중요한 수정 사항이다.

예전에 여러 작업을 연속으로 제출할 때, 앞의 작업이 막 끝나고 모델 프로세스가 종료되는 중에 마침 이때 다음 대기 작업이 스케줄되면, 화면에는 "실행 실패"가 표시되지만 오디오는 이미 생성되어 있을 수 있었다. 더 나쁜 것은 그 작업이 다시 실행되도록 끌어올려져 한 번 헛되이 돌아가는 일이었다.

원인은 두 곳이었다. 스케줄링 루프의 타이머 핸들이 실제로 기록되지 않아 작업을 제출할 때마다 새로운 스케줄링 체인이 겹쳐 생길 수 있었고, 같은 대기 작업이 중복으로 발동되었다. 그리고 모델 프로세스 종료 콜백에서 큐에 아직 작업이 있으면 먼저 그것을 다시 끌어올리지 않고 빈 결과로 바로 끝내 버려, 작업이 실패로 판정되었다.

이번에는 두 곳을 함께 고쳤다. 스케줄링은 단일 체인 폴링으로 바꾸고, 새 작업을 제출할 때 이전에 대기 중이던 타이머를 먼저 취소해서 항상 하나의 스케줄링 체인만 작동하게 했다. 프로세스 종료 콜백은 먼저 큐를 확인해서 남은 작업을 다시 끌어올리고 결과를 계속 기다리며, 남은 작업이 없는 것이 확인된 뒤에야 끝내도록 했다.

안정성이란 "결코 대기하지 않는 것"이 아니라, 대기에 줄을 서더라도 작업 하나도 잃지 않고 다시 하지 않는 것이다.

사용자 정의 파라미터 폼: 라벨은 위에, 파라미터는 카드로

도구가 모델을 호출할 때 파라미터가 많아지면, 기존 폼은 한 줄의 긴 띠로 빽빽하게 붙어 있었다. 이제 반응형 그리드로 바꿨다. 좁은 화면은 한 열, 중간 화면은 두 열, 넓은 화면은 세 열이고, 각 파라미터는 독립된 카드이며, 긴 텍스트 상자는 한 줄 전체를 차지한다.

겸사겸사 몇 가지 세부 사항도 추가했다. 필수 파라미터에는 빨간 별표가 붙고, 파라미터 설명에는 물음표 아이콘이 있어 마우스를 올려 확인할 수 있으며, 사용자 정의 파라미터 영역 왼쪽에는 통일된 「사용자 정의 파라미터」 아이콘이 있고, 사용자 정의 파라미터가 없으면 이 블록 전체가 표시되지 않는다.

필수 검증도 폼 컴포넌트 안에 통일해 모았다. 제출 전에 항목별로 확인하고, 어느 항목이 빠졌는지 그 항목을 알려주므로, 모델까지 돌려 보지 않고도 파라미터 오류를 알 수 있다.

지난 기능 둘러보기

시각화 워크플로는 v2.0.0부터 있었다. 노드를 드래그해서 대형 모델 호출, JS 스크립트, 조건 분기 그리고 모든 도구 상자 기능을 자동화 파이프라인으로 엮는다. 위의 그 "영상 배경 교체 노드"가 바로 그중 하나다.

API 서비스와 인터페이스는 v2.3.0에서 보완되었다. 소프트웨어 안에서 HTTP 서비스를 켜면 외부 스크립트나 다른 프로그램이 모델을 직접 호출할 수 있고, 파일 업로드, 모델 파라미터 조회 같은 인터페이스도 모두 갖추어졌으며, 문서는 중국어와 영어 전환을 지원한다.

텍스트 투 비디오 / 이미지 투 비디오는 v2.2.0에서 나왔다. 텍스트 한 단락을 입력해 영상을 생성하거나, 이미지 한 장과 설명을 업로드해 움직이게 한다.

기타 업데이트

- 디지털 휴먼 형상과 라이브 형상 카드에 「영상 내보내기」 버튼을 추가했고, 내보내기 파일 이름은 기본적으로 형상 제목을 따른다

- 생성 프롬프트, 음성 내용, 장문 텍스트 등 입력 영역에 왼쪽 아이콘을 통일해 추가했고, 이미지 투 이미지와 이미지 투 비디오의 생성 프롬프트는 한 줄을 독점한다

- 장문 텍스트를 오디오로 변환할 때 음성 합성 설정을 장문 텍스트 입력 위로 옮겨 조작 순서에 더 맞게 했다

- 내장 대형 모델 할당량이 부족할 때(insufficient_quota) 에너지 부족을 알리고 자동으로 충전으로 이동한다

- 디지털 휴먼 합성이 음성 인식 파라미터 출처를 잘못 읽던 문제를 수정해, videoGen 파라미터를 읽도록 바꿨다

최근 버전 회고

- v2.3.0 — API 서비스와 인터페이스 정식 출시, 모든 도구 다국어 지원 전면 커버

- v2.2.0 — 텍스트 투 이미지·이미지 투 비디오 출시, AI 창작 전면 업그레이드

- v2.0.0 — 워크플로 엔진, 20+ 소도구, CLI 전면 출시

이번 두 가지 새 도구는 원리를 몰라도 된다. 파일을 고르고 버튼을 누를 줄만 알면 된다. 저변의 "키잉을 어떻게 하는지, 큐를 어떻게 정렬하는지" 같은 일은 AIGCPanel에 맡겨 두면 된다.

여러분은 그린 스크린 배경 바꾸기를 먼저 써 보고 싶은가, 아니면 노래 커버를 먼저 시도해 보고 싶은가? 혹은 마침 장면을 바꾸고 싶은 그린 스크린 소재가 있다면, 댓글로 여러분의 활용법을 들려주기 바란다.

복잡함은 자기에게 맡기고, 한 번에 끝내는 것은 사용자에게 남겨 두는 것, 이것이 도구가 가져야 할 모습이다.