Initial Audio에서 사용자의 컴퓨터에서 완전히 실행되는 독립형 AI 멜로디 생성기 Difro Melody AI를 출시했습니다.
원격 API로 노트를 전송하는 클라우드 MIDI 도구와 달리, Difro는 로컬 VAE + Transformer 모델을 사용하여 CPU에서 실시간으로 MIDI를 생성하고 재해석하며, 호환되는 카드가 있는 경우 GPU에서도 작동합니다. 계정, 클라우드 대기열, 생성당 API 비용이 없습니다.
이 워크플로우는 이미 피아노 롤 방식으로 생각하는 프로듀서를 위해 설계되었습니다. 녹음을 누르고 피아노 롤로 실시간 연주하거나 기존 MIDI 클립을 드롭하세요. Difro는 멜로디, 리듬, 화음 등 음악적 DNA를 분석하여 마디별로 변형을 만듭니다. 시작하는 데 MIDI 파일이 필요하지 않습니다. 완성된 아이디어는 MIDI로 DAW에 직접 드래그하거나, Render to WAV를 통해 WAV 루프로 변환할 수 있습니다.
첫인상
라이브 녹음부터 MIDI를 DAW로 드래그하는 과정까지, 로컬 AI 코프로듀서의 워크플로우를 보여줍니다:
작동 방식
앱을 열고, 프롬프트 모델을 선택하고, MIDI를 연주하거나 드롭한 다음, 결과를 Ableton, FL Studio, Logic 또는 Cubase로 드래그하세요:
Initial Audio는 Difro가 랜덤 생성기가 아니라고 말합니다. 원본 아이디어의 DNA를 유지하면서 새로운 것을 만듭니다. 라이브로 녹음하거나 코드 / 이전 멜로디를 드롭한 다음, 창의성 슬라이더를 사용하여 모델이 얼마나 멀리 나아갈지 결정하세요:
Render to WAV를 누르면 Difro는 생성된 멜로디를 오디오 루프로 변환합니다. WAV를 바탕화면, 폴더 또는 DAW로 샘플로 직접 드래그하세요. MIDI를 선호하시나요? Render to WAV 버튼 바로 아래에 있는 출력 MIDI 클립을 클릭하고 대신 드래그하세요.
Initial Audio는 일반적인 "AI MIDI" 유틸리티와 차별화되는 점은 모델이 고정되어 있지 않다는 것이라고 말합니다. 생성 후 사용자는 피아노 롤에서 출력을 편집하고 만족스럽거나 불만족스러운 이모티콘으로 평가할 수 있습니다. 긍정적인 평가 (편집된 MIDI 평가 포함)는 개인 사용자 모델을 생성합니다. 즉, 해당 프로듀서가 실제로 원하는 방향으로 조정된 원본 네트워크의 복사본입니다. 팩토리 모델과 사용자 모델은 언제든지 전환할 수 있습니다. 사용자 모델이 너무 벗어난 경우 메뉴에서 삭제할 수 있습니다 (Delete User Feedback Model).
Difro는 140개 이상의 MIDI 파일로 구성된 10개의 프롬프트 모델을 제공하며, 더 많은 모델이 계획되어 있습니다. Pro 버전은 사용자의 MIDI 폴더에서 사용자 지정 프롬프트 모델을 구축할 수도 있으며, 파일 수 제한은 없습니다. 사용자 지정 모델은 100% 로컬로 유지되며, SourceLab 사전 설정을 할당하고 폴더로 공유할 수 있습니다.
내장된 SourceLab Light 엔진 (80개 이상의 사전 설정)을 통해 사용자는 외부 악기를 로드하지 않고도 아이디어를 미리 들어볼 수 있습니다. Serum, Kontakt, Omnisphere 등 다른 악기도 Difro 내에서 호스팅할 수 있습니다 (Windows의 VST3, macOS의 Audio Units). 따라서 새로운 멜로디를 DAW로 가져오기 전에 사용자의 사전 설정으로 미리 들어볼 수 있습니다.
GPU 가속은 선택 사항입니다. Windows의 호환되는 NVIDIA GPU 및 Mac의 Apple silicon GPU는 오른쪽 상단의 CPU/GPU 스위치에서 선택할 수 있습니다. 지원되는 GPU가 없으면 Difro는 CPU 모드로 작동합니다. 모든 작업은 오프라인으로 진행됩니다.
내부적으로 VAE는 입력 MIDI를 리듬, 윤곽 및 화음 움직임의 잠재적 맵으로 인코딩합니다. 그런 다음 Transformer가 다음 음표를 예측합니다. 이는 MIDI에 대한 LLM과 동일한 아이디어입니다. Initial Audio는 이를 로컬에서 실행되는 MIDI GPT라고 설명합니다:
기능
- 로컬 VAE + Transformer MIDI 생성 — 100% 오프라인.
- 피아노 롤로 실시간 녹음하거나 MIDI 드롭 — 시작에 MIDI 파일 필요 없음.
- 창의성 슬라이더로 변형 재해석.
- 개인 사용자 모델: AI가 사용자의 취향을 학습하도록 결과 (편집된 MIDI 포함) 평가.
- 원본 및 사용자 모델 간 전환; 사용자 모델은 언제든지 삭제 가능.
- 140개 이상의 MIDI 파일 기반 10개 프롬프트 모델 (추가 예정).
- 자신의 MIDI로 사용자 지정 프롬프트 모델 생성 (Pro) — 파일 수 제한 없음.
- Render to WAV로 루프 또는 MIDI를 DAW로 드래그.
- 80개 이상의 사전 설정이 포함된 내장 SourceLab Light.
- Windows에서 VST3 플러그인, macOS에서 Audio Units 호스팅.
- CPU 또는 GPU: Windows의 NVIDIA, Mac의 Apple silicon.
- 다양한 스킨 포함.
가격 및 이용 가능 여부
Difro Melody AI Pro는 $49 (정가 $69)의 일회성 구매로, 무제한 생성, 사용자 지정 모델, 로열티 프리 결과물 및 평생 업데이트가 포함됩니다.
Windows 및 macOS용 무료 버전 (월 50회 생성, 신용카드 불필요)을 사용할 수 있습니다: Windows용 다운로드 / macOS용 다운로드.








