# Keterampilan Agen Pengeditan Video

> Edit video menggunakan AI dengan Claude Code, mengotomatiskan tugas seperti memotong kata pengisi, penilaian warna, dan membakar subtitle. Sederhanakan alur kerja produksi video Anda dan dapatkan MP4 akhir yang dipoles.

- Canonical: https://nanoskill.ai/id/skills/video-editing
- Markdown: https://nanoskill.ai/id/skills/video-editing.md
- Author: browser-use
- Published: 2026-06-09T05:30:00.000Z
- Updated: 2026-07-17T03:29:25.412Z
- Language: id
- Source type: github
- Popularity signal: 8913

## Sources

- https://github.com/browser-use/video-use

## Install

```shell
npx skills add https://github.com/browser-use/video-use
```

## About

video-use memperkenalkan pendekatan inovatif untuk pengeditan video, memanfaatkan agen AI seperti Claude Code untuk mengotomatiskan tugas yang membosankan dan memakan waktu. Alat sumber terbuka ini memungkinkan pengguna untuk cukup menjatuhkan rekaman mentah ke dalam folder, berinteraksi dengan agen AI, dan menerima hasil \`final.mp4\` yang dipoles. Ini dirancang untuk menyederhanakan proses pengeditan video untuk berbagai jenis konten, mulai dari talking head hingga montase, dengan menangani pemotongan, penilaian warna, dan pembakaran subtitle secara cerdas.

Sistem beroperasi dengan membaca konten video melalui transkrip audio terperinci dan komposit visual sesuai permintaan, daripada memproses setiap bingkai. Metode ini memberikan AI presisi batas kata untuk pengeditan sambil secara signifikan mengurangi overhead komputasi. Kemampuan utama meliputi menghapus kata pengisi dan ruang kosong secara otomatis, menerapkan tingkat warna cerdas, memastikan transisi audio yang mulus, dan membakar subtitle yang dapat disesuaikan langsung ke dalam video.

Di luar otomatisasi, video-use menggabungkan jalur evaluasi-diri yang kuat. Setelah pemrosesan awal, AI meninjau hasil render di setiap batas potongan untuk mendeteksi dan mengoreksi ketidaksempurnaan seperti lompatan visual atau letupan audio. Ini memastikan bahwa video akhir memenuhi standar produksi tinggi sebelum disajikan kepada pengguna. Alat ini juga menyimpan memori sesi, memungkinkan pengguna untuk melanjutkan sesi pengeditan tepat dari tempat mereka tinggalkan, meningkatkan efisiensi dan konsistensi alur kerja.

## Key features

- **Penghapusan Kata Pengisi Otomatis**: Secara otomatis memotong kata pengisi seperti 'umm,' 'uh,' awal yang salah, dan ruang mati di antara pengambilan untuk audio yang lebih bersih.
- **Koreksi Warna Cerdas**: Koreksi warna otomatis untuk setiap segmen video, menawarkan opsi seperti sinematik hangat, punch netral, atau rantai FFmpeg kustom untuk kualitas visual yang konsisten.
- **Fade Audio Mulus**: Menerapkan fade audio 30ms pada setiap potongan untuk menghilangkan letupan dan memastikan transisi yang mulus antar segmen.
- **Pembakaran Subtitle yang Dapat Disesuaikan**: Membakar subtitle langsung ke dalam video Anda dengan gaya yang dapat disesuaikan, dengan potongan 2-kata HURUF BESAR secara default, meningkatkan aksesibilitas dan keterlibatan.
- **Evaluasi Diri Bertenaga AI**: Sistem mengevaluasi sendiri hasil render di setiap batas potongan, mendeteksi lompatan visual, letupan audio, dan subtitle tersembunyi sebelum menampilkan pratinjau kepada Anda.

## Use cases

- **Memproduksi Video Talking Head Profesional**: Sempurnakan rekaman talking head dengan cepat dengan menghilangkan jeda dan kata pengisi, memastikan presentasi yang ringkas dan menarik.
- **Membuat Montase Video Dinamis**: Rakit montase dengan mudah dengan potongan otomatis, koreksi warna, dan overlay animasi untuk tampilan yang halus dan profesional.
- **Merampingkan Produksi Video Tutorial**: Percepat pembuatan video tutorial dengan mengotomatiskan tugas pengeditan berulang, memungkinkan kreator untuk fokus pada konten.

## Result preview

Lihat video wawancara yang dipoles menjadi klip media sosial dengan ritme yang lebih baik, subtitle, audio yang ditingkatkan.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-2.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-3.png)

## Result walkthrough

### Langkah 1：Instal

Tambahkan keterampilan ke agen Anda.

![a simple demonstration of the first step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-1.jpg)

### Langkah 2：Unggah Video Anda

Unggah video wawancara, tutorial, atau produk dan jelaskan pengeditan yang diinginkan.

![a simple demonstration of the second step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-2.jpg)

### Langkah 3：Tinjau Output

Terima versi yang diedit dan verifikasi subtitle, transisi, dan ritme.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

## Skill definition

# penggunaan-video

Memperkenalkan **penggunaan-video** — edit video dengan Kode Claude. 100% sumber terbuka.

Letakkan rekaman mentah dalam folder, obrolan dengan Kode Claude, dapatkan `final.mp4` kembali. Bekerja untuk konten apa pun — pembicara di depan kamera, montase, tutorial, perjalanan, wawancara — tanpa prasetel atau menu.

## Apa yang Dilakukannya

- **Memotong kata pengisi** (`umm`, `uh`, start palsu) dan ruang kosong antara pengambilan
- **Pewarnaan otomatis** setiap segmen (sinematik hangat, punch netral, atau rantai ffmpeg kustom apa saja)
- **Fade audio 30ms** di setiap potongan sehingga Anda tidak pernah mendengar letupan
- **Membakar subtitel** sesuai gaya Anda — potongan KAPITAL 2-kata secara default, sepenuhnya dapat disesuaikan
- **Menghasilkan overlay animasi** melalui [HyperFrames](https://github.com/heygen-com/hyperframes), [Remotion](https://www.remotion.dev/), [Manim](https://www.manim.community/), atau PIL — dijalankan dalam sub-agen paralel, satu per animasi
- **Mengevaluasi sendiri output yang dirender** di setiap batas potongan sebelum menunjukkan apa pun kepada Anda
- **Menyimpan memori sesi** di `project.md` sehingga sesi minggu depan dapat melanjutkan dari tempat Anda berhenti

## Perintah Persiapan

Tempelkan ke Kode Claude, Codex, Hermes, Openclaw, atau agen apa pun dengan akses shell:

```text
Set up https://github.com/browser-use/video-use for me.

Read install.md first to install this repo, wire up ffmpeg, register the skill with whichever agent you're running under, and set up the ElevenLabs API key — ask me to paste it when you need it. Then read SKILL.md for daily usage, and always read helpers/ because that's where the editing scripts live. After install, don't transcribe anything on your own — just tell me it's ready and wait for me to drop footage into a folder.
```

Agen menangani kloning, dependensi, pendaftaran skill, dan meminta Anda sekali untuk kunci API ElevenLabs (dapatkan di [elevenlabs.io/app/settings/api-keys](https://elevenlabs.io/app/settings/api-keys)).

Kemudian arahkan agen Anda ke folder yang berisi rekaman mentah:

```bash
cd /path/to/your/videos
claude    # or codex, hermes, etc.
```

Untuk pengeditan selalu aktif dari VPS atau Telegram Anda sendiri, jalankan agen melalui [Browser Use Box](https://browser-use.com/bux). [Tonton demo 15 detik](https://www.tiktok.com/@browser_use/video/7639824093721758989).

Dan dalam sesi:

> edit ini menjadi video peluncuran

Ini menginventarisasi sumber, mengusulkan strategi, menunggu persetujuan Anda, lalu menghasilkan `edit/final.mp4` di samping sumber Anda. Semua output berada di `<videos_dir>/edit/` — direktori skill tetap bersih.

## Instalasi Manual

Jika Anda lebih suka melakukannya secara manual:

```bash
# 1. Clone and symlink into your agent's skills directory
git clone https://github.com/browser-use/video-use ~/Developer/video-use
ln -sfn ~/Developer/video-use ~/.claude/skills/video-use        # Claude Code
# ln -sfn ~/Developer/video-use ~/.codex/skills/video-use       # Codex

# 2. Install deps
cd ~/Developer/video-use
uv sync                         # or: pip install -e .
brew install ffmpeg             # required
brew install yt-dlp             # optional, for downloading online sources

# 3. Add your ElevenLabs API key
cp .env.example .env
$EDITOR .env                    # ELEVENLABS_API_KEY=...
```

## Cara Kerjanya

LLM tidak pernah menonton video. Ia **membacanya** — melalui dua lapisan yang bersama-sama memberikan semua yang dibutuhkan untuk memotong dengan presisi batas kata.

<p align="center">
  <img src="https://file.nanoskill.ai/timeline-view.svg" alt="timeline_view composite — filmstrip + speaker track + waveform + word labels + silence-gap cut candidates" width="100%">
</p>

**Lapisan 1 — Transkrip audio (selalu dimuat).** Satu panggilan ElevenLabs Scribe per sumber memberikan stempel waktu tingkat kata, diarisasi pembicara, dan peristiwa audio (`(tawa)`, `(tepuk tangan)`, `(desah)`). Semua pengambilan dikemas ke dalam satu file ~12KB `takes_packed.md` — tampilan bacaan utama LLM.

```
## C0103  (duration: 43.0s, 8 phrases)
  [002.52-005.36] S0 Ninety percent of what a web agent does is completely wasted.
  [006.08-006.74] S0 We fixed this.
```

**Lapisan 2 — Komposit visual (sesuai permintaan).** `timeline_view` menghasilkan PNG filmstrip + bentuk gelombang + label kata untuk rentang waktu apa pun. Dipanggil hanya pada titik keputusan — jeda ambigu, perbandingan pengambilan ulang, pemeriksaan kewarasan titik potong.

> Pendekatan naif: 30.000 frame × 1.500 token = **45M token noise**.
> Penggunaan Video: **12KB teks + segenggam PNG**.

Ide yang sama dengan penggunaan-browser memberikan DOM terstruktur kepada LLM alih-alih tangkapan layar — tetapi untuk video.

## Pipa

```
Transcribe ──> Pack ──> LLM Reasons ──> EDL ──> Render ──> Self-Eval
                                                              │
                                                              └─ issue? fix + re-render (max 3)
```

Loop evaluasi-diri menjalankan `timeline_view` pada _output yang dirender_ di setiap batas potongan — mendeteksi lompatan visual, letupan audio, subtitel tersembunyi. Anda melihat pratinjau hanya setelah lulus.

## Prinsip Desain

1. **Teks + visual sesuai permintaan.** Tidak ada pembuangan frame. Transkrip adalah permukaan.
2. **Audio adalah utama, visual mengikuti.** Potongan berasal dari batas bicara dan celah sunyi.
3. **Tanya → konfirmasi → eksekusi → evaluasi-diri → simpan.** Jangan pernah menyentuh potongan tanpa persetujuan strategi.
4. **Tanpa asumsi tentang jenis konten.** Lihat, tanya, lalu edit.
5. **12 aturan keras, kebebasan artistik di tempat lain.** Kebenaran produksi tidak bisa dinegosiasikan. Selera tidak.

Lihat [`SKILL.md`](./SKILL.md) untuk aturan produksi lengkap dan kerajinan pengeditan.

## FAQ

### Apa itu video-use?

video-use adalah alat sumber terbuka yang memungkinkan Anda mengedit video menggunakan agen AI seperti Claude Code. Alat ini mengotomatiskan tugas pengeditan umum seperti memotong kata pengisi, koreksi warna, dan menambahkan subtitle.

### Bagaimana cara kerja video-use tanpa LLM menonton video?

LLM membaca video melalui dua lapisan: transkrip audio dengan stempel waktu tingkat kata dan diarisasi pembicara, serta komposit visual sesuai permintaan (filmstrip + bentuk gelombang + PNG label kata) untuk titik keputusan. Pendekatan ini meminimalkan penggunaan token sambil memberikan kemampuan pengeditan yang presisi.

### Jenis video apa yang bisa saya edit dengan video-use?

video-use dirancang untuk bekerja dengan jenis konten apa pun, termasuk talking head, montase, tutorial, vlog perjalanan, dan wawancara. Alat ini beradaptasi dengan rekaman Anda tanpa memerlukan preset atau menu.

### Apa saja fitur inti dari video-use?

Fitur utama termasuk memotong kata pengisi dan ruang mati, koreksi warna otomatis, fade audio 30ms, membakar subtitle yang dapat disesuaikan, menghasilkan overlay animasi, evaluasi sendiri hasil render, dan menyimpan memori sesi.

### Apakah saya memerlukan kunci API ElevenLabs untuk menggunakan video-use?

Ya, kunci API ElevenLabs diperlukan untuk transkripsi audio dan diarisasi pembicara, yang sangat penting untuk fungsionalitas alat. Anda akan diminta untuk menyediakannya selama proses pengaturan.

### Bisakah saya menginstal video-use secara manual alih-alih menggunakan prompt pengaturan?

Ya, Anda dapat melakukan instalasi manual dengan mengkloning repositori, menautkan secara simbolik ke direktori keterampilan agen Anda, menginstal dependensi seperti FFmpeg, dan mengonfigurasi kunci API ElevenLabs Anda di file .env.
