# Videoredigeringsagent-færdighed

> Rediger videoer med AI ved hjælp af Claude Code, automatiser opgaver som at klippe fyldord, farvekorrigering og indbrænding af undertekster. Strømlin din videoproduktions workflow og få en poleret endelig MP4.

- Canonical: https://nanoskill.ai/da/skills/video-editing
- Markdown: https://nanoskill.ai/da/skills/video-editing.md
- Author: browser-use
- Published: 2026-06-09T05:30:00.000Z
- Updated: 2026-07-17T03:29:25.412Z
- Language: da
- Source type: github
- Popularity signal: 8913

## Sources

- https://github.com/browser-use/video-use

## Install

```shell
npx skills add https://github.com/browser-use/video-use
```

## About

video-use introducerer en innovativ tilgang til videoredigering, der udnytter AI-agenter som Claude Code til at automatisere kedelige og tidskrævende opgaver. Dette open source-værktøj giver brugerne mulighed for blot at placere råoptagelser i en mappe, interagere med en AI-agent og modtage et poleret \`final.mp4\`-output. Det er designet til at strømline videoredigeringsprocessen for forskellige indholdstyper, fra talende hoveder til montager, ved intelligent at håndtere klip, farvekorrigering og undertekstindbrænding.

Systemet fungerer ved at læse videoindhold gennem detaljerede lydtransskriptioner og visuelle kompositter efter behov i stedet for at behandle hvert billede. Denne metode giver AI'en ordgrænsepræcision til redigering, samtidig med at den betydeligt reducerer beregningsomkostningerne. Nøglefunktioner omfatter automatisk fjernelse af fyldord og dødt rum, anvendelse af intelligente farvegradueringer, sikring af sømløse lydovergange og indbrænding af tilpassede undertekster direkte i videoen.

Ud over automatisering inkorporerer video-use en robust selvevalueringspipeline. Efter den indledende behandling gennemgår AI'en det gengivede output ved hver klipgrænse for at opdage og rette ufuldkommenheder som visuelle hop eller lydpopper. Dette sikrer, at den endelige video opfylder høje produktionsstandarder, før den præsenteres for brugeren. Værktøjet opretholder også sessionshukommelse, hvilket giver brugerne mulighed for at genoptage redigeringssessioner præcis, hvor de slap, hvilket forbedrer workflow-effektivitet og -konsistens.

## Key features

- **Automatisk fjernelse af fyldord**: Klipper automatisk fyldord som 'øh', 'øhm', falske starter og død tid mellem optagelser ud for renere lyd.
- **Intelligent farvekorrektion**: Farrvekorrigerer automatisk hvert videosegment og tilbyder muligheder som varm filmisk, neutralt punch eller tilpassede FFmpeg-kæder for ensartet visuel kvalitet.
- **Glidende lydtoninger**: Anvender 30ms lydtoninger ved hver klipning for at eliminere pops og sikre jævne overgange mellem segmenter.
- **Tilpasselig undertekstindbrænding**: Brænder undertekster direkte ind i din video i en tilpasselig stil, med 2-ords sektioner i STORE BOGSTAVER som standard, hvilket øger tilgængelighed og engagement.
- **AI-drevet selvevaluering**: Systemet selvevaluerer det gengivne output ved hver klippegrænse, fanger visuelle spring, lydpops og skjulte undertekster, før det viser dig forhåndsvisningen.

## Use cases

- **Produktion af professionelle videoer med talende hoveder**: Forfin hurtigt talking head-optagelser ved at fjerne pauser og fyldord, hvilket sikrer en koncis og engagerende præsentation.
- **Skabelse af dynamiske videomontager**: Saml ubesværet montager med automatiserede klip, farvekorrektion og animationsoverlejringer for et poleret, professionelt udseende.
- **Strømlining af produktion af tutorial-videoer**: Fremskynd oprettelsen af tutorial-videoer ved at automatisere gentagne redigeringsopgaver, så skabere kan fokusere på indhold.

## Result preview

Se et interviewvideo poleret til et social media-klip med forbedret tempo, undertekster, forbedret lyd.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-2.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-3.png)

## Result walkthrough

### Trin 1：Installer

Tilføj færdigheden til din agent.

![a simple demonstration of the first step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-1.jpg)

### Trin 2：Upload din video

Upload en interview-, tutorial- eller produktvideo og beskriv de ønskede redigeringer.

![a simple demonstration of the second step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-2.jpg)

### Trin 3：Gennemgå output

Modtag den redigerede version og verificer undertekster, overgange og tempo.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

## Skill definition

# video-brug

Vi præsenterer **video-brug** — rediger videoer med Claude Code. 100% open source.

Læg råoptagelser i en mappe, chat med Claude Code, få `final.mp4` tilbage. Virker til alt indhold — talende hoveder, montager, tutorials, rejse, interviews — uden forudindstillinger eller menuer.

## Hvad den gør

- **Fjerner fyldord** (`umm`, `uh`, falske starter) og dødt rum mellem takes
- **Auto-farvegraderer** hvert segment (varm cinematisk, neutral punch eller enhver tilpasset ffmpeg-kæde)
- **30ms lydfade** ved hver klipning, så du aldrig hører et pop
- **Brænder undertekster** i din stil — 2-ord STORE BOGSTAVER-blokke som standard, fuldt tilpasselig
- **Genererer animationsoverlays** via [HyperFrames](https://github.com/heygen-com/hyperframes), [Remotion](https://www.remotion.dev/), [Manim](https://www.manim.community/), eller PIL — spawnet i parallelle sub-agenter, én pr. animation
- **Selvurderer den rendrerede output** ved hver klipningsgrænse, før den viser dig noget
- **Gemmer sessionhukommelse** i `project.md`, så næste uges session fortsætter, hvor du slap

## Opsætningsprompt

Indsæt i Claude Code, Codex, Hermes, Openclaw eller enhver agent med shell-adgang:

```text
Set up https://github.com/browser-use/video-use for me.

Read install.md first to install this repo, wire up ffmpeg, register the skill with whichever agent you're running under, and set up the ElevenLabs API key — ask me to paste it when you need it. Then read SKILL.md for daily usage, and always read helpers/ because that's where the editing scripts live. After install, don't transcribe anything on your own — just tell me it's ready and wait for me to drop footage into a folder.
```

Agenten håndterer kloning, afhængigheder, skill-registrering og beder dig én gang om din ElevenLabs API-nøgle (hent en på [elevenlabs.io/app/settings/api-keys](https://elevenlabs.io/app/settings/api-keys)).

Peg herefter din agent mod en mappe med råoptagelser:

```bash
cd /path/to/your/videos
claude    # or codex, hermes, etc.
```

For altid tændt redigering fra din egen VPS eller Telegram, kør agenten gennem [Browser Use Box](https://browser-use.com/bux). [Se den 15-sekunders demo](https://www.tiktok.com/@browser_use/video/7639824093721758989).

Og i sessionen:

> rediger disse til en launch-video

Den opgør kilderne, foreslår en strategi, venter på din godkendelse og producerer derefter `edit/final.mp4` ved siden af dine kilder. Alle output ligger i `<videos_dir>/edit/` — skill-mappen forbliver ren.

## Manuel installation

Hvis du hellere vil gøre det manuelt:

```bash
# 1. Clone and symlink into your agent's skills directory
git clone https://github.com/browser-use/video-use ~/Developer/video-use
ln -sfn ~/Developer/video-use ~/.claude/skills/video-use        # Claude Code
# ln -sfn ~/Developer/video-use ~/.codex/skills/video-use       # Codex

# 2. Install deps
cd ~/Developer/video-use
uv sync                         # or: pip install -e .
brew install ffmpeg             # required
brew install yt-dlp             # optional, for downloading online sources

# 3. Add your ElevenLabs API key
cp .env.example .env
$EDITOR .env                    # ELEVENLABS_API_KEY=...
```

## Sådan virker det

LLM'en ser aldrig videoen. Den **læser** den — gennem to lag, der tilsammen giver den alt, hvad den behøver for at klippe med ordgrænse-præcision.

<p align="center">
  <img src="https://file.nanoskill.ai/timeline-view.svg" alt="timeline_view komposit — filmstrimmel + speaker-spor + bølgeform + ordetiketter + stilhed-gab klipkandidater" width="100%">
</p>

**Lag 1 — lydtransskription (altid indlæst).** Ét ElevenLabs Scribe-kald pr. kilde giver ordniveau-tidsstempler, taler-diarization og lydbegivenheder (`(latter)`, `(bifald)`, `(suk)`). Alle takes pakkes i en enkelt ~12KB `takes_packed.md` — LLM'ens primære læsevisning.

```
## C0103  (duration: 43.0s, 8 phrases)
  [002.52-005.36] S0 Ninety percent of what a web agent does is completely wasted.
  [006.08-006.74] S0 We fixed this.
```

**Lag 2 — visuel komposit (på forespørgsel).** `timeline_view` producerer en filmstrimmel + bølgeform + ordetiketter PNG for ethvert tidsinterval. Kaldes kun ved beslutningspunkter — tvetydige pauser, genoptagelses-sammenligninger, fornuftskontrol af klippepunkter.

> Naiv tilgang: 30.000 frames × 1.500 tokens = **45M tokens støj**.
> Video Brug: **12KB tekst + en håndfuld PNG'er**.

Samme idé som browser-use giver en LLM en struktureret DOM i stedet for et skærmbillede — men til video.

## Pipeline

```
Transcribe ──> Pack ──> LLM Reasons ──> EDL ──> Render ──> Self-Eval
                                                              │
                                                              └─ issue? fix + re-render (max 3)
```

Selvurderingsløkken kører `timeline_view` på den _rendrerede output_ ved hver klipningsgrænse — fanger visuelle spring, lydpop, skjulte undertekster. Du ser forhåndsvisningen kun, når den er godkendt.

## Designprincipper

1. **Tekst + visuals på forespørgsel.** Ingen frame-dumping. Transskriptionen er overfladen.
2. **Lyd er primær, visuals følger.** Klip kommer fra talegrænser og stilhedsgab.
3. **Spørg → bekræft → udfør → selvurder → gem.** Rør aldrig klippet uden strategigodkendelse.
4. **Ingen antagelser om indholdstype.** Se, spørg, rediger derefter.
5. **12 faste regler, kunstnerisk frihed ellers.** Produktionskorrekthed er ikke til forhandling. Smag er det.

Se [`SKILL.md`](./SKILL.md) for de fulde produktionsregler og redigeringshåndværk.

## FAQ

### Hvad er video-brug?

video-brug er et open-source værktøj, der giver dig mulighed for at redigere videoer ved hjælp af AI-agenter som Claude Kode. Det automatiserer almindelige redigeringsopgaver som at klippe fyldord ud, farvekorrigere og tilføje undertekster.

### Hvordan fungerer video-brug uden at LLM'en ser videoen?

LLM'en læser videoen gennem to lag: en lydtransskription med tidsstempler på ordniveau og talerdiarisering, og on-demand visuelle kompositter (filmstrip + bølgeform + ordetiketter i PNG'er) ved beslutningspunkter. Denne tilgang minimerer tokenforbruget, samtidig med at den giver præcise redigeringsmuligheder.

### Hvilke typer videoer kan jeg redigere med video-brug?

video-brug er designet til at fungere med enhver indholdstype, herunder talende hoveder, montager, tutorials, rejsevlogs og interviews. Den tilpasser sig dine optagelser uden at kræve forudindstillinger eller menuer.

### Hvad er video-brugs kernefunktioner?

Nøglefunktioner inkluderer at klippe fyldord og død tid ud, automatisk farvekorrektion, 30ms lydtoninger, brænde tilpassede undertekster ind, generere animationsoverlejringer, selvevaluering af gengivet output og fastholdelse af sessionshukommelse.

### Har jeg brug for en ElleveLaboratorier API-nøgle for at bruge video-brug?

Ja, en ElleveLaboratorier API-nøgle er påkrævet til lydtransskription og talerdiarisering, som er afgørende for værktøjets funktionalitet. Du vil blive bedt om at angive den under opsætningsprocessen.

### Kan jeg manuelt installere video-brug i stedet for at bruge opsætningsprompten?

Ja, du kan udføre en manuel installation ved at klone repository'et, symlinke det til din agents færdighedsmappe, installere afhængigheder som FFmpeg og konfigurere din ElleveLaboratorier API-nøgle i .env-filen.
