# Videoredigeringsagent-ferdighet

> Rediger videoer ved hjelp av AI med Claude-kode, automatiser oppgaver som klipping av fyllord, fargekorrigering og innbrenning av undertekster. Strømlinjeform videoproduksjonsflyten din og få en polert endelig MP4.

- Canonical: https://nanoskill.ai/nb/skills/video-editing
- Markdown: https://nanoskill.ai/nb/skills/video-editing.md
- Author: browser-use
- Published: 2026-06-09T05:30:00.000Z
- Updated: 2026-07-17T03:29:25.412Z
- Language: nb
- Source type: github
- Popularity signal: 8913

## Sources

- https://github.com/browser-use/video-use

## Install

```shell
npx skills add https://github.com/browser-use/video-use
```

## About

videobruk introduserer en innovativ tilnærming til videoredigering, ved å utnytte AI-agenter som Claude-kode for å automatisere kjedelige og tidkrevende oppgaver. Dette åpen kildekode-verktøyet lar brukere ganske enkelt slippe råopptak i en mappe, samhandle med en AI-agent og motta en polert \`endelig.mp4\`-utdata. Det er designet for å strømlinjeforme videoredigeringsprosessen for ulike innholdstyper, fra snakkende hoder til montasjer, ved intelligent håndtering av klipp, fargekorrigering og innbrenning av undertekster.

Systemet fungerer ved å lese videoinnhold gjennom detaljerte lydtranskripsjoner og visuelle kompositter på forespørsel, i stedet for å behandle hvert bilde. Denne metoden gir AI-en ordgrense-presisjon for redigering samtidig som beregningsmessig overhead reduseres betydelig. Viktige funksjoner inkluderer automatisk fjerning av fyllord og død plass, anvendelse av intelligente fargegraderinger, sikring av sømløse lydoverganger og innbrenning av tilpassbare undertekster direkte i videoen.

Utover automatisering inkorporerer videobruk en robust selvevalueringspipeline. Etter innledende behandling gjennomgår AI-en den renderte utdataen ved hver klippgrense for å oppdage og korrigere ufullkommenheter som visuelle hopp eller lydpopp. Dette sikrer at den endelige videoen møter høye produksjonsstandarder før den presenteres for brukeren. Verktøyet opprettholder også øktminne, slik at brukere kan plukke opp redigeringsøkter nøyaktig der de slapp, noe som forbedrer arbeidsflyteffektivitet og konsistens.

## Key features

- **Automatisk fjerning av fyllord**: Kutter automatisk ut fyllord som 'umm', 'uh', falske starter og dødrom mellom opptak for renere lyd.
- **Intelligent fargegradering**: Autofargegraderer hvert videosegment, og tilbyr alternativer som varm filmatisk, nøytral punch, eller egendefinerte FFmpeg-kjeder for jevn visuell kvalitet.
- **Sømløse lydoverganger**: Legger på 30 ms lydoverganger ved hvert kutt for å eliminere knatrelyder og sikre jevne overganger mellom segmenter.
- **Tilpassbar innbrenning av undertekster**: Brenner undertekster direkte inn i videoen i en tilpassbar stil, med 2-ords STORE BOKSTAVER-biter som standard, noe som forbedrer tilgjengelighet og engasjement.
- **KI-drevet selvevaluering**: Systemet selvevaluerer det ferdigstilte utdata ved hver kuttegrense, og fanger visuelle hopp, lyd-popp og skjulte undertekster før forhåndsvisningen vises.

## Use cases

- **Produsere profesjonelle pratsomme hode-videoer**: Finpuss raskt opptak av pratsomme hoder ved å fjerne pauser og fyllord, for å sikre en konsis og engasjerende presentasjon.
- **Skape dynamiske videomontasjer**: Sett enkelt sammen montasjer med automatiserte kutt, fargegradering og animasjonsoverlegg for et polert og profesjonelt utseende.
- **Effektivisere produksjon av veiledningsvideoer**: Akselerer produksjonen av veiledningsvideoer ved å automatisere repeterende redigeringsoppgaver, slik at skapere kan fokusere på innhold.

## Result preview

Se en intervjuvideo polert til et sosiale medier-klipp med forbedret tempo, undertekster, forbedret lyd.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-2.png)

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-3.png)

## Result walkthrough

### Steg 1：Installer

Legg til ferdigheten til agenten din.

![a simple demonstration of the first step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-1.jpg)

### Steg 2：Last opp videoen din

Last opp en intervju-, veilednings- eller produktvideo og beskriv de ønskede redigeringene.

![a simple demonstration of the second step in using Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-step-2.jpg)

### Steg 3：Gjennomgå utdata

Motta den redigerte versjonen og verifiser undertekster, overganger og tempo.

![the demo of Video Editing Agent Skill](https://file.nanoskill.ai/video-editing-demo-1.png)

## Skill definition

# videobruk

Introduserer **videobruk** — rediger videoer med Claude Code. 100 % åpen kildekode.

Slipp råmateriale i en mappe, chat med Claude Code, få `final.mp4` tilbake. Fungerer for alt innhold — snakkende hoder, montasjer, opplæringsprogrammer, reise, intervjuer — uten forhåndsinnstillinger eller menyer.

## Hva den gjør

- **Kutter ut fyllord** (`umm`, `uh`, feilstarter) og dødrom mellom opptak
- **Automatisk fargegradering** av hvert segment (varm filmatisk, nøytralt trøkk, eller hvilken som helst tilpasset ffmpeg-kjede)
- **30 ms lydovertoninger** ved hvert kutt så du aldri hører et smell
- **Brenner undertekster** i din stil — standard 2-ords STORE BOKSTAVER-biter, fullt tilpassbart
- **Genererer animasjonsoverlegg** via [HyperFrames](https://github.com/heygen-com/hyperframes), [Remotion](https://www.remotion.dev/), [Manim](https://www.manim.community/), eller PIL — opprettes i parallelle underagenter, én per animasjon
- **Selv-evaluerer den renderte utdataen** ved hver kutteovergang før du får se noe
- **Varig lagrer sesjonsminne** i `project.md` slik at neste ukes sesjon fortsetter der du slapp

## Oppsettsprompt

Lim inn i Claude Code, Codex, Hermes, Openclaw, eller hvilken som helst agent med skalltilgang:

```text
Set up https://github.com/browser-use/video-use for me.

Read install.md first to install this repo, wire up ffmpeg, register the skill with whichever agent you're running under, and set up the ElevenLabs API key — ask me to paste it when you need it. Then read SKILL.md for daily usage, and always read helpers/ because that's where the editing scripts live. After install, don't transcribe anything on your own — just tell me it's ready and wait for me to drop footage into a folder.
```

Agenten håndterer kloning, avhengigheter, ferdighetsregistrering, og spør deg én gang om ElevenLabs API-nøkkelen din (hent en på [elevenlabs.io/app/settings/api-keys](https://elevenlabs.io/app/settings/api-keys)).

Deretter pek agenten din til en mappe med råopptak:

```bash
cd /path/to/your/videos
claude    # or codex, hermes, etc.
```

For kontinuerlig redigering fra din egen VPS eller Telegram, kjør agenten gjennom [Browser Use Box](https://browser-use.com/bux). [Se den 15 sekunder lange demoen](https://www.tiktok.com/@browser_use/video/7639824093721758989).

Og i sesjonen:

> rediger disse til en lanseringsvideo

Den tar opptelling av kildene, foreslår en strategi, venter på din OK, og produserer så `edit/final.mp4` ved siden av kildene dine. All utdata havner i `<videos_dir>/edit/` — ferdighetsmappen forblir ren.

## Manuell installasjon

Hvis du heller vil gjøre det for hånd:

```bash
# 1. Clone and symlink into your agent's skills directory
git clone https://github.com/browser-use/video-use ~/Developer/video-use
ln -sfn ~/Developer/video-use ~/.claude/skills/video-use        # Claude Code
# ln -sfn ~/Developer/video-use ~/.codex/skills/video-use       # Codex

# 2. Install deps
cd ~/Developer/video-use
uv sync                         # or: pip install -e .
brew install ffmpeg             # required
brew install yt-dlp             # optional, for downloading online sources

# 3. Add your ElevenLabs API key
cp .env.example .env
$EDITOR .env                    # ELEVENLABS_API_KEY=...
```

## Hvordan det fungerer

LLM-en ser aldri videoen. Den **leser** den — gjennom to lag som sammen gir den alt den trenger for å klippe med ordgrense-presisjon.

<p align="center">
  <img src="https://file.nanoskill.ai/timeline-view.svg" alt="timeline_view composite — filmstrip + speaker track + waveform + word labels + silence-gap cut candidates" width="100%">
</p>

**Lag 1 — Lydtranskripsjon (alltid lastet).** Én ElevenLabs Scribe-kall per kilde gir tidsstempler på ordnivå, talediariering og lydhendelser (`(latter)`, `(applaus)`, `(sukk)`). Alle opptak pakkes inn i én enkelt ~12KB `takes_packed.md` — LLM-ens primære lesevisning.

```
## C0103  (duration: 43.0s, 8 phrases)
  [002.52-005.36] S0 Ninety percent of what a web agent does is completely wasted.
  [006.08-006.74] S0 We fixed this.
```

**Lag 2 — Visuell kompositt (på forespørsel).** `timeline_view` produserer en filmstrimmel + bølgeform + ordetiketter PNG for ethvert tidsintervall. Kalles kun ved beslutningspunkter — tvetydige pauser, sammenligninger av gjentak, fornuftssjekker av klippepunkter.

> Naiv tilnærming: 30 000 bilder × 1 500 symboler = **45M symboler med støy**.
> Video Use: **12KB tekst + en håndfull PNG-er**.

Samme idé som browser-use gir en LLM en strukturert DOM istedenfor et skjermbilde — men for video.

## Rørledning

```
Transkriber ──> Pakk ──> LLM-resonnering ──> EDL ──> Render ──> Selv-eval
                                                              │
                                                              └─ problem? fiks + re-render (maks 3)
```

Selv-evalueringssløyfen kjører `timeline_view` på den _renderte utdataen_ ved hver klippegrense — fanger opp visuelle hopp, lydsmell, skjulte undertekster. Du ser forhåndsvisningen først etter at den har passert.

## Designprinsipper

1. **Tekst + visuelle elementer på forespørsel.** Ingen bildedumping. Transkripsjonen er overflaten.
2. **Lyd er primær, det visuelle følger.** Klipp kommer fra talegrenser og stillhetshull.
3. **Spør → bekreft → utfør → selv-evaluer → varig lagre.** Aldri rør klippet uten strategigodkjenning.
4. **Null antagelser om innholdstype.** Se, spør, og rediger så.
5. **12 harde regler, kunstnerisk frihet ellers.** Produksjonskorrekthet er ufravikelig. Smak er det ikke.

Se [`SKILL.md`](./SKILL.md) for alle produksjonsreglene og redigeringshåndverket.

## FAQ

### Hva er videobruk?

Videobruk er et åpen kildekode-verktøy som lar deg redigere videoer ved hjelp av KI-agenter som Claude Kode. Det automatiserer vanlige redigeringsoppgaver som å kutte fyllord, fargegradere og legge til undertekster.

### Hvordan fungerer videobruk uten at språkmodellen ser videoen?

Språkmodellen leser videoen gjennom to lag: en lydtranskripsjon med tidsstempler på ordnivå og taleroppdeling, samt visuelle sammensetninger på forespørsel (filmstrimmel + bølgeform + ordetiketter-PNGer) for beslutningspunkter. Denne tilnærmingen minimerer token-bruk samtidig som den gir presise redigeringsmuligheter.

### Hvilke typer videoer kan jeg redigere med videobruk?

Videobruk er designet for å fungere med alle innholdstyper, inkludert pratsomme hoder, montasjer, veiledninger, reise-vlogger og intervjuer. Den tilpasser seg opptakene dine uten å kreve forhåndsinnstillinger eller menyer.

### Hva er kjernefunksjonene til videobruk?

Nøkkelfunksjoner inkluderer å kutte ut fyllord og dødrom, automatisk fargegradering, 30 ms lydoverganger, innbrenning av tilpassbare undertekster, generering av animasjonsoverlegg, selvevaluering av ferdigstilt utdata og lagring av øktminne.

### Trenger jeg en ElevenLabs API-nøkkel for å bruke videobruk?

Ja, en ElevenLabs API-nøkkel kreves for lydtranskripsjon og taleroppdeling, som er avgjørende for verktøyets funksjonalitet. Du vil bli bedt om å oppgi den under oppsettprosessen.

### Kan jeg installere videobruk manuelt i stedet for å bruke oppsettsprompten?

Ja, du kan utføre en manuell installasjon ved å klone depotet, lage en symbolsk lenke til agentens ferdighetsmappe, installere avhengigheter som FFmpeg, og konfigurere ElevenLabs API-nøkkelen din i .env-filen.
