Google DeepMind har netop udrullet en ny opdatering til deres nyeste AI-modeller, herunder Gemini 3.7 Flash, 3.6 Flash og 3.5 Flash-Lite. Den nye funktion kaldes agentic video understanding (agentisk videoanalyse).
Med denne opdatering ændrer Google måden, AI behandler videoer på. Det resulterer i op til 88% lavere token-forbrug, op til 66% lavere omkostninger og op til 7% højere præcision.
Hvordan fungerer den nye agentiske videoanalyse?
Tidligere behandlede AI-modeller videoer “statisk”. Det skete ved at gennemgå et fast antal billeder i sekundet (f.eks. 1 frame i sekundet). Det var både dyrt i tokens og medførte, at vigtige detaljer ofte blev overset i lange videoer.
Med den nye opdatering tager Gemini selv styringen i en såkaldt agentic loop:
- Aktiv og målrettet søgning: Modellen bestemmer selv, hvilke tidsstempler den skal kigge nærmere på, ved hvilken hastighed og via hvilke datakilder (billeder, lyd eller transkription).
- Dynamisk genafspilning: Hvis der sker noget hurtigt i videoen, kan modellen automatisk skrue op for opdateringshastigheden i det specifikke tidsrum.
- Målrettet datahentning: Modellen henter kun de øjeblikke, den reelt skal bruge til at besvare brugerens opgave, frem for at hente hele videoen i høj opløsning.
Du kan læse flere guides om kunstig intelligens og de nyeste AI-værktøjer på vores guidesektion
.
Benchmarks: Ydeevne og besparelser
| Parameter | Statisk videoanalyse | Agentisk videoanalyse (Gemini 3.7 Flash) |
| Token-forbrug | Standard (100%) | Reduceret med op til 88% |
| Driftsomkostninger | Standard (100%) | Sænket med op til 66% |
| Analysepræcision | Standard | Forbedret med op til 7% |
| Processeringstype | Fast billedfrekvens (f.eks. 1 FPS) | Dynamisk scanning via interne værktøjer |
Nye muligheder for udviklere og virksomheder
Den nye teknologi åbner for en række avancerede funktioner, som tidligere var for dyre eller teknisk svære at udføre på lange videoer:
- Søgning på under et sekund: Find præcise klip og hurtige skift i videoen, hvilket gør automatiseret videoredigering langt mere nøjagtig.
- Nål-i-en-høstak søgning: Stil komplekse spørgsmål til flere timers videomateriale uden at opbruge millioner af tokens.
- Præcis tælling og sporing: Registrer gentagne fysiske bevægelser eller specifikke genstande over tid.
- Fejlsøgning og afvigelser: Genkend hurtige bevægelser og visuelle fejl ved automatisk at analysere udvalgte sekvenser i højere kvalitet.
Funktionen er tilgængelig fra i dag via Gemini API i Google AI Studio samt på Gemini Enterprise Agent Platform.
Læs mere om udviklingen og de officielle udmeldinger direkte hos Google DeepMind
.
Techsens vurdering: Google viser endnu engang, at fremtidens AI handler om smarte agenter frem for blot at smide rå regnekraft efter store datamængder. At reducere token-forbruget med 88% er et gigantisk gennembrud for virksomheder, der arbejder med tungt videomateriale.
Hvis du ville læse om hvordan EU tvinger giganten til at åbne for Gemini AI kan du læse det her
Læs også
-
TikToks nye kommentarfelt: Genialt træk eller det rene kaos?
-
Sådan gør du dit barns iPhone mere sikker med iOS 27
-
Realme lancerer Harry Potter-udgave af 16 Pro: Hedvig-kamera og kuffert-æske
-
OPPO Find X10-serien får 8.000 mAh batteri og op til tre 200 MP-kameraer
-
Samsung melder om rekordsucces: Salget af Galaxy Z Fold8 og Fold8 Ultra brager op med 50 %
