Google DeepMind har netop udrullet en ny opdatering til deres nyeste AI-modeller, herunder Gemini 3.7 Flash, 3.6 Flash og 3.5 Flash-Lite. Den nye funktion kaldes agentic video understanding (agentisk videoanalyse).
Med denne opdatering ændrer Google måden, AI behandler videoer på. Det resulterer i op til 88% lavere token-forbrug, op til 66% lavere omkostninger og op til 7% højere præcision.
Hvordan fungerer den nye agentiske videoanalyse?
Tidligere behandlede AI-modeller videoer “statisk”. Det skete ved at gennemgå et fast antal billeder i sekundet (f.eks. 1 frame i sekundet). Det var både dyrt i tokens og medførte, at vigtige detaljer ofte blev overset i lange videoer.
Med den nye opdatering tager Gemini selv styringen i en såkaldt agentic loop:
- Aktiv og målrettet søgning: Modellen bestemmer selv, hvilke tidsstempler den skal kigge nærmere på, ved hvilken hastighed og via hvilke datakilder (billeder, lyd eller transkription).
- Dynamisk genafspilning: Hvis der sker noget hurtigt i videoen, kan modellen automatisk skrue op for opdateringshastigheden i det specifikke tidsrum.
- Målrettet datahentning: Modellen henter kun de øjeblikke, den reelt skal bruge til at besvare brugerens opgave, frem for at hente hele videoen i høj opløsning.
Du kan læse flere guides om kunstig intelligens og de nyeste AI-værktøjer på vores guidesektion
.
Benchmarks: Ydeevne og besparelser
| Parameter | Statisk videoanalyse | Agentisk videoanalyse (Gemini 3.7 Flash) |
| Token-forbrug | Standard (100%) | Reduceret med op til 88% |
| Driftsomkostninger | Standard (100%) | Sænket med op til 66% |
| Analysepræcision | Standard | Forbedret med op til 7% |
| Processeringstype | Fast billedfrekvens (f.eks. 1 FPS) | Dynamisk scanning via interne værktøjer |
Nye muligheder for udviklere og virksomheder
Den nye teknologi åbner for en række avancerede funktioner, som tidligere var for dyre eller teknisk svære at udføre på lange videoer:
- Søgning på under et sekund: Find præcise klip og hurtige skift i videoen, hvilket gør automatiseret videoredigering langt mere nøjagtig.
- Nål-i-en-høstak søgning: Stil komplekse spørgsmål til flere timers videomateriale uden at opbruge millioner af tokens.
- Præcis tælling og sporing: Registrer gentagne fysiske bevægelser eller specifikke genstande over tid.
- Fejlsøgning og afvigelser: Genkend hurtige bevægelser og visuelle fejl ved automatisk at analysere udvalgte sekvenser i højere kvalitet.
Funktionen er tilgængelig fra i dag via Gemini API i Google AI Studio samt på Gemini Enterprise Agent Platform.
Læs mere om udviklingen og de officielle udmeldinger direkte hos Google DeepMind
.
Techsens vurdering: Google viser endnu engang, at fremtidens AI handler om smarte agenter frem for blot at smide rå regnekraft efter store datamængder. At reducere token-forbruget med 88% er et gigantisk gennembrud for virksomheder, der arbejder med tungt videomateriale.
Hvis du ville læse om hvordan EU tvinger giganten til at åbne for Gemini AI kan du læse det her
Læs også
-
Bang & Olufsen lancerer Beosound A9 i ny Sienna Brown med unikt Kvadrat-tekstil
-
Hvilken vej vil John Ternus tage Apple?
-
AI-briller bliver det næste store tech-hit – men vil vi gå med kamera i ansigtet?
-
EISA Awards: Sony tager årets kamera, mens Fujifilm og Nikon også vinder priser
-
Sennheiser og Mercedes-Benz indleder nyt partnerskab: Lancerer eksklusive HD 620 Mercedes-AMG Edition gaming-hovedtelefoner
