kunstig intelligens
Slipper kraftig KI-agent: Nå har Open AI gjort tunge kodeoppgaver mye enklere
Lanserer sin nye, kraftige kodeagent «Codex».
Koding har raskt blitt et av de områdene hvor generativ, kunstig intelligens virkelig har funnet sin plass, og det har fått KI-selskapene til å lansere nye KI-baserte verktøy i høyt tempo.
Nå har Open AI store saker på gang, for på nettsidene sine har selskapet avduket «Codex» – det seneste hjelpemiddelet for de som benytter KI til koding i større skala.
Jobber med mange oppgaver samtidig
Codex beskrives av Open AI som en nettskybasert «programvareingeniør-agent» som kan jobbe med mange forskjellige oppgaver samtidig, og løse mer komplekse problemer.
– Codex kan utføre oppgaver som å skrive funksjoner, svare på spørsmål om kodebasen din, fikse feil og foreslå «pull requests» for gjennomgang. Hver oppgave kjøres i sitt eget sandkassemiljø i skyen, forhåndslastet med kodearkivet ditt, skriver Open AI i sin beskrivelse.
Agenten rulles ut til betalende brukere av ChatGPT Pro-, Enterprise- og Team-tilbudene, mens Plus- og Edu-brukere vil få funksjonen på et senere tidspunkt. Den blir tilgjengelig via sidemenyen i Chat GPT, med ett menyvalg for utføring av kodeoppgaver og et annet for spørsmål om koden din.
Open AI sier at Codex har blitt trent på reelle kodeoppgaver i mange ulike typer miljøer, noe som innebærer at agenten skal kunne generere kode som ligger svært nær menneskelige preferanser og stil. Den skal også være i stand til å følge instrukser svært presist, og kan kjøre tester om og om igjen inntil et akseptabelt resultat foreligger.
Bygger på den kraftige o3-modellen
– Codex kan lese og redigere filer, samt kjøre kommandoer inkludert testverktøy, linters og typekontroller. Fullføringen av en oppgave tar vanligvis mellom 1 og 30 minutter, avhengig av kompleksitet, og du kan følge Codex’ fremdrift i sanntid, forteller Open AI videre.
Den nye kodeganten er basert på resonneringsmodellen OpenAI o3, som ble lansert i april og som er selskapets aller mest potente modell hittil. Codex bygger på en versjon av o3 som skal være optimalisert for programmering, og skal levere enda høyere ytelse på dette området.
I interne tester som Open AI utførte oppnådde Codex en presisjon på 75 prosent med den såkalte SWE Bench-testen, et ytelsesverktøy som brukes til å måle KI-modellers evne til å løse problemer i virkelige kodeprosjekter på Github. Til sammenligning nådde OpenAI o3-modellen 70 prosent i den samme testen.
Tekniske team hos Open AI har allerede begynt å benytte Codex, og eksterne testere som inkluderer IT-giganten Cisco, har også begynt å utforske ulike anvendelser for den nye KI-agenten.
Skal ivareta sikkerhet
Etter hvert som KI-drevne kodeverktøyene blir stadig mer avanserte, har aktørene også begynt å anerkjenne truslene som teknologien utgjør innen utvikling av skadevare. Digi har tidligere rapportert om funn som indikerer at ondsinnede aktører i økende grad bruker KI til å lage skadevare.
Open AI sier at Codex har blitt trent til å identifisere og avvise forespørsler som har ondsinnede formål, og å skille slike forespørsler fra de som er legitime.
Agenten opererer også fullstendig innenfor et sikkert, isolert miljø i skyen, og har ikke internettilgang under selve utførelsen av oppgavene, opplyser selskapet.