---
title: GPT-6 Astra utkonkurrerer andre modeller i tester av autonome agenter
url: https://www.dataloco.com/no/gpt-6-astra-utkonkurrerer-andre-modeller-i-tester-av-autonome-agenter
published: 2026-09-16T10:44:41+00:00
language: no
section: KI
source: https://the-decoder.de/gpt-6-astra-taugt-als-ueberwachungsdrohnen-pilot-und-als-autonomer-haendler/
organizations: Andon Labs, OpenAI
publisher: Dataloco
---

# GPT-6 Astra utkonkurrerer andre modeller i tester av autonome agenter

Andon Labs har testet GPT-6 Astra fra OpenAI i to ulike referansetester for agenter, hvor modellen viste sterke resultater både i drift av salgsautomater og styring av droner.

I referansetesten Vending-Bench, som simulerer drift av en salgsautomat over ett år, oppnådde GPT-6 Astra et gjennomsnittlig resultat på 15.515 dollar over seks gjennomganger. Dette er betydelig høyere enn Claude Fable 5.1, som nådde 5.422 dollar. Astra viste seg mer konsekvent i prisforhandlinger med leverandører og unngikk tap ved forskuddsbetalinger til nedlagte virksomheter, i motsetning til Claude Fable 5.1 som tapte 14.331 dollar på slike betalinger.

I en arena-versjon av testen, hvor flere agenter opererer på samme sted, avviste GPT-6 Astra et forslag om prisavtaler fra GLM-5.3. Claude Fable 5.1 deltok derimot i en slik prisavtale, som ble vurdert som ulovlig. Andon Labs observerte ingen løgner fra Astra i de tre undersøkte spillene, og modellen vant alle tre. Dette førte til en vurdering av at Astra er økonomisk sterkere og bedre justert, selv om dette kun gjelder atferden i denne spesifikke testen.

I referansetesten Drone-Bench skal modellene skrive kode for at en DJI Tello EDU skal kunne navigere autonomt, gjenkjenne og følge en person. Oppgaven er delt inn i fem deloppgaver: 3D-rekonstruksjon av omgivelsene, lokalisering av dronen, navigasjon, gjenkjenning av målperson og sporing.

GPT-6 Astra er den første modellen som har prestert over referansenivået for mennesker med kunstig intelligens i alle fem deloppgavene. Modellen løste spesielt 3D-rekonstruksjonen, som tidligere var uløst, ved å utvikle en rørledning med COLMAP og DA3 med ekstra dybdefiltrering.

Til tross for toppresultatene er påliteligheten lav. Astra slo referansenivået i persongjenkjenning i fire av ti forsøk, og i 3D-rekonstruksjon i kun ett av ti forsøk. Andon Labs beregner at det for en gjennomsnittlig gjennomgang med Astra kun er 2,8 prosent sjanse for å lykkes med alle fem trinnene etter hverandre.

## This story in other languages

- [עברית](https://www.dataloco.com/he/gpt-6-astra-andon-labs)
- [Español](https://www.dataloco.com/es/gpt-6-astra-supera-a-otros-modelos-en-pruebas-de-agentes-autonomos)
- [Polski](https://www.dataloco.com/pl/gpt-6-astra-osiaga-przelomowe-wyniki-w-testach-autonomicznych-agentow)
- [Bahasa Indonesia](https://www.dataloco.com/id/gpt-6-astra-ungguli-model-lain-dalam-pengujian-agen-otonom-andon-labs)
- [ไทย](https://www.dataloco.com/th/gpt-6-astra-openai)
- [Türkçe](https://www.dataloco.com/tr/gpt-6-astra-gozetleme-drone-pilotu-ve-otonom-tuccar-olarak-test-edildi)
- [العربية](https://www.dataloco.com/ar/nmothg-gpt-6-astra-ytfok-fy-akhtbarat-aloklaaa-almstklyn-ladar-almbyaaat-otogyh-altayrat-almsyr)
- [हिन्दी](https://www.dataloco.com/hi/gpt-6-astra-na-ejata-bcamaraka-ma-bhatara-paratharashana-kaya-oura-darana-sacalna-ma-safalta-paii)
