---
title: GPT-6 Astra Ungguli Model Lain dalam Pengujian Agen Otonom Andon Labs
url: https://www.dataloco.com/id/gpt-6-astra-ungguli-model-lain-dalam-pengujian-agen-otonom-andon-labs
published: 2026-09-16T10:58:14+00:00
language: id
section: AI
source: https://the-decoder.de/gpt-6-astra-taugt-als-ueberwachungsdrohnen-pilot-und-als-autonomer-haendler/
organizations: Andon Labs, OpenAI
publisher: Dataloco
---

# GPT-6 Astra Ungguli Model Lain dalam Pengujian Agen Otonom Andon Labs

Andon Labs telah menguji GPT-6 Astra dari OpenAI dalam dua tolok ukur agen yang berbeda, yaitu Vending-Bench dan Drone-Bench, di mana model tersebut menunjukkan kinerja yang lebih unggul dibandingkan model frontier sebelumnya.

Dalam Vending-Bench, model ini mensimulasikan pengoperasian mesin penjual otomatis selama satu tahun dengan modal awal 500 dolar. GPT-6 Astra menghasilkan rata-rata 15.515 dolar dari enam kali percobaan, jauh melampaui Claude Fable 5.1 yang hanya mencapai 5.422 dolar. Hasil terendah Astra sebesar 13.272 dolar masih lebih tinggi daripada hasil terbaik Fable yang mencapai 9.874 dolar.

Keunggulan Astra terlihat pada kemampuan negosiasi harga pembelian yang lebih konsisten. Sebagai contoh, Astra berhasil menurunkan harga keranjang belanja dari 226,32 dolar menjadi 108 dolar. Selain itu, Astra tidak mengalami kerugian akibat pembayaran di muka kepada pemasok yang sudah tutup, berbeda dengan Claude Fable 5.1 yang kehilangan total 14.331 dolar melalui 45 pembayaran serupa.

Dalam pengujian Vending-Bench Arena, Astra memenangkan ketiga permainan dan menolak proposal pengaturan harga dari model GLM-5.3. Sebaliknya, Claude Fable 5.1 terlibat dalam pengaturan harga yang dikategorikan ilegal oleh Andon Labs. Andon Labs menilai Astra lebih kuat secara ekonomi dan memiliki penyelarasan yang lebih baik berdasarkan perilaku dalam tolok ukur tersebut.

Pada Drone-Bench, model ini diminta menulis kode agar drone DJI Tello EDU dapat bernavigasi secara otonom, mengenali orang, dan mengikutinya. Astra menjadi model pertama yang berhasil melampaui garis dasar manusia dengan bantuan kecerdasan buatan pada kelima tugas bagian, termasuk rekonstruksi 3D yang sebelumnya tidak terpecahkan. Astra menggunakan alur kerja dari COLMAP dan DA3 dengan penyaringan kedalaman tambahan untuk membuat model 3D yang dapat dinavigasi.

Meskipun mencapai performa puncak, Andon Labs mencatat bahwa Astra masih tidak dapat diandalkan. Model ini hanya melampaui garis dasar dalam empat dari sepuluh percobaan untuk pengenalan orang, dan hanya satu dari sepuluh percobaan untuk rekonstruksi 3D. Peluang rata-rata bagi Astra untuk berhasil menyelesaikan kelima langkah secara berurutan diperkirakan hanya sebesar 2,8 persen.

## This story in other languages

- [עברית](https://www.dataloco.com/he/gpt-6-astra-andon-labs)
- [Español](https://www.dataloco.com/es/gpt-6-astra-supera-a-otros-modelos-en-pruebas-de-agentes-autonomos)
- [Norsk](https://www.dataloco.com/no/gpt-6-astra-utkonkurrerer-andre-modeller-i-tester-av-autonome-agenter)
- [Polski](https://www.dataloco.com/pl/gpt-6-astra-osiaga-przelomowe-wyniki-w-testach-autonomicznych-agentow)
- [ไทย](https://www.dataloco.com/th/gpt-6-astra-openai)
- [Türkçe](https://www.dataloco.com/tr/gpt-6-astra-gozetleme-drone-pilotu-ve-otonom-tuccar-olarak-test-edildi)
- [العربية](https://www.dataloco.com/ar/nmothg-gpt-6-astra-ytfok-fy-akhtbarat-aloklaaa-almstklyn-ladar-almbyaaat-otogyh-altayrat-almsyr)
- [हिन्दी](https://www.dataloco.com/hi/gpt-6-astra-na-ejata-bcamaraka-ma-bhatara-paratharashana-kaya-oura-darana-sacalna-ma-safalta-paii)
