Merge
@merge_api
Two frontier models a few points apart on the Intelligence Index can differ 7x in the tokens they burn per task.
GPT-6 Astra (@OpenAI) scores 52.7 and finishes an average Artificial Analysis Intelligence Index task in 27K output tokens. Claude Sonnet 5.5 scores 56.0 and uses
GPT-6 Astra (@OpenAI) scores 52.7 and finishes an average Artificial Analysis Intelligence Index task in 27K output tokens. Claude Sonnet 5.5 scores 56.0 and uses
4 44