استخدام النماذج لتنفيذ مهام البرمجة بصورة وكيلة، وهو سياق استُخدم لمقارنة أداء Opus 5.5.
أعلنت Anthropic عن نموذج Opus 5.5، بينما كشفت OpenAI عن GPT-6 Sol وGPT-6 Luna، مع تركيز مشترك على خفض تكاليف الاستخدام وتحسين البرمجة والالتزام بضوابط السلامة. وتظل نتائج المقارنات ومقترحات معايير التقييم الخارجية بحاجة إلى تحقق مستقل.