AWS отметила 20-летие запуска бета-версии Amazon EC2, которая появилась в 2006 году благодаря публикации Jeff Barr и предоставила масштабируемые виртуальные серверы Linux с почасовой оплатой. Тогда был доступен только один тип инстансов — m1.small — и один регион — US East. По словам AWS, эта простая модель изменила подход к созданию и управлению вычислительной инфраструктурой.
С момента запуска основная ценность EC2 не изменилась: предоставление масштабируемых вычислительных мощностей в течение нескольких минут, оплата по факту потребления и возможность увеличивать или сокращать ресурсы без долгосрочных обязательств. Однако масштаб сервиса радикально изменился: от одного типа инстансов он вырос до более чем 1 200 типов, охватывающих универсальные вычисления, рабочие нагрузки, оптимизированные для обработки, памяти или хранения данных, ускоренные вычисления и высокопроизводительные вычисления. Кроме того, сервис расширился с одного региона AWS до 39 регионов по всему миру.
Основа, на которой была построена экосистема
AWS связывает развитие EC2 с несколькими базовыми сервисами, добавлявшимися поэтапно. Amazon Elastic Block Store, представленный в 2008 году, обеспечил постоянное блочное хранилище, а Elastic Load Balancing, Auto Scaling и Amazon CloudWatch, появившиеся в 2009 году, поддержали масштабируемость и высокую доступность. В том же году Amazon Virtual Private Cloud предоставил логически изолированные сети. Затем AWS Nitro System, представленный в 2017 году, стал основой для ускорения инноваций и повышения безопасности, а в 2018 году последовала архитектура процессоров AWS Graviton для масштабных и чувствительных к затратам рабочих нагрузок.
EC2 больше не ограничивается традиционными регионами AWS. Благодаря AWS Outposts, представленному в 2018 году, инстансы EC2 можно запускать локально, тогда как AWS Local Zones с 2019 года предоставляют площадки, расположенные ближе к пользователям. AWS Wavelength позволяет запускать инстансы внутри сетей глобальных операторов связи, работающих по технологии 5G.
От универсальных вычислений к жизненному циклу искусственного интеллекта
AWS подчёркивает расширение EC2 в области чипов для искусственного интеллекта. Инстансы Inf1 с чипами AWS Inferentia были созданы для крупномасштабного машинного обучения при выполнении вывода, а инстансы Inf2 стали общедоступными в апреле 2023 года для крупных рабочих нагрузок генеративного вывода. Параллельно инстансы Trainium предназначены для обучения и вывода: Trn1 были представлены в ноябре 2021 года, а Trn2 с Trainium2 запущены в декабре 2024 года.
Trn2 UltraServers объединяют до 64 ускорителей через NeuronLink для обучения базовых моделей, содержащих триллионы параметров. AWS также заявляет, что Trn3 UltraServers, представленные на AWS re:Invent 2025, могут объединять до 144 чипов Trainium3 для рабочих нагрузок обучения и обслуживания передовых моделей, агентских приложений, вывода и видео.
Что изменилось на практике?
Расширение не ограничилось чипами. EC2 Mac появилась в 2020 году с устройствами Mac mini на базе процессоров Intel Core i7, а в июле 2022 года появились инстансы Mac M1, ставшие первыми основанными на Arm инстансами macOS в EC2. За ними последовали инстансы M2 Pro в 2023 году, затем M4 и M4 Pro в 2025 году, а также M3 Ultra и M4 Max в 2026 году. Они предоставляют облачные среды для создания и тестирования приложений macOS, iOS, iPadOS, tvOS, watchOS и visionOS.
EC2 Capacity Blocks for ML также представила модель временного резервирования мощностей GPU: клиент может зарезервировать инстансы GPU, начиная с P5, на будущую дату и только на необходимый срок. В ноябре 2024 года была добавлена поддержка подготовки в течение нескольких минут и продления срока до шести месяцев. Затем поддержка расширилась на P6-B300, P6-B200, P5e, P5en, P4d, P4de, Trn1, Trn2 и Trn3 наряду с P5.
Значение юбилея и его ограничения
Эта история показывает, что EC2 стала операционным уровнем, на который опираются такие сервисы, как Amazon ECS, Amazon EKS, AWS Lambda, AWS Fargate, AWS Batch, Amazon EMR, Amazon SageMaker AI и Amazon Bedrock. AWS также отмечает, что Graviton5, представленный на AWS re:Invent 2025, содержит 192 ядра, кэш увеличенного в пять раз объёма и обеспечивает сокращение времени связи между ядрами до 33%, а инстансы M9g и M9gd, а затем C9g и C9gd были представлены в июне 2026 года.
Последнее из упомянутого AWS — AWS Nitro Isolation Engine в 2026 году. Это компонент Nitro Hypervisor, использующий формальную верификацию для предоставления математической гарантии изоляции клиентских рабочих нагрузок друг от друга и от операторов AWS. Как и приведённые компанией показатели производительности и экономии на токенах, этот тезис является описанием самого источника, а не независимой оценкой. Однако общая тенденция очевидна: то, что начиналось как гибкий сервис виртуальных серверов, стало основой для запуска разнообразных рабочих нагрузок — от веб-серверов до обучения моделей искусственного интеллекта, содержащих триллионы параметров.