AWS Graviton5 и возвращение CPU в эпоху AI
AWS представила Graviton5 на инстансах EC2 C9g/C9gd — ARM-процессоры для AI-инференса, HPC и аналитики. Разбираем, почему CPU снова становится ключевым игроком в эпоху агентного AI.
Читать новостьServerbay
События компании, анонсы и актуальные обновления из мира серверного оборудования и IT.
6 новостей
AWS представила Graviton5 на инстансах EC2 C9g/C9gd — ARM-процессоры для AI-инференса, HPC и аналитики. Разбираем, почему CPU снова становится ключевым игроком в эпоху агентного AI.
Читать новостьNvidia обогнала Cisco и Arista на рынке Ethernet-коммутаторов для ЦОД — данные IDC. Секрет взлета — интеграция Mellanox и GPU-платформ под ИИ-задачи. Как Nvidia меняет правила игры в сетевой инфраструктуре и что ждет enterprise-сегмент? Читайте анализ рынка AI-фабрик.
Читать новостьНовый Dell PowerEdge XE8812 на архитектуре NVIDIA Vera Rubin NVL4 обеспечивает беспрецедентную плотность вычислений (до 144 GPU в стойке) и прямую жидкостную систему охлаждения для самых требовательных HPC- и AI-нагрузок в геномике, суперкомпьютерных центрах и корпоративном машинном обучении.
Читать новостьWiwynn представила сервер хранения на базе NVIDIA SCADA, где GPU напрямую управляет вводом-выводом в обход CPU, обеспечивая 2,95 ПБ ёмкости, 528 млн IOPS на блоках 4K и субмиллисекундные задержки для инференса LLM, графовых нейросетей и RAG-систем.
Читать новостьAMD заявила, что 256-ядерный EPYC Venice на архитектуре Zen 6 опережает NVIDIA Vera в 3,3 раза при одинаковом энергобюджете стойки 100 кВт, однако сравнение основано на экстраполяции и линейном масштабировании, а не на прямых замерах, и касается преимущественно enterprise-нагрузок вроде SPEC CPU, Java, Redis и MySQL, а не специализированных AI-задач.
Читать новостьКитайская InnoGrit представила контроллер IG5686 Crestone с интерфейсом PCIe 6.0 x4, обеспечивающий скорость последовательного чтения до 28 Гбайт/с, произвольного чтения до 7 млн IOPS и поддержку накопителей ёмкостью до 256 Тбайт, что в 2 раза быстрее PCIe 5.0 решений и устраняет узкое горлышко ввода-вывода в ИИ-дата-центрах, позволяя загружать 70-миллиардные LLM-модели за секунды и обслуживать тысячи параллельных агентов в сценариях agentic AI, а также включает контроллер Cascade IG5676 для CXL 3.1 Type-3.
Читать новость