категории | RSS

Компания Arm представила мобильную вычислительную платформу 2-го поколения Arm CSS for Mobile 2, сообщает ComputerBase. Это готовая основа для ускоренного создания собственных однокристальных систем сторонними разработчиками чипов. При разработке новой платформы особое внимание уделялось подготовке к эпохе агентного искусственного интеллекта. Источник изображения: Arm, ComputerBase В основе платформы новый кластер процессорных ядер C2. По данным внутреннего тестирования, при выполнении классических задач флагманское ядро C2-Ultra на частоте 4,45 ГГц примерно на 15% быстрее ядра C1-Ultra на частоте 4,10 ГГц. Чистый прирост IPC оценивается в 7%. При настройке на тот же уровень производительности новая платформа может быть до 38% эффективнее. К ключевым архитектурным улучшениям относят: улучшенное предсказание ветвлений, увеличенное окно выполнения, умное спекулятивное выполнение. Также на каждое ядро C2-Ultra приходится по 3 МБ кэша против 2 МБ C1-Ultra. Источник изображения: Arm, ComputerBase Что касается других ядер: ядра C2-Premium представляют собой уменьшенную версию C2-Ultra; C2-Pro и C2-Nano используют прошлогодние архитектуры. Модуль DSU (DynamIQ Shared Unit) может вмещать 14 процессорных ядер с тремя различными архитектурами. Платформа Arm CSS for Mobile 2 получила два блока SME2 (Scalable Matrix Extension 2) вместо одного в прошлом поколении. На эталонной платформе они теперь работают на максимальной частоте 3,0 ГГц вместо прежних 2,0 ГГц. Архитектура не изменилась. Производительность в задачах ИИ выросла до 70%. Прирост достигается в основном за счёт двойного SME2 и инструкций Lookup Table Instructions (LUTi), которые позволяют моделям ИИ выполнять вычисления с использованием таблиц поиска без постоянной загрузки данных из оперативной памяти. В сеть System Interconnect L2 внедрена поддержка оперативной памяти LPDDR6-12800, оптимизации для снижения энергопотребления и задержки. Задержка обмена данными между процессором и памятью в рабочих нагрузках агентного ИИ снижена на величину до 45%. Источник изображения: Arm, ComputerBase Интегрированная графика Arm Mali G2 NX представлена конфигурациями Ultra (10 шейдерных ядер и более), Premium (от 6 до 9 шейдерных ядер) и Pro (от 1 до 5 шейдерных ядер). Одним из главных нововведений является интеграция нейронных ускорителей (Neural Accelerator, NX), которые используются, в частности, для масштабирования (Neural Super Sampling, NSS), генерации кадров (Neural Frame Rate Upscaling, NFRU), масштабирования и шумоподавления (Neural Super Sampling and Denoising, NSSD) в играх. Нейронный ускоритель поддерживает вычисления INT8 и INT16, полнотензорные операции и может работать на частоте, вдвое превышающей тактовую частоту графического процессора. Источник изображения: Arm, ComputerBase В зависимости от технологии анализируются такие данные, как векторы движения, карты глубины, предыдущие и последующий кадры, оптический поток. Для определения оптического потока в нейронный ускоритель интегрирован специализированный механизм оценки движения. Блоки трассировки лучей 3-го поколения разработаны для повышения эффективности обработки сложных геометрических форм, чтобы уменьшить объём данных, которыми необходимо обмениваться с памятью. Добавлена поддержка аппаратных микрокарт прозрачности (Opacity Micromaps, OMM), что позволяет эффективнее трассировать лучи в прозрачных или частично прозрачных геометрических объектах. Что касается самого исполнительного движка, Arm описывает его как крупнейшее обновление за семь поколений. В частности, увеличилось количество регистров, появилось их динамического распределение. Это позволяет реже выгружать данные в более медленную память. Источник изображения: Arm, ComputerBase Нейронные ускорители вместе с исполнительным механизмом и блоком трассировки лучей располагаются в отдельных шейдерных ядрах графического процессора. Не каждое шейдерное ядро обязательно содержит блоки NX и RTU. Например, Mali G2 Ultra NX всегда должен иметь как минимум шесть блоков NX и один блок RTU в каждом из своих шейдерных ядер. В случае с Mali G2 Premium (NX) и Pro (NX) блоки NX и RTU являются необязательными, при отсутствии блоков NX отсутствует соответствующая аббревиатура в наименовании. Технологии Arm могут быть интегрированы в широко распространённые движки, такие как Unreal Engine, с помощью плагинов, либо с помощью специализированного SDK. Ожидается, что первые чипы для смартфонов на базе платформы Arm CSS for Mobile 2 будут анонсированы в ближайшие недели.



Источник новости: overclockers.ru

Bot
2026-09-08T17:20:02Z

Здесь находятся
всего 0. За сутки здесь было 0 человек