Chips y hardware
Microsoft lanza el chip Maia 200 para escalar la inferencia de IA
Microsoft ha lanzado el Maia 200, un nuevo chip de inferencia de IA diseñado para ejecutar modelos a mayor velocidad y con más eficiencia, reduciendo a la vez la dependencia de las GPU de Nvidia.
Microsoft ha lanzado el Maia 200, un chip diseñado para escalar la inferencia de IA, el proceso informático de ejecutar un modelo de IA, a diferencia de su entrenamiento. Anunciado el lunes, el nuevo chip sucede al Maia 100, que fue lanzado en 2023. A medida que las empresas de IA maduran, los costos asociados con la inferencia se han convertido en una parte cada vez más importante de los costos operativos totales, lo que impulsa el interés de la industria en optimizar el proceso. Microsoft espera que el Maia 200 pueda ayudar con esta optimización, permitiendo a las empresas de IA operar con menos interrupciones y un menor consumo de energía. Según Microsoft, el Maia 200 está diseñado para ejecutar modelos de IA a mayor velocidad y con más eficiencia que su predecesor. El hardware está equipado con más de 100 mil millones de transistores. En cuanto a la velocidad de computación, ofrece más de 10 petaflops en precisión de 4 bits (FP4) y aproximadamente 5 petaflops de rendimiento de 8 bits (FP8), lo que representa un aumento sustancial de rendimiento respecto al modelo de 2023.
El lanzamiento posiciona a Microsoft para competir directamente con otros gigantes tecnológicos que diseñan sus propios chips para optimizar los costos de inferencia y disminuir la dependencia de las GPU de Nvidia. En su anuncio del lunes, Microsoft comparó el rendimiento del chip con hardware rival de Amazon y Google. Según Microsoft, el Maia 200 ofrece 3 veces el rendimiento FP4 de los chips Trainium de tercera generación de Amazon, lanzados en diciembre. Microsoft también afirma que el chip ofrece un rendimiento FP8 superior al de la séptima generación de la Tensor Processing Unit (TPU) de Google. Aunque las TPU de Google no se venden como chips individuales, sino que se ofrecen como potencia de cómputo a través de su nube, Amazon ofrece Trainium como su propio chip acelerador de IA. En ambos casos, estas alternativas pueden utilizarse para descargar cargas de trabajo de cómputo que de otro modo requerirían GPU de Nvidia, reduciendo así los costos generales de hardware.
El Maia 200 ya está activo dentro de las operaciones internas de Microsoft. La empresa declaró que el chip es utilizado actualmente por su equipo de Superinteligencia para impulsar sus modelos de IA, y también está dando soporte a Copilot, el producto de chatbot de Microsoft. Para demostrar la capacidad del chip, Microsoft señaló: “En términos prácticos, un nodo Maia 200 puede ejecutar sin esfuerzo los modelos más grandes de hoy, con mucho margen para modelos aún más grandes en el futuro”. Además, desde el lunes, Microsoft ha invitado a partes externas —incluidos desarrolladores, académicos y laboratorios de IA— a utilizar el kit de desarrollo de software del Maia 200 en sus cargas de trabajo.
Por qué importa
Microsoft está posicionando el Maia 200 para competir con chips diseñados internamente por otros gigantes tecnológicos como Google y Amazon, con el objetivo de disminuir la dependencia de las GPU de Nvidia y optimizar los costos de inferencia.