Apple ha anunciado OpenELM, un conjunto de pequeños modelos de lenguaje de inteligencia artificial en código abierto diseñados para ejecutarse directamente en dispositivos como iPhones y Macs. Estos modelos son lo suficientemente pequeños como para funcionar localmente en el dispositivo, lo que elimina la dependencia de servidores en la nube para tareas de IA.
OpenELM (“Open-source Efficient Language Models”) utiliza una estrategia de escalado por capas para asignar eficientemente los parámetros dentro de cada capa del modelo, lo que resulta en una mayor precisión. La familia de modelos consta de ocho variantes con tamaños de parámetros que van desde 270 millones hasta 3.000 millones, todos entrenados con conjuntos de datos públicos.
Comparado con otros modelos similares de código abierto, como OLMo, OpenELM ha demostrado un rendimiento superior, a pesar de necesitar el doble de datos de entrenamiento. Estos modelos se han entrenado con CoreNet, una biblioteca de código abierto, junto con otros modelos que permiten una inferencia y ajuste eficientes en dispositivos Apple.
Apple ha adoptado un enfoque transparente al publicar no solo los pesos del modelo y el código de inferencia, sino también el marco completo para el entrenamiento y la evaluación del modelo lingüístico en conjuntos de datos públicos, así como herramientas para la inferencia y ajuste en dispositivos Apple.

El lanzamiento de OpenELM llega antes de la Conferencia Mundial de Desarrolladores de Apple (WWDC), sugiriendo un interés de Apple en integrar la inteligencia artificial en su próxima versión del sistema operativo móvil, iOS 18.
Este movimiento también refleja una tendencia general en la industria tecnológica, donde empresas como Microsoft y Apple están desarrollando modelos de lenguaje más pequeños y eficientes. El hecho de que Apple haya optado por hacer OpenELM de código abierto marca un cambio significativo en su enfoque, ya que anteriormente tendía a mantener sus métodos de desarrollo más restrictivos y reservados.