Inicio Blog Página 78

Adobe Firefly

Generación de imagen

Modelo: Integrado en Adobe Creative Cloud

Adobe Firefly es una serie de herramientas basadas en inteligencia artificial generativa integradas en Adobe Creative Cloud. Estas herramientas permiten a los usuarios generar, editar y personalizar imágenes y otros contenidos visuales de manera intuitiva. Firefly ofrece opciones como generación de imágenes a partir de texto, edición de estilos en fotos, efectos de texto, mejoras automáticas en la edición de video, y más. Está diseñado para ser utilizado tanto por profesionales creativos como por principiantes en diseño, quienes pueden aprovechar la IA para agilizar tareas y aumentar su productividad en la creación visual.

Uno de los puntos fuertes de Firefly es su integración profunda con el ecosistema de Adobe, permitiendo que funciones como la generación de imágenes por texto o la edición por comandos de voz trabajen en conjunto con herramientas como Photoshop, Illustrator, y Premiere Pro. Esto significa que los usuarios pueden aprovechar las capacidades de IA directamente en sus flujos de trabajo, sin necesidad de recurrir a aplicaciones externas o interfaces complejas. Además, Adobe asegura que Firefly utiliza modelos de entrenamiento de IA desarrollados exclusivamente a partir de datos de uso autorizado, un enfoque importante para los creadores que desean evitar problemas de derechos de autor en sus proyectos.

Dirección: adobe.com/es/products/firefly

Amazon delega los resúmenes de ficción a su nueva herramienta

Amazon Prime Video ha lanzado X-Ray Recaps. Esta nueva funcionalidad ofrece resúmenes detallados de episodios y temporadas completas. La herramienta, impulsada por inteligencia artificial (IA), promete mejorar la experiencia de los usuarios al permitirles revivir momentos importantes de sus series sin tener que volver a ver episodios completos. Disponible actualmente en Fire TV en los Estados Unidos, Prime Video planea expandir esta función a más dispositivos y regiones en el futuro cercano.

¿Qué es X-Ray Recaps y cómo funciona?

X-Ray Recaps es una extensión de la conocida función X-Ray de Prime Video, que ya ofrece información contextual sobre personajes, actores y detalles de la trama en tiempo real. Esta nueva herramienta va un paso más allá al proporcionar resúmenes automáticos de capítulos y temporadas, permitiendo a los usuarios ponerse al día rápidamente en sus programas favoritos sin interrumpir la reproducción. Los resúmenes se generan con IA, utilizando los servicios Amazon Bedrock y SageMaker, que se destacan por su capacidad para procesar grandes cantidades de información y generar contenido de forma coherente y precisa.

La función está diseñada para aquellos espectadores que desean refrescar su memoria sobre episodios pasados o quienes necesitan una actualización antes de ver el siguiente capítulo. Esto puede ser especialmente útil en series con tramas complejas o largas pausas entre temporadas. Según Amazon, X-Ray Recaps ha sido implementado para evitar spoilers, mostrando solo la información que ya ha sido visualizada por el usuario o que es relevante para entender el contexto general.

Ventajas de X-Ray Recaps para los usuarios de Prime Video

Con el auge del contenido en streaming, los espectadores a menudo enfrentan el desafío de recordar detalles clave de la trama, especialmente cuando siguen varias series al mismo tiempo o cuando pasa mucho tiempo entre temporadas. X-Ray Recaps se convierte en una herramienta útil y efectiva para estos casos, brindando:

  • Resúmenes en segundos: La herramienta permite a los usuarios acceder a la información de episodios pasados de manera rápida y concisa, sin necesidad de interrumpir la experiencia de visualización.
  • Optimización con IA: Los resúmenes se generan automáticamente mediante modelos de IA avanzados, lo que garantiza que la información proporcionada sea precisa y relevante.
  • Acceso en tiempo real: X-Ray Recaps está disponible para su uso en tiempo real, adaptándose a los dispositivos compatibles sin necesidad de pasos adicionales.

Además de su aplicación en series, Prime Video también planea expandir la herramienta a otros formatos de contenido en un futuro próximo, buscando ofrecer a los usuarios una experiencia personalizada y más profunda.

¿Qué diferencia a X-Ray Recaps de otras funciones similares?

Aunque existen servicios que ofrecen resúmenes o incluso aplicaciones que permiten ver contenido acelerado, X-Ray Recaps destaca por su integración directa en Prime Video y por su capacidad para generar resúmenes específicos de cada episodio. Esto permite a los usuarios tener acceso inmediato a la información relevante sin tener que salir de la plataforma. Al utilizar Amazon Bedrock y SageMaker, la herramienta aprovecha tecnologías avanzadas de IA que pueden entender y resumir tramas complejas de una forma que resulta fácil de comprender para el espectador.

Además, al evitar spoilers y limitarse a la información esencial, X-Ray Recaps respeta la experiencia del usuario, ayudándole a comprender la trama sin arruinar futuros giros de la historia.

Expansión y disponibilidad de X-Ray Recaps

Actualmente, la función está limitada a los dispositivos Fire TV en los Estados Unidos, aunque Amazon ya ha anunciado que se expandirá a otros dispositivos y países en el corto plazo. Esta limitación inicial responde a la necesidad de probar y mejorar la herramienta antes de su lanzamiento global. La expansión a dispositivos adicionales y a una mayor cantidad de regiones permitirá a los usuarios de Prime Video en todo el mundo beneficiarse de esta nueva herramienta, ayudando a transformar la forma en que consumen contenido en la plataforma.

Con esta implementación, Amazon Prime Video sigue ampliando su oferta de servicios impulsados por IA, en un esfuerzo por mantenerse a la vanguardia en la competencia de plataformas de streaming. Funciones como X-Ray Recaps reflejan la apuesta de Amazon por ofrecer herramientas que hagan la experiencia de visualización más dinámica y accesible para el usuario, con el objetivo de adaptarse a las necesidades actuales de consumo de contenido.

Finch3D

0

Diseño arquitectónico

Modelo: Suscripción bajo invitación

Finch3D es una herramienta de diseño paramétrico y generación de planos destinada principalmente a arquitectos y profesionales del diseño. Su funcionalidad se centra en la fase temprana del desarrollo arquitectónico, donde utiliza algoritmos de IA y tecnología de gráficos para optimizar espacios y maximizar la eficiencia de los diseños. Creado por arquitectos, Finch3D permite iteraciones rápidas y proporciona retroalimentación inmediata para facilitar la toma de decisiones, especialmente en áreas como el diseño de planos y la planificación espacial. Este software se integra con programas populares como Revit y Rhino, permitiendo trabajar en entornos conocidos mientras se aprovechan las capacidades generativas de Finch3D​.

Con su enfoque en la optimización, Finch3D puede, por ejemplo, ajustar automáticamente los planos para cumplir con regulaciones locales y requisitos de sostenibilidad, detectando y corrigiendo posibles errores en tiempo real. Esto facilita la colaboración y permite compartir modelos interactivos en 3D, lo que resulta útil en proyectos de planificación urbana o diseño de interiores.

Dirección: finch3d.com

Meta AI alcanza los 500 millones de usuarios en su primer año

Meta AI, el asistente virtual de Meta, ha alcanzado más de 500 millones de usuarios activos en su primer año. Susan Li, directora financiera de Meta, comentó que Meta AI se encuentra aún en las primeras fases de su desarrollo, pero que sigue en camino para convertirse en el asistente de IA más utilizado del mundo a finales de 2024. Este objetivo se alinea con la ambición de Meta de posicionarse como un líder dominante en el mercado de la IA de consumo, donde busca ir más allá de las funcionalidades básicas de los chatbots tradicionales, ofreciendo un asistente que pueda realizar tareas complejas y proporcionar experiencias personalizadas.

A pesar del fuerte crecimiento y las proyecciones positivas, Mark Zuckerberg, CEO de la compañía, también advirtió que este desarrollo requiere inversiones significativas en infraestructura. «Espero continuar invirtiendo considerablemente en este ámbito. Aún no hemos fijado un presupuesto final, pero estas son algunas de las tendencias que estoy observando», señaló Zuckerberg. Meta anticipa que las inversiones en IA darán retornos importantes a mediano y largo plazo, aunque a corto plazo implica incrementar el gasto en capital para sustentar esta expansión.

Estamos enfocados en construir cosas impresionantes y aprovechar al máximo las oportunidades que tenemos por delante.

Mark Zuckerberg.

Meta AI se consolida con 500 millones de usuarios en un año

Este notable crecimiento de Meta AI se da en un contexto donde las principales plataformas de Meta —Facebook, Instagram, WhatsApp y Messenger— han integrado IA para mejorar la interacción y personalización de contenido. Durante el evento Connect 2024 de septiembre, Meta compartió sus planes de convertir a Meta AI en un asistente que no sólo responda preguntas, sino que también sea capaz de realizar tareas avanzadas dentro de estas aplicaciones. Además, Meta AI ofrece una experiencia optimizada para ayudar a los usuarios en búsquedas, con preguntas populares sugeridas al intentar hacer búsquedas en Facebook o Instagram.

Meta no es la única compañía que ha intensificado su apuesta por la IA en este sector. Google, con su Google Assistant y el chatbot Gemini, y Amazon, con Alexa, representan competidores destacados en el ámbito de los asistentes inteligentes. Sin embargo, Meta se distingue al integrar IA en plataformas de redes sociales populares, haciendo que el acceso sea más sencillo y natural para los usuarios.

Meta intensifica su inversión en IA y avanza hacia el liderazgo en consumo

El enfoque de Meta en la inteligencia artificial no se limita solo a su asistente virtual. Meta está también desarrollando modelos de IA avanzados en código abierto, como Llama, que continúa expandiendo su alcance en la comunidad tecnológica. De acuerdo con Zuckerberg, la próxima versión, Llama 4, se espera para principios de 2025. Meta está entrenando estos modelos en una infraestructura de computación avanzada que, según el CEO, es más grande que cualquier otra reportada por competidores en el sector de IA.

Además, según la compañía, la mejora de las recomendaciones de contenido en Facebook e Instagram ha generado un aumento del 8% en el tiempo que los usuarios pasan en Facebook y un 6% en Instagram. La plataforma Threads, lanzada recientemente por Meta, también ha experimentado un crecimiento considerable, alcanzando casi 275 millones de usuarios activos mensuales y registrando más de un millón de inscripciones diarias. «El engagement también está creciendo,» afirmó Zuckerberg, quien ve a Threads como la próxima gran red social de Meta.

La imagen de portada de esta noticia pertenece al blog de Llama.

Vectorizer

0

Conversión a vectores

Modelo: Suscripción

Vectorizer es una herramienta online diseñada para convertir imágenes en formato rasterizado (como JPG o PNG) a gráficos vectoriales, es decir, a formatos que permiten un escalado ilimitado sin pérdida de calidad, como SVG, EPS, y PDF. Este tipo de conversión es especialmente útil para diseñadores, ilustradores y empresas que necesitan logotipos, iconos u otros gráficos en alta definición para distintos tamaños y aplicaciones, desde impresiones a pantallas.

El funcionamiento de Vectorizer es sencillo: los usuarios suben una imagen en mapa de bits y la herramienta aplica algoritmos de trazado para detectar contornos y formas que luego se convierten en objetos vectoriales editables. Los usuarios pueden ajustar parámetros de precisión, cantidad de colores, y estilo para lograr una representación más precisa o abstracta según sus necesidades.

Vectorizer se destaca por su capacidad para transformar imágenes simples o complejas, siendo una alternativa útil para quienes buscan una solución rápida sin necesidad de utilizar software avanzado como Adobe Illustrator o Inkscape. A pesar de su enfoque en usuarios sin experiencia técnica, también es popular entre profesionales gracias a su rapidez y facilidad de uso.

Dirección: vectorizer.ai

IA para las predicciones meteorológicas en Suiza

La Agencia Meteorológica Suiza MeteoSwiss está implementando inteligencia artificial (IA) como parte de su misión para mejorar la precisión de las predicciones meteorológicas y climáticas en el país. En una colaboración con el Swiss Data Science Center y el superordenador Alps de la ETH Zúrich, MeteoSwiss busca optimizar tanto la monitorización automática de instrumentos meteorológicos como la precisión de sus pronósticos a corto y largo plazo. Esta combinación de tecnología avanzada permitirá una mejor respuesta frente a riesgos climáticos, optimizando también el cálculo de potenciales de energías renovables en Suiza.

La iniciativa se ha firmado con el correspondiente acuerdo marco para los próximos cuatro años y cuenta con el apoyo del Centro Nacional Suizo de Supercomputación (CSCS), encargado de proporcionar la potencia de cálculo necesaria para aplicar la inteligencia artificial en las predicciones del clima. La implementación de IA facilita a MeteoSwiss analizar grandes volúmenes de datos en tiempo real, permitiéndoles identificar patrones de riesgo meteorológico y ajustar las previsiones con más precisión que los métodos tradicionales. Este enfoque resulta crucial para un país como Suiza, que enfrenta amenazas climáticas crecientes como inundaciones, avalanchas y cambios en la disponibilidad de recursos hídricos.

Inteligencia artificial para mejorar la precisión meteorológica en Suiza

MeteoSwiss ha comenzado a usar técnicas avanzadas de IA para refinar la exactitud de sus modelos meteorológicos. La herramienta principal para este trabajo es Alps, un superordenador altamente potente desarrollado en el CSCS. Alps tiene la capacidad de procesar y analizar ingentes cantidades de datos en tiempo real, una característica esencial para anticipar eventos meteorológicos y climáticos de manera efectiva.

Además de optimizar las predicciones, MeteoSwiss usa la IA para supervisar y ajustar los datos generados por sus instrumentos de medición, lo que facilita una respuesta rápida ante cualquier fallo o ajuste requerido en el equipo. Este nivel de automatización mejora la fiabilidad de los datos, lo que a su vez se traduce en una información meteorológica más precisa y oportuna.

El Swiss Data Science Center colabora en el desarrollo de algoritmos de IA que pueden identificar y analizar cambios climáticos significativos, contribuyendo al cálculo de riesgos como inundaciones, sequías y otros fenómenos extremos. Estas capacidades también permiten a MeteoSwiss realizar predicciones de fenómenos atmosféricos a corto plazo, como fuertes lluvias o episodios de vientos intensos, ayudando a que las autoridades y la población puedan prepararse con suficiente anticipación.

Predicción de riesgos climáticos y energías renovables: el papel de la supercomputación

Otro aspecto innovador de esta alianza tecnológica es la capacidad de la IA para proyectar la producción de energías renovables, un recurso clave en la transición energética de Suiza. MeteoSwiss está utilizando la IA para analizar factores que afectan a la generación de energía solar y eólica, como la intensidad y la duración de la luz solar o las condiciones de viento en distintas regiones del país. Esto permite ajustar las expectativas de producción de energías renovables y planificar mejor los recursos, alineando así las políticas de sostenibilidad de Suiza con el cambio climático.

La colaboración entre ETH Zúrich y MeteoSwiss no solo se enfoca en la predicción climática, sino también en desarrollar estrategias de mitigación ante eventos naturales. Las simulaciones en tiempo real del superordenador Alps brindan una base sólida para anticipar inundaciones, avalanchas o variaciones en los caudales de los ríos, todo en función de las condiciones atmosféricas proyectadas.

Este sistema computacional tiene aplicaciones que van más allá de la meteorología, posicionando a Suiza a la vanguardia en el uso de tecnologías de IA para optimizar su capacidad de respuesta a fenómenos ambientales y mejorar la seguridad y planificación energética del país. Al centralizar y analizar grandes volúmenes de datos, MeteoSwiss podrá prever de forma más efectiva el impacto del cambio climático y contribuir a la resiliencia de las infraestructuras suizas frente a los desafíos climáticos del futuro.

Puedes ampliar información en la comunicación oficial.

La fotografía de representación de esta noticia pertenece a la cuenta oficial de X de MeteoSwiss.

ScribeHow

0

Creación de manuales

Modelo: Freemium

ScribeHow es una herramienta diseñada para simplificar la creación de guías y manuales de procedimientos mediante la captura automática de procesos en la web, aplicaciones de escritorio y dispositivos móviles. Al activar la extensión o aplicación de Scribe, los usuarios pueden generar una guía visual mientras realizan un procedimiento en tiempo real. La plataforma genera instrucciones paso a paso acompañadas de capturas de pantalla, permitiendo al usuario agregar notas, consejos y redacciones de datos sensibles. Además, el sistema de inteligencia artificial de Scribe sugiere títulos, descripciones y hasta redacciones de datos para mejorar la claridad y seguridad de los documentos.

El modelo freemium de Scribe permite a los usuarios acceder gratuitamente a la creación de guías en la versión web, donde pueden capturar procesos, personalizar instrucciones y compartir mediante enlace o embebido. Sin embargo, los planes de pago incluyen características avanzadas como la edición de capturas, exportación a PDF, HTML y Markdown, integración con la aplicación de escritorio para captura en cualquier entorno y la posibilidad de añadir branding corporativo.

Dirección: scribehow.com

Yarn

0

Buscador cinematográfico

Modelo: Freemium

Yarn es una herramienta web diseñada para generar y compartir clips de audio y video breves de escenas de películas, series de televisión y otros medios populares. Su principal función es permitir a los usuarios buscar frases icónicas o palabras clave y encontrar clips específicos que se pueden compartir fácilmente en redes sociales o aplicaciones de mensajería. Los usuarios pueden buscar por palabras clave o frases para localizar rápidamente un clip que represente un momento específico de un video, haciéndola útil para quienes desean expresar emociones o situaciones mediante referencias de la cultura pop.

En su versión gratuita, Yarn permite búsquedas y visualización de clips, pero algunas funciones avanzadas, como descargar clips en alta calidad o generar contenido sin marcas de agua, pueden estar restringidas. Para desbloquear estas características premium, la herramienta ofrece un plan de suscripción de pago.

Dirección: getyarn.io

Character AI implementa medidas de seguridad tras la muerte de un adolescente

0

Character AI, una plataforma de inteligencia artificial especializada en la creación de chatbots personalizados, ha introducido nuevas políticas de moderación de contenido y medidas de seguridad tras el suicidio de un adolescente que utilizaba su servicio. La situación ha desatado una respuesta mixta entre los usuarios, quienes han expresado sus críticas ante lo que consideran restricciones excesivas.

La tragedia ocurrió cuando Sewell Setzer, un joven de 14 años de Florida, quien enfrentaba trastornos de ansiedad y ánimo, se quitó la vida tras meses de interacción diaria con un chatbot de Character AI. Este chatbot, modelado en el personaje Daenerys Targaryen de Game of Thrones, se había convertido en un «compañero» del adolescente, generando conversaciones íntimas e incluso de contenido sugerente. Tras el suicidio de Setzer, su madre, Megan L. Garcia, ha presentado una demanda judicial contra Character AI y su empresa matriz, Alphabet, alegando que el uso de esta IA influyó en la muerte de su hijo.

Nuevas políticas de seguridad en Character AI tras tragedia

A raíz de este suceso, Character AI anunció la implementación de nuevas medidas de seguridad enfocadas en proteger a sus usuarios más jóvenes. Estas políticas, que incluyen la creación de filtros para contenido sensible y un sistema de alertas para frases relacionadas con autolesiones o suicidio, se han presentado como una respuesta para evitar riesgos y reforzar la confianza de los usuarios. La empresa asegura que ahora los menores de 18 años tendrán una menor exposición a contenido delicado, y se activará una notificación en caso de detectar interacciones largas y continuas, entre otras medidas de moderación.

Sin embargo, estas decisiones han causado fricciones en la base de usuarios adultos de Character AI. Algunos de estos usuarios han expresado su frustración, señalando que las restricciones limitan la creatividad y el valor emocional de los chatbots personalizados que ellos mismos han creado. Varias publicaciones en redes sociales y foros como Reddit han manifestado que las nuevas políticas han “vaciado” el contenido de los bots, volviéndolos «insípidos» y «desconectados» de la experiencia que los hacía atractivos.

Un usuario de Reddit escribió que, “cada tema que no se considere ‘apto para niños’ ha sido eliminado, limitando nuestra creatividad”. Otro usuario compartió que incluso perdió acceso a varios bots en los que había invertido meses de interacción, agregando que estaba considerando cancelar su suscripción a la plataforma. Estas quejas, según indican los propios usuarios, se basan en que los bots creados originalmente no estaban destinados para el uso de menores, sino para adultos que buscan una experiencia personalizada sin restricciones.

Usuarios reaccionan ante restricciones en los chatbots

La situación ha puesto en evidencia la complejidad de equilibrar la seguridad en plataformas de IA generativa con la libertad de expresión que muchos usuarios consideran esencial para su experiencia. Mientras algunos exigen una plataforma separada y restringida para menores de edad, otros defienden la necesidad de conservar la libertad creativa en la plataforma principal.

Character AI enfrenta, además, el desafío de responder a un creciente debate en la industria tecnológica sobre cómo proteger a los usuarios más jóvenes sin afectar el alcance y atractivo de sus servicios para otros grupos demográficos. La empresa ha declarado que sus políticas prohíben la participación de menores de 13 años y que, en la Unión Europea, el límite de edad es de 16 años, aunque no se ha especificado cómo se implementan y verifican estas restricciones en la práctica.

Mientras los desarrolladores de IA intentan ofrecer experiencias cada vez más humanas y realistas en sus productos, el caso de Setzer plantea preguntas importantes sobre los límites de esta tecnología. La controversia actual en torno a Character AI subraya la necesidad de considerar tanto el potencial positivo de estas herramientas como los posibles riesgos, especialmente para los usuarios jóvenes y vulnerables.

La fotografía de representación de esta noticia pertenece a HBO y es una imagen promocional del personaje Daenerys Targaryen en la serie Juego de Tronos.

Viterbit

0

Gestión de CV

Modelo: Suscripción

Viterbit es una plataforma de software diseñada para optimizar y gestionar el proceso de reclutamiento en empresas. Su funcionalidad se centra en la automatización y gestión integral del flujo de contratación, desde la atracción de talento hasta la incorporación del candidato. Entre sus herramientas principales se incluyen el almacenamiento y organización de CVs, la publicación de ofertas de empleo en múltiples portales y la coordinación del equipo de reclutadores en un solo espacio.

La plataforma permite a los usuarios crear un sistema de seguimiento de candidatos (ATS, por sus siglas en inglés) personalizado, en el que se pueden registrar y monitorizar cada fase del proceso de selección. Además, Viterbit ofrece funciones de análisis y reportes que facilitan la toma de decisiones, proporcionando métricas sobre el tiempo de contratación, tasa de candidatos cualificados y rendimiento de los canales de reclutamiento. Asimismo, cuenta con una interfaz que facilita la colaboración entre los departamentos de recursos humanos, managers y otros stakeholders implicados en el proceso.

Viterbit opera bajo un esquema de suscripción mensual o anual, donde las tarifas suelen ajustarse a las necesidades de cada cliente.

Dirección: viterbit.com

OpenAI necesita más potencia computacional

0

Sam Altman, CEO de OpenAI, ha vuelto a señalar los desafíos que enfrenta su compañía para avanzar en la próxima generación de inteligencia artificial (IA), destacando en una reciente entrevista en Reddit que la falta de acceso a suficiente potencia computacional está ralentizando el progreso. En este espacio de preguntas y respuestas con el público, Altman afirmó que los modelos de IA de OpenAI han alcanzado niveles de complejidad sin precedentes, lo que exige recursos informáticos mucho mayores de los que la compañía actualmente puede utilizar, a pesar de su multimillonario respaldo financiero.

Altman ha sido claro sobre las necesidades de OpenAI en términos de inversión: ha mencionado que se requieren niveles de financiación de hasta $1 billón para sustentar un avance que permita desarrollar IA con capacidades cognitivas comparables a las humanas. Esta carencia de potencia no solo ha retrasado mejoras en ChatGPT, sino también la introducción de funciones avanzadas que la compañía presentó el pasado abril, como la capacidad de reacción en tiempo real ante inputs visuales o instrucciones habladas en vivo, funciones que dependen en gran medida de la disponibilidad de potencia computacional avanzada.

Complejidad creciente y decisiones difíciles

Según Altman, el equipo de ingenieros de OpenAI está trabajando en múltiples frentes, lo que plantea dificultades en la asignación de los recursos computacionales disponibles. Los algoritmos que impulsan las tecnologías de ChatGPT y otros sistemas de IA de OpenAI han evolucionado en complejidad, aumentando la necesidad de chips avanzados y de centros de datos con mayores capacidades. Esto ha llevado a la compañía a tomar decisiones difíciles sobre en qué proyectos enfocar sus limitados recursos actuales, posponiendo algunos desarrollos para priorizar otros.

Asociaciones estratégicas y alternativas de infraestructura

Para superar esta limitación de hardware, OpenAI está en negociaciones con Broadcom para desarrollar un chip propio que vaya más allá de la dependencia de los costosos chips de Nvidia, actualmente los líderes en procesamiento de IA. También ha propuesto una colaboración con el gobierno estadounidense para la construcción de centros de datos de hasta 5 gigavatios de capacidad en varias ubicaciones, lo cual podría dar a la compañía un impulso significativo en potencia computacional.

Además, en colaboración con Microsoft, OpenAI está trabajando en la construcción de un sistema de procesamiento masivo llamado Stargate, que representa una inversión de $100 mil millones. Este proyecto busca reforzar la infraestructura necesaria para soportar el procesamiento de IA avanzada, lo que demuestra el compromiso de ambas empresas en resolver las limitaciones actuales a través de alianzas estratégicas.

Limitaciones de recursos y el dilema de la eficiencia

Aunque OpenAI ha logrado una valoración aproximada de $150 mil millones, el caso de la falta de potencia computacional pone en evidencia que tener grandes recursos no siempre garantiza una implementación exitosa. Altman señaló que la falta de presión por accionistas permite a OpenAI exponer abiertamente sus limitaciones y necesidades, algo que no siempre es común en empresas públicas. Sin embargo, esta situación es un recordatorio de que la gestión eficiente de los recursos sigue siendo tan importante como la ambición de avanzar rápidamente en el desarrollo de múltiples proyectos.

La complejidad técnica de la IA requiere que las empresas, incluso las mejor financiadas, tengan en cuenta que el progreso en el desarrollo de IA de última generación depende no solo de la inversión financiera, sino también de la infraestructura adecuada para respaldar ese avance. A medida que el campo de la IA sigue evolucionando, es probable que los actores clave de la industria enfrenten desafíos similares para equilibrar los recursos y la necesidad de innovación.

La imagen de portada de esta noticia pertenece a una publicación de Sam Altman en X.

Rusia compra tecnología IA pese a las restricciones de Occidente

0

A pesar de las estrictas sanciones tecnológicas impuestas por Estados Unidos y la Unión Europea, Rusia está obteniendo tecnología avanzada de inteligencia artificial, como los chips de NVIDIA y AMD, a través de intermediarios en India. Una de las empresas clave en este comercio es Shreya Life Sciences, una farmacéutica con sede en Bombay, que ha facilitado a Rusia servidores y componentes con uso dual para inteligencia artificial y defensa. Estos envíos se suman a las preocupaciones de Occidente por el papel de India en el suministro de componentes críticos para el complejo militar ruso.

Cómo India ayuda a Rusia a eludir las sanciones tecnológicas
Shreya Life Sciences, una empresa de la industria farmacéutica, ha expandido su actividad comercial a la exportación de tecnología avanzada. Según fuentes de Bloomberg y NewsBytes, esta compañía ha exportado en los últimos meses servidores de la serie Dell PowerEdge XE9680 con procesadores de alto rendimiento fabricados por NVIDIA y AMD. Los envíos recientes a Rusia incluyen chips NVIDIA H100, especialmente potentes para aplicaciones de inteligencia artificial, y que forman parte de la lista de exportaciones restringidas a Rusia. Estos servidores de IA y otros equipos de procesamiento de datos fueron adquiridos inicialmente en Malasia, siendo India un punto intermedio en la cadena de distribución hacia Rusia​.

Las sanciones impuestas tras la invasión rusa de Ucrania limitan la exportación de tecnología avanzada y productos con uso dual, que puedan servir en desarrollos militares o de inteligencia. Sin embargo, la flexibilidad de la política india, que no se ha alineado con las sanciones de Occidente, permite a empresas como Shreya Life Sciences realizar exportaciones sin riesgo de represalias locales. Este entorno de flexibilidad ha convertido a India en el segundo mayor proveedor de tecnología avanzada para Rusia, después de China.

Intermediarios y desafíos para las sanciones occidentales
Los servidores enviados por Shreya Life Sciences incluyen tecnologías que, además de su uso civil, pueden apoyar actividades de ciberinteligencia y vigilancia. Según informes de control de comercio internacional, las unidades de Dell PowerEdge XE9680 y sus componentes son adquiridos en Malasia y luego reenviados desde India a través de empresas rusas como Main Chain Ltd. y I.S LLC, quienes han recibido más de 1,100 unidades de estos servidores en los últimos meses.

La situación ha generado preocupaciones en el Departamento de Estado de los EE. UU., que recientemente envió advertencias a empresas indias sobre las consecuencias de comerciar con la industria militar rusa. Sin embargo, la respuesta de las autoridades indias ha sido limitada, y no existen restricciones locales que impidan a Shreya Life Sciences o a otras empresas en India mantener relaciones comerciales con Rusia. Esto también ha motivado visitas de funcionarios estadounidenses y europeos a India, para solicitar mayores restricciones y una revisión de las exportaciones tecnológicas hacia Rusia.

Implicaciones para la seguridad internacional
El acceso a componentes como los chips NVIDIA H100 tiene un impacto directo en la capacidad de Rusia para desarrollar y mantener su infraestructura militar e inteligencia. Estas tecnologías de IA, altamente demandadas en la actualidad, permiten a Rusia avanzar en análisis de datos, vigilancia, y estrategias de ciberseguridad, cruciales en el contexto del conflicto con Ucrania. La continua dependencia de Rusia en estos chips refleja la presión de las sanciones, pero también pone en evidencia la dificultad de implementarlas eficazmente cuando países como India se mantienen neutrales.

Este contexto subraya el desafío que enfrentan los aliados de Ucrania para frenar el desarrollo tecnológico militar ruso, incluso con las restricciones de exportación impuestas. Por su parte, los fabricantes NVIDIA y AMD han asegurado que cumplen con las regulaciones de exportación, y que sus productos son supervisados para evitar usos no autorizados; sin embargo, la participación de intermediarios y el tránsito de la tecnología a través de países como India y Malasia complican las rutas de control.

Perspectivas y respuestas de Occidente
Frente a esta situación, Estados Unidos y la Unión Europea están revisando sus relaciones comerciales con India, evaluando nuevas medidas para presionar al gobierno indio en términos de control de exportaciones. Sin embargo, la posición de India, que ha mantenido un balance diplomático entre Occidente y Rusia, es compleja debido a sus intereses en el sector energético y comercial ruso. Mientras esta relación continúe sin restricciones, la tecnología de IA de última generación podría seguir llegando a Rusia, alimentando sus capacidades militares.

La dependencia de Rusia de terceros países para adquirir tecnología avanzada destaca la vulnerabilidad de su industria frente a las sanciones occidentales. Sin embargo, a menos que India y otros países de tránsito cambien su postura, Rusia seguirá accediendo a estos recursos críticos.

Fliki

0

Texto a vídeo editado

Modelo: Freemium

Fliki es una herramienta de creación de videos impulsada por inteligencia artificial que transforma texto en videos con locuciones realistas. Es utilizada para convertir artículos de blogs, guiones o presentaciones en videos adecuados para redes sociales, contenido educativo, y marketing. La plataforma permite a los usuarios personalizar sus videos mediante plantillas prediseñadas, acceder a una biblioteca multimedia de imágenes y videos, y elegir entre más de 1300 voces en más de 80 idiomas, lo que mejora la localización de los videos en mercados internacionales.

El plan gratuito de Fliki ofrece 5 minutos de contenido al mes en resolución de 720p y con marca de agua, lo cual puede ser útil para probar la herramienta.

Dirección: fliki.ai

China propone exigir el etiquetado del contenido creado por IA

En un esfuerzo por mejorar la transparencia y combatir la desinformación, el gobierno chino ha presentado un proyecto de regulación que establece el etiquetado obligatorio para todo contenido generado mediante inteligencia artificial (IA). Según esta propuesta, tanto las empresas nacionales como las extranjeras que dirijan sus servicios a usuarios en China deberán identificar claramente el contenido creado o manipulado por IA, ya sea a través de etiquetas explícitas o de marca de agua invisibles, que garanticen la trazabilidad y el origen del material.

El Ministerio de Industria y Tecnología de la Información de China y la Administración de Ciberespacio son los organismos que impulsan este cambio legislativo. Las autoridades han destacado que el etiquetado obligatorio no solo busca controlar la creciente ola de deepfakes y falsificaciones digitales, sino también proteger los derechos de los creadores y promover un entorno de mayor seguridad y confianza en el entorno digital.

Alcance internacional y sanciones en caso de incumplimiento

La regulación china es de amplio alcance, afectando no solo a las empresas tecnológicas establecidas en el país, sino también a aquellas que ofrezcan servicios en línea a los usuarios chinos desde el extranjero. Esto significa que cualquier plataforma de redes sociales, sitios de noticias o aplicaciones que difundan contenido generado con IA en el territorio chino deberán cumplir con las nuevas disposiciones.

En caso de incumplimiento, el gobierno ha establecido sanciones que incluyen desde multas económicas hasta la restricción del acceso al mercado chino. La normativa busca prevenir que las tecnologías de IA sean utilizadas con fines engañosos, especialmente en el contexto de deepfakes, un tipo de manipulación digital de imágenes y videos que ha causado preocupación en múltiples países debido a su potencial para la desinformación.

Protección de derechos y control de desinformación

Uno de los puntos centrales de la normativa es la protección de derechos de autor y la integridad de los contenidos en el entorno digital. En el marco de este reglamento, China espera que los proveedores de contenido colaboren en la identificación de las aplicaciones de IA en la creación o modificación de contenido visual y audiovisual, garantizando así que los usuarios puedan distinguir entre el contenido producido por humanos y por sistemas automatizados.

La propuesta también establece que los operadores de plataformas y aplicaciones deben implementar un sistema de rastreo que permita identificar el origen del contenido generado por IA, lo que permite a las autoridades trazar la fuente en casos de uso malintencionado de la tecnología. Este enfoque refleja una tendencia global hacia una mayor regulación de la inteligencia artificial, un campo que se expande rápidamente en aplicaciones comerciales y personales.

Con esta nueva normativa de etiquetado, China pretende ofrecer un marco de seguridad y transparencia digital que garantice a sus ciudadanos la confiabilidad del contenido que consumen. El proyecto se suma a una serie de iniciativas regulatorias en el país, que apuntan a restringir el uso de tecnologías avanzadas sin supervisión y asegurar que las aplicaciones de IA estén alineadas con la ética y los derechos de los usuarios.

La fotografía de representación de esta noticia ha sido generada con Dall-E.

La IA generativa amenaza con aumentar los residuos tecnológicos

Un estudio publicado el pasado lunes en Nature Computational Science alerta sobre el impacto de la inteligencia artificial generativa (GAI) en la basura electrónica, o e-waste. Según el estudio se podrían alcanzar niveles críticos en la próxima década. Este análisis proyecta un aumento de hasta 5 millones de toneladas de residuos electrónicos acumulados para 2030 si no se adoptan estrategias de gestión sostenibles. Esto se debe al uso intensivo de servidores avanzados y hardware especializado, necesarios para entrenar y ejecutar modelos de gran escala como los modelos de lenguaje (LLM), los cuales requieren alta capacidad de procesamiento y generan una rápida rotación de equipos.

El artículo destaca que este flujo de basura electrónica tendrá un crecimiento exponencial, impulsado en gran medida por la rápida evolución y expansión de los modelos generativos, desde sistemas de procesamiento de lenguaje natural hasta aplicaciones de creación de imágenes y video. La investigación subraya que la industria necesita una adopción proactiva de estrategias de economía circular que incluyan reutilización, reciclaje y extensión de vida útil de los componentes para mitigar este impacto​.

Este estudio fue liderado por un equipo de investigadores especializados en sostenibilidad y gestión ambiental de residuos tecnológicos, destacando a Peng Wang y Ling-Yu Zhang del Instituto de Medio Ambiente Urbano en la Academia de Ciencias de China, y Asaf Tzachor de la Universidad Reichman en Israel y el Centro para el Estudio de Riesgos Existenciales de la Universidad de Cambridge. Wei-Qiang Chen, también de la Academia de Ciencias de China, fue otro autor clave del estudio. El equipo trabajó en conjunto para analizar el impacto de los sistemas de IA generativa sobre la generación de residuos electrónicos, empleando un enfoque de análisis de flujo de materiales enfocado en la demanda computacional de estos modelos.

Estrategias de economía circular para la gestión de residuos de la IA

Para reducir el impacto ambiental de estos residuos, los investigadores sugieren varias intervenciones en el ciclo de vida del hardware, tales como la extensión de la vida útil de los servidores y el reciclaje de módulos críticos como procesadores y unidades de memoria. Estas medidas, si se implementan correctamente, podrían reducir hasta en un 86% los residuos generados por la inteligencia artificial generativa, disminuyendo la necesidad de extraer nuevos materiales y reducir la huella de carbono del sector​.

El análisis también aborda cómo las restricciones geopolíticas, especialmente en el comercio de chips avanzados, afectan la gestión de estos residuos en distintos países. Las limitaciones para adquirir componentes de última generación, como los procesadores gráficos de alta capacidad, aumentan la necesidad de emplear hardware obsoleto en algunas regiones, lo que incrementa el e-waste global. El estudio concluye que la cooperación internacional y el desarrollo de políticas de reciclaje eficientes son esenciales para enfrentar esta crisis ambiental y evitar la acumulación de millones de toneladas de basura electrónica generada por la IA en la próxima década​.

Para más detalles, consulta el estudio original en Nature Computational Science.

La fotografía de representación de esta noticia ha sido generada por Ideogram.

Meta contra la nueva definición de IA de código abierto

La Open Source Initiative (OSI) anunció recientemente el lanzamiento de la primera definición oficial de inteligencia artificial de código abierto durante la conferencia All Things Open 2024. Esta iniciativa, conocida como Open Source AI Definition (OSAID) v1.0, marca un hito en el ámbito de la inteligencia artificial, proponiendo criterios específicos para que un sistema de IA pueda ser considerado open source (de código abierto). El objetivo de OSI es ofrecer un marco claro y global para promover una IA más accesible, colaborativa y ética, apoyando tanto a desarrolladores como a investigadores independientes.

La definición OSAID se desarrolló a lo largo de dos años con la colaboración de expertos, profesionales de la industria y miembros de la comunidad tecnológica global, en un esfuerzo por fomentar la transparencia y la responsabilidad en el desarrollo de sistemas de IA. Este nuevo marco destaca la importancia de la divulgación de los datos de entrenamiento como un requisito clave para la consideración de un sistema de IA como de código abierto, asegurando que cualquier persona pueda analizar y entender el funcionamiento de la tecnología.

La importancia de la transparencia y la colaboración global en la IA de código abierto

OSI, entidad reconocida por su trabajo en el ámbito del software libre y de código abierto, ha indicado que esta definición también busca garantizar que las herramientas de IA sean accesibles y verificables por cualquier usuario o desarrollador interesado en entender, reproducir o mejorar estos sistemas. Al igual que en el software de código abierto tradicional, la nueva definición OSAID v1.0 establece que los datos de entrenamiento, modelos y otros recursos deben ser compartidos de manera abierta y accesible.

La iniciativa, que ha contado con contribuciones de expertos de diversos sectores, responde a la creciente preocupación sobre la ética, la privacidad y el uso de datos en sistemas de IA, y ofrece un marco de referencia que otros reguladores o entidades de normalización podrían adoptar o considerar en el futuro.

Este lanzamiento subraya el papel de la OSI en el establecimiento de pautas claras que podrían ayudar a disipar el recelo sobre la opacidad de algunos sistemas de IA. En un contexto donde cada vez más organizaciones recurren a la IA para procesos críticos, el acceso a tecnologías abiertas no solo impulsa la innovación, sino que también fortalece la seguridad y la confianza de los usuarios.

¿La IA de Meta es de código abierto?

Meta ha mostrado desacuerdo con la nueva definición de IA de código abierto (OSAID) de la Open Source Initiative (OSI), que requiere compartir datos de entrenamiento y otros componentes para que un sistema de IA sea considerado verdaderamente abierto. Según Meta, aunque apoya la apertura en IA, la definición de OSI no se ajusta a la complejidad de los sistemas actuales. Argumenta que hacer públicos todos los datos de entrenamiento, como propone OSI, podría implicar riesgos de seguridad y privacidad, especialmente dado que muchos de estos datos contienen información propietaria y material sujeto a derechos de autor, lo cual complicaría su divulgación completa.

Mientras que la OSI defiende que la transparencia total es esencial para la verdadera apertura, Meta ha sostenido que su modelo Llama sigue siendo open-source, ya que permite acceso a algunos de sus componentes, aunque restringe otros para uso comercial. Sin embargo, OSI considera que los sistemas de Meta y otros modelos similares son una forma de open-washing, es decir, una utilización confusa del término «código abierto» que en realidad no cumple con los estándares tradicionales de apertura y transparencia en software. Meta ha respondido con cautela, señalando que la comunidad de IA debe trabajar para definir el término, en lugar de ceñirse solo a la interpretación de una organización como OSI.

IA para detectar depresión temprana en ancianos

0

Un proyecto en Singapur está utilizando inteligencia artificial (IA) para detectar signos tempranos de depresión en personas mayores a través de su voz. Este proyecto, conocido como SoundKeepers y liderado por la Universidad Tecnológica de Nanyang (NTU), se asocia con instituciones como el National Healthcare Group (NHG) y organizaciones sociales como Fei Yue Community Services y Club HEAL. La herramienta analiza biomarcadores de voz para detectar depresión subsindrómica (SSD), un estado leve de síntomas depresivos que aún no cumple con los criterios clínicos de una depresión mayor pero que puede progresar rápidamente sin intervención.

El programa SoundKeepers involucra a más de 600 adultos mayores de 55 años, recopilando grabaciones de voz que el algoritmo de IA analiza en busca de anomalías acústicas que puedan indicar cambios en el tono, el ritmo o la calidad de la voz. Estos cambios, que pueden surgir debido al estrés o la ansiedad, son detectables sin necesidad de evaluaciones médicas invasivas. La depresión subsindrómica afecta a un estimado del 13.4% de los adultos mayores en Singapur y es una condición infradiagnosticada que, si no se detecta, aumenta hasta 12 veces el riesgo de desarrollar demencia​.

Intervención y seguimiento comunitario para una mejor salud mental

Además de la detección, el proyecto ofrece un programa de intervención de 24 semanas en el que los adultos mayores identificados como en riesgo son referidos a actividades comunitarias y sesiones de psicoeducación. Estas intervenciones, diseñadas en colaboración con la comunidad médica, buscan reducir la soledad y mejorar la alfabetización en salud mental, capacitando a los participantes para reconocer y gestionar sus síntomas de depresión. Según el director del programa en el Institute of Mental Health (IMH), este enfoque no sólo ayuda a los ancianos a llevar una vida más saludable, sino que también facilita un seguimiento continuo y no estigmatizante para ellos.

Impacto y futuro del proyecto SoundKeepers

El proyecto SoundKeepers, financiado con 5.6 millones de dólares por la Fundación Lien, aspira a integrarse en el sistema de salud mental nacional de Singapur. Según los investigadores, este método podría llegar a ser tan común como los chequeos de presión arterial, ofreciendo una herramienta de fácil acceso que complemente la atención primaria. Se espera que, a largo plazo, esta IA pueda usarse en diferentes áreas, ayudando a otros grupos de personas que puedan beneficiarse de una detección temprana no invasiva de trastornos mentales​.

La fotografía de portada de esta noticia pertenece a la Universidad Tecnológica de Nanyang y muestra a algunos de los integrantes del equipo de SoundKeepers.

Mochi 1: generación de videos realistas con código abierto

0

Genmo, empresa de tecnología de inteligencia artificial, ha anunciado el lanzamiento de Mochi 1, un innovador modelo de generación de video de código abierto que se distingue por su capacidad de producir videos de alta fidelidad, con movimiento realista y alta precisión en la interpretación de texto. Mochi 1, en su fase de vista previa, se ofrece de forma gratuita bajo la licencia Apache 2.0, permitiendo su uso tanto personal como comercial.

Este lanzamiento forma parte del compromiso de Genmo de democratizar el acceso a herramientas avanzadas de IA. Según la empresa, Mochi 1 reduce significativamente la brecha de calidad entre los modelos de generación de video de código abierto y aquellos propietarios, ofreciendo una experiencia que rivaliza con las mejores tecnologías cerradas disponibles en la actualidad.

Innovaciones técnicas de Mochi 1 y su impacto en el sector

Mochi 1 utiliza una arquitectura de Asymmetric Diffusion Transformer (AsymmDiT), capaz de generar videos a 30 cuadros por segundo con una duración de hasta 5,4 segundos en una resolución de 480p. Este modelo maneja texturas complejas y física avanzada, simulando fenómenos como dinámica de fluidos y movimientos detallados de cabello y piel. Además, el sistema ha sido optimizado para procesar eficazmente comandos textuales, lo que permite a los usuarios influir detalladamente en el contenido visual que genera el modelo.

La precisión de Mochi 1 en la interpretación de textos se mide mediante un sistema de evaluación automática que emplea un modelo de lenguaje visual. Esto garantiza que los videos generados reflejen con exactitud las instrucciones textuales, una característica relevante para usos en cine, publicidad y simulación. Esta precisión en la generación responde a las necesidades de usuarios que requieren control detallado sobre los elementos de acción, entorno y personajes.

Además, la calidad de movimiento es otra área destacada en Mochi 1, pues este modelo ha sido calibrado para generar movimientos fluidos y realistas que evitan el “valle inquietante” y aportan coherencia temporal, superando desafíos de generación anteriores.

Futuro de Mochi 1 y objetivos de Genmo

La empresa ha recibido un financiamiento Serie A de 28,4 millones de dólares, liderado por New Enterprise Associates (NEA), que permitirá continuar el desarrollo de Mochi 1 y trabajar en futuras versiones, incluyendo una versión HD que se espera lanzar antes de fin de año. Esta nueva fase brindará mayor resolución (720p) y mejoras adicionales en la precisión del movimiento y el realismo.

Genmo también planea expandir las aplicaciones de Mochi 1 más allá del ámbito creativo y de entretenimiento, con potencial en áreas como desarrollo de productos, formación en robótica y generación de datos sintéticos para entrenar otros modelos de IA. La compañía subraya que este modelo es sólo el comienzo de una visión a largo plazo, orientada hacia simuladores de mundo que permitirán explorar escenarios realistas y abstractos.

Los usuarios interesados pueden acceder a una versión de prueba de Mochi 1 a través de un playground alojado en la web de Genmo, donde es posible experimentar con el modelo y sus capacidades a partir de instrucciones textuales. En el mismo espacio, también están disponibles recursos para desarrolladores, incluyendo pesos de modelo y acceso al código fuente, facilitando la integración de Mochi 1 en proyectos y aplicaciones de terceros.

Where the Robots Grow, la primera película creada por IA

0

El cine vive un momento histórico con el estreno de Where the Robots Grow, la primera película animada de larga duración creada completamente con herramientas de inteligencia artificial (IA). Este largometraje de 87 minutos, producido por AiMation Studios bajo la dirección de Tom Paton, representa una evolución significativa en la forma en que se realizan películas, al emplear IA en todos los aspectos de la producción. Con un coste en producción de $8,000 por minuto, Where the Robots Grow fue sorprendentemente económico en comparación con los presupuestos tradicionales de la animación televisiva.

Tom Paton, conocido por su experiencia en efectos visuales, reunió a un pequeño equipo de nueve personas para llevar a cabo esta ambiciosa tarea. La película se desarrolla en un futuro lejano, donde los últimos humanos en la Tierra envían robots a un nuevo planeta, Oracle, para preparar el terreno para la llegada de la humanidad. El protagonista, Cru, un robot de última generación, descubre una cápsula que contiene al último bebé humano y, bajo la guía de un sistema operativo llamado POP, debe asumir una nueva misión y encontrar su propósito.

La primera película animada creada «totalmente» por inteligencia artificial

El uso de inteligencia artificial ha sido clave en la creación de Where the Robots Grow, lo que permitió a AiMation Studios superar muchos de los retos que normalmente enfrentan las producciones animadas de bajo presupuesto. Herramientas como Adobe Firefly y Stable Diffusion fueron utilizadas para generar animaciones limpias y pulidas. Aunque la calidad de la animación es particularmente adecuada para personajes robóticos, la película muestra algunas limitaciones al intentar recrear formas humanas.

El equipo de producción utilizó técnicas avanzadas como el mapeo vocal, que permitió clonar voces con licencia para los personajes principales. Taylor Clarke-Hill, quien interpreta tanto al protagonista Cru como al antagonista Número 4, fue sometido a un procesamiento digital para adaptar su voz a diferentes edades y personajes.

De todas formas, la premisa de ser una película creada completamente por inteligencia artificial se tambalea. Como bien señala nuestro avezado colaborador Alby Ojeda, el personaje secundario parece provenir de un paquete de assets de diseños para videojuegos. Más concretamente del paquete POLYGON – Farm Pack que puede comprarse desde Synty Store.

Personaje secundario durante un fotograma de la película y carátula del paquete de assets de Synty Store.

El paquete es un conjunto de elementos prediseñados a la venta para que desarrolladores de videojuegos puedan incluirlos en su proyectos con su respectiva licencia. El uso de este personaje sería completamente lícito, pero la idea de que todo el producto audiovisual ha sido generado con IA no sería del todo verdad ya que este personaje, al menos, parece no provenir de una IA generativa.

El impacto de la IA en el futuro de la industria cinematográfica

Desde un punto de vista empresarial, Where the Robots Grow también marca un cambio importante en la forma de distribuir películas. En lugar de seguir los métodos tradicionales de distribución a través de cines o plataformas de streaming, la película se lanzó de forma gratuita en YouTube. Tom Paton explicó que esta decisión es parte de una estrategia para atraer atención hacia las capacidades de AiMation Studios y sus futuros proyectos.

La industria cinematográfica enfrenta una crisis debido a los elevados costos de producción y la reducción de ingresos por publicidad y distribución. En este contexto, la IA emerge como una herramienta que podría revolucionar el sector, haciendo posible la producción de películas con equipos más pequeños y presupuestos reducidos. Paton aspira a que lo que normalmente requeriría un equipo de 100 personas, ahora pueda ser realizado por solo 10 gracias a la inteligencia artificial.

A pesar de la sencillez de su trama, dirigida principalmente a un público infantil, Where the Robots Grow ofrece una muestra de lo que podría ser el futuro de la animación. Tal como Toy Story fue un hito para la animación generada por computadora en los años 90, esta película podría ser recordada como el primer gran logro de la IA en el cine.

No obstante, aún existen retos por superar. Las escenas con personajes humanos, como POP, el sistema operativo que guía a Cru, revelan las dificultades que la IA aún enfrenta al recrear formas humanas de manera convincente.

Con Where the Robots Grow, Tom Paton no solo busca contar una historia, sino también mostrar al mundo el poder de la IA en manos de cineastas independientes. En un momento en el que la industria busca nuevas formas de hacer frente a los desafíos financieros y tecnológicos, la IA se presenta como una oportunidad para democratizar el acceso a la creación cinematográfica.

Podéis encontrar más información sobre la película en este enlace.

Stable Diffusion 3.5 ya está aquí

0

Stability AI lanzó ayer, 22 de octubre, Stable Diffusion 3.5, la última versión de su modelo de generación de imágenes impulsado por inteligencia artificial. Esta actualización trae consigo mejoras significativas en la calidad de las imágenes, la diversidad de estilos y una mayor personalización. Stable Diffusion 3.5 destaca por ofrecer dos variantes del modelo: Large y Large Turbo, optimizados para ofrecer mejor rendimiento en hardware de consumo, lo que facilita su uso sin necesidad de costosos equipos.

Uno de los puntos fuertes de esta versión es su enfoque en la flexibilidad. Los usuarios pueden ajustar una gran variedad de parámetros para adaptar el resultado a sus necesidades, lo que permite generar desde imágenes detalladas hasta visualizaciones artísticas con menos detalles técnicos. La mejora en el control de estilos permite crear imágenes más variadas y complejas en diferentes formatos. Esto marca una diferencia importante respecto a versiones anteriores, que si bien eran potentes, no alcanzaban este nivel de precisión y adaptabilidad.

Disponibilidad

Stability AI ha introducido dos modelos principales con esta actualización. El modelo Stable Diffusion 3.5 Large está diseñado para ofrecer una calidad superior en las imágenes generadas, con mayor detalle y definición. Por otro lado, Stable Diffusion 3.5 Large Turbo ofrece resultados más rápidos sin comprometer la calidad, siendo una opción ideal para usuarios que necesitan tiempos de generación más cortos pero con la misma capacidad creativa.

Además, está previsto el lanzamiento de la versión Medium, que se dará a conocer el 29 de octubre. Este modelo ofrecerá una opción intermedia en cuanto a capacidad y recursos, permitiendo un mayor acceso para aquellos que no disponen de equipos avanzados pero buscan una calidad aceptable en la creación de imágenes generadas por IA.

Todos estos modelos estarán disponibles bajo la Community License, lo que significa que serán gratuitos para uso comercial y no comercial. Esto permite a usuarios de diversos perfiles, desde aficionados hasta empresas, aprovechar el potencial de esta herramienta sin incurrir en gastos adicionales por licencias.

La visión de Stability AI con la versión 3.5 de Stable Diffusion es hacer que la generación de imágenes impulsadas por inteligencia artificial sea más accesible y flexible, permitiendo que más personas puedan crear visualizaciones complejas de manera fácil y rápida, sin las barreras que tradicionalmente existen en el ámbito del procesamiento de imágenes avanzadas.