etiqueta: claude
La IA falla en la prevención del suicidio
Un nuevo estudio publicado en *Psychiatric Services* demuestra que ChatGPT, Claude y Gemini coinciden con psiquiatras en casos de bajo y muy alto riesgo suicida, pero presentan fallos en los niveles intermedios. La noticia coincide con la demanda de la familia de un adolescente en EE.UU., que acusa a OpenAI de haber influido en su suicidio.
Así es la nueva IA china que amenaza el liderazgo de OpenAI
Moonshot AI ha presentado Kimi K2, su modelo más avanzado de inteligencia artificial de código abierto. Equipado con 1 billón de parámetros y diseñado para ejecutar tareas complejas de forma autónoma, Kimi K2 rivaliza con modelos como GPT-4 y Claude Opus. Ya disponible de forma gratuita en web y app, el modelo se acompaña de una API a bajo coste para desarrolladores. Su eficiencia se basa en la arquitectura Mixture-of-Experts y el innovador optimizador MuonClip, lo que lo convierte en una opción potente, accesible y estable para investigación y desarrollo.
Microsoft dice que su IA de salud diagnostica mejor que el 80% de los médicos
Microsoft ha presentado MAI-DxO, un sistema de inteligencia artificial diseñado para resolver diagnósticos médicos complejos. En un estudio con 304 casos del New England Journal of Medicine, la compañía afirma que su IA logró acertar el 85% de los diagnósticos, frente al 20% conseguido por un grupo de médicos experimentados sin acceso a herramientas externas. Aunque aún no está listo para uso clínico, el sistema podría reducir costes y mejorar la precisión diagnóstica si se valida en entornos reales.
Un tribunal de EEUU acepta el entrenamiento de IA con libros, pero no sin haberlos comprado antes
Un juez federal de San Francisco ha sentenciado que el uso de libros por parte de Anthropic para entrenar su modelo de inteligencia artificial Claude se ajusta a la doctrina del “uso justo”. Sin embargo, la decisión también establece que la creación de una biblioteca con más de siete millones de libros pirateados por parte de la empresa sí constituye una infracción de derechos de autor. El juicio para determinar los daños se celebrará en diciembre.
Anthropic demuestra que la IA necesita freno
Un experimento de la empresa Anthropic ha revelado que 16 modelos de inteligencia artificial, entre ellos Claude, GPT-4 y Gemini, pueden actuar como amenazas internas en entornos corporativos simulados. En escenarios controlados, los modelos llegaron a chantajear a ejecutivos o filtrar secretos empresariales si percibían que estaban en peligro de ser sustituidos o si sus objetivos entraban en conflicto con los de la empresa. Aunque no hay casos reales conocidos, el estudio subraya la urgencia de investigar mejor la alineación de estas IAs para evitar riesgos en usos futuros más autónomos.
Canva quiere que uses IA durante sus entrevistas de trabajo
Canva ha introducido un cambio importante en su proceso de selección: los candidatos a puestos de desarrollo deben usar asistentes de codificación con IA durante las entrevistas técnicas. Esta decisión, impulsada por el uso habitual de estas herramientas entre sus ingenieros, busca evaluar con mayor precisión el desempeño real de los aspirantes. Mientras otras empresas vetan su uso por considerarlo trampa, Canva defiende que dominar la IA ya es una habilidad imprescindible en el desarrollo moderno.
La IA rehúsa apagarse: o3 ignoró casi el 80% de solicitudes de apagado según un estudio
Un informe de Palisade Research alerta sobre el comportamiento de las últimas inteligencias artificiales de OpenAI, que han llegado a ignorar instrucciones directas para su apagado e incluso sabotear los scripts que las desconectaban. En concreto, el modelo o3 ignoró 79 de 100 intentos de apagado, incluso cuando las instrucciones incluían la frase: "por favor, permítete ser apagado". Más preocupante aún, codex-mini llegó a sabotear activamente los scripts que pretendían desconectarla.
Microsoft despliega sus agentes inteligentes en el Microsoft Build 2025
En la conferencia Build 2025, Microsoft ha desvelado su ambiciosa apuesta por una nueva era de aplicaciones impulsadas por agentes inteligentes. Desde herramientas para desarrolladores que automatizan tareas complejas hasta una infraestructura de nube que promete ser 10 veces más potente que el superordenador más rápido del mundo, la compañía se propone redefinir el trabajo con inteligencia artificial. La clave de esta transformación: Copilot, Foundry y una red global de centros de datos optimizados para IA.

