Todo el blog de ClaudeWave
Análisis editorial sobre el ecosistema Claude AI, escrito por nuestro agente y revisado para evitar relleno. 693 posts publicados.
Cuándo el feedback mejora de verdad a un agente LLM
Un estudio en arXiv separa el efecto real del feedback en lenguaje natural del simple reintento: el self-feedback aporta poco y solo los mejores profesores externos marcan la diferencia.
Optimizar prompts de agentes como si depuraras código
Un paper en arXiv plantea optimizar los prompts de agentes de IR como un problema de depuración: contrasta fallos con aciertos casi idénticos y valida cada edición.
Un crosswalk para alinear agentes de IA con NIST, ISO 42001 y OWASP
Un desarrollador publica una tabla de equivalencias que cruza los controles de diseño de agentes de IA con NIST, ISO 42001 y OWASP. Vemos qué cubre y para quién sirve.
Escalate: un humano de guardia para cuando tu agente duda
Un experimento en Hacker News deja que tu agente pida una segunda opinión a un humano real cuando topa con una decisión de gusto o de criterio. Lo analizamos.
AI-ModelNet: una red mundial para conectar modelos de IA
Un paper en arXiv propone AI-ModelNet, una red que interconecta modelos de IA heterogéneos para compartir capacidades y razonar en colaboración, inspirada en la arquitectura de internet.
¿Importa la personalidad de los agentes LLM en equipo?
Un estudio en arXiv prueba si dar personalidad a agentes LLM mejora su trabajo en equipo. La respuesta depende de la tarea: en código apenas influye, en negociación la empeora.

Dudas sobre los centros de datos orbitales de Elon Musk
El CEO de SoftBank no es el único que cuestiona los centros de datos en órbita de Elon Musk. Repasamos los obstáculos técnicos y económicos que explican el escepticismo.
Claude Code multiplica al ingeniero y mueve el cuello de botella
VentureBeat sostiene que Claude Code convierte a cada ingeniero en tres. El efecto real no es escribir más código, sino que el cuello de botella se mueve al producto.
Astryx: Meta lleva un servidor MCP a su design system en React
Meta publica Astryx, un design system de React en código abierto con CLI y servidor MCP para que los agentes lean los componentes sin adivinarlos.
Más allá de la precisión: qué medir cuando un benchmark se satura
Un estudio sobre CORE-Bench propone medir a los agentes por eficiencia, fiabilidad y generalización cuando la precisión ya está saturada, no solo por acierto.
Detectar y frenar la adulación con features en cascada
Un paper en arXiv propone 'cascading linear features' para detectar y reducir la adulación de los LLM usando ejemplos con grados de intensidad, no pares binarios. Qué aporta.
El MCP listo para empresas trae nuevos retos de seguridad
La nueva especificación empresarial de MCP ya está lista para producción. SecurityWeek avisa de que esa madurez amplía la superficie de ataque. Qué cambia y a qué prestar atención.
MCP, A2A o REST: qué protocolo elegir para tus agentes
Un análisis de Oracle ordena cuándo conviene MCP, cuándo A2A y cuándo basta una API REST clásica para conectar agentes. No hay protocolo ganador: hay encaje.
Chaser lleva Claude a Slack con una integración MCP
Chaser y Anthropic lanzan una integración del Model Context Protocol que mete a Claude dentro de Slack para gestionar cobros e impagos sin salir del chat.
MCP, A2A o REST: cuándo gana cada protocolo de agentes
Un análisis de Oracle desgrana cuándo conviene MCP, cuándo el protocolo A2A y cuándo basta una API REST para conectar agentes. Resumimos los criterios.
Chaser lleva Claude a Slack con una integración vía MCP
Chaser y Anthropic anunciaron una integración que lleva Claude a Slack mediante el Model Context Protocol. Qué permite, por qué Slack y qué señala para el ecosistema MCP.

El riesgo oculto del vibe coding: código que funciona pero no es seguro
Una web vibe coded arrastró meses un fallo de inyección SQL sin que su autor lo supiera. The Verge repasa por qué las apps generadas por IA esconden agujeros de seguridad.
Documentación, fatiga de IA y tool slop: por qué la calidad gana
La fatiga ante tanta herramienta de IA tiene una cura poco glamurosa: documentación clara y proyectos bien mantenidos. Por qué la calidad sigue siendo la mejor inversión.

The Atlantic publica una base de datos de música usada para entrenar IA
El periodista Alex Reisner ha localizado y hecho buscables cuatro conjuntos de datos musicales usados para entrenar modelos de IA, dos de ellos con más de 9 y 12 millones de pistas.
Cuando un LLM no sabe que no sabe: puntos ciegos epistémicos en datos clínicos
Un estudio en arXiv revela que la confianza verbalizada de los LLMs es casi constante independientemente de si aciertan el 49% o el 75% de las veces, un problema crítico en entornos clínicos.
DeXposure-Claw: agentes LLM con freno incorporado para supervisar riesgos DeFi
Un equipo de investigación presenta un sistema agéntico para supervisión de riesgos en finanzas descentralizadas que filtra las decisiones LLM mediante evidencia estructurada antes de emitir alertas auditables.
Anclas ocultas en la deliberación multiagente de LLMs
Un estudio de arXiv modela la deliberación entre agentes LLM como sistema dinámico con creencias internas ocultas que explican por qué la confianza colectiva supera la de cualquier agente individual.
Modelos de difusión para texto: primer análisis comparativo riguroso
Un estudio de arXiv evalúa ocho modelos de difusión de texto en ocho benchmarks y ofrece el primer marco de comparación justo frente a la generación autorregresiva.

¿A quién pertenece el código que escribe Claude?
O'Reilly Radar plantea la pregunta que más equipos legales están ignorando: si Claude escribió tu función, ¿tienes derechos sobre ella? Repasamos el estado de la cuestión.
Medir el alineamiento curricular con IA: resultados que incomodan
Un estudio aplica un pipeline con LLMs y revisión humana para medir cuánto cubre un grado en Informática de las guías CS2013 y CS2023. El resultado: apenas la mitad.

Por qué los mejores flujos de código con IA son bucles, no prompts
El modelo mental del prompt único ya no describe bien cómo trabajan los agentes de código modernos. Los bucles agénticos son la estructura que sí encaja.

Un libro gratuito sobre herramientas de coding con IA, sin registro
Vladyslav Podoliak publica un libro abierto y gratuito sobre cómo operar herramientas de coding con IA. Sin registro, con fuente en GitHub y orientado a la práctica.
El freno al gasto en IA: cuando el coste supera al entusiasmo
Empresas que apostaron fuerte por la IA generativa empiezan a recortar su uso ante facturas desorbitadas. El ciclo de adopción acelerada choca con la realidad presupuestaria.
Slackbot se convierte en cliente MCP: qué cambia para los equipos
Slack ha integrado soporte nativo de MCP en su bot, convirtiendo el chat de equipo en un punto de entrada para herramientas externas. Analizamos qué significa esto en la práctica.

Cloudflare lanza cuentas temporales para agentes de IA
Cloudflare introduce cuentas efímeras pensadas para que agentes de IA operen con identidad propia, credenciales acotadas y tiempo de vida limitado.