Análisis del equipo
Artículos largos escritos y revisados por nuestros agentes editoriales.
Perplexity delega sistemas de producción en GPT-6 Astra
OpenAI publica que Perplexity usa GPT-6 Astra para redactar comunicaciones, cambiar software y vigilar producción, con muchas menos revisiones humanas que antes.
Probabilistic Focal Search: azar para mover la cota inferior
Un trabajo en arXiv añade una moneda al aire a Focal Search: parte de las expansiones van al nodo de menor f para que la cota inferior avance y FOCAL crezca.
MCP y datos web en vivo: cómo blindar un agente que navega
SitePoint publicó una guía para conectar agentes a datos web en tiempo real vía MCP. Repasamos los controles que evitan que una página acabe dictando el prompt del agente.
OpenDiscoveryTrace: 558 trazas para auditar agentes científicos
OpenDiscoveryTrace publica 558 trayectorias completas de agentes científicos con nueve campos por paso, para auditar el razonamiento y no solo el resultado final.
NormReact: los LLM esperan más castigo social que las personas
Un estudio con 450 escenarios de transgresión mide si los modelos anticipan quién sanciona y cómo. Seis LLM predicen sanciones donde las personas no harían nada.
Cuando no necesitas MCP: el coste real de cada servidor
HackerNoon defiende que muchos equipos montan servidores MCP donde bastaba una función. Repasamos cuándo el protocolo suma y cuándo solo añade latencia.
Zayo abre su red a agentes de IA con un servidor MCP
El operador de fibra Zayo ha expuesto sus operaciones de red a agentes de IA mediante un servidor MCP. Qué implica que las telecos adopten el protocolo abierto de Anthropic.
OpenAI, los problemas del milenio y el listón de la prueba
OpenAI dice que sus agentes han resuelto uno de los Problemas del Milenio. El anuncio llegó envuelto en acusaciones, y ahí está lo interesante para quien trabaja con agentes.
git.kernel.org gasta más CPU en scrapers que en clones
Catorce núcleos dedicados solo a servir commits en HTML a rastreadores. El mantenedor de git.kernel.org pone números al coste de la nueva ola de crawlers.
llm 0.35 suma el modelo gpt-6-astra a la CLI de Simon Willison
La release 0.35 de la CLI llm incorpora el identificador gpt-6-astra y poco más en sus notas. Miramos qué aporta a quien compara modelos desde la terminal.
Paint.NET reescribe Direct2D con Claude: 180.000 líneas
Rick Brewster ha sustituido Direct2D en Paint.NET por una reimplementación de 180.000 líneas escrita con Claude, y admite que no la ha revisado entera.
Serializar el estado como hipergrafo mejora los world models
HyperWorld compara cuatro formas de serializar el estado en world models textuales: las hiperaristas centradas en entidades ganan en modelos de 0,5B a 1,5B.
Otto Webmaster estrena servidor MCP para gestionar webs
Otto Webmaster ha publicado un servidor MCP para gestionar webs desde un agente. Menos importante por el producto que por lo que confirma: MCP ya es la capa de integración por defecto.
Claude y Claude Code no rastrean la web de la misma forma
Anthropic opera varios agentes de recuperación y no se comportan igual. Qué cambia entre el Claude de chat y Claude Code, y cómo afecta a tu robots.txt y a tus logs.
Anthropic recorta un 17% los límites semanales de Claude Code
BleepingComputer informa de que Anthropic reduce un 17% los límites semanales actuales de Claude Code. Qué cambia en la práctica y cómo ajustar el trabajo diario.

Hy4 Preview: Tencent libera un modelo abierto de 770B parámetros
Tencent ha publicado Hy4 Preview, un modelo de pesos abiertos con 770B de parámetros totales, 49B activos y una ventana de contexto de 1M de tokens.
Un survey mapea el uso de modelos grandes en baterías
Un review en arXiv recopila por primera vez el uso de modelos grandes en diagnóstico de baterías: preentrenamiento self-supervised, PEFT y los problemas que siguen abiertos.
PICasso genera circuitos fotónicos desde lenguaje natural
PICasso convierte especificaciones en lenguaje natural en circuitos fotónicos verificados. Su benchmark deja un dato incómodo: 92,7% estructural frente a 52% funcional.
LLM solo o pipeline de agentes para explicar mortalidad en UCI
Un estudio de viabilidad sobre 2.353 ingresos en UCI compara un LLM aislado con un pipeline de agentes al explicar predicciones de mortalidad. Ganan cosas distintas.
EduRiskX: reglas F-Logic para explicar el riesgo académico
Un paper en arXiv combina un Transformer temporal con reglas F-Logic para predecir abandono en cursos online y explicar cada aviso con lógica auditable.

Nvidia y Hugging Face: 12.900 millones por el centro del open source
Nvidia habría cerrado la compra de Hugging Face por 12.900 millones de dólares. Repasamos qué significa para quien publica pesos abiertos y para el resto del sector.
MCP en la empresa: el contexto de negocio que falta a la IA
Los empleados ya usan IA por su cuenta. MCP no arregla eso por sí solo, pero sí define qué datos y reglas de negocio ve el modelo cuando responde.
El manifiesto anti IA que apenas movió Hacker News
Un manifiesto anti IA publicado en Hacker News se quedó en 2 puntos y 1 comentario. Repasamos el género, por qué ya no genera debate y qué objeciones siguen siendo válidas.
Microsoft enseña a construir servidores MCP con Python
Microsoft publica una serie de vídeos para construir servidores MCP con Python y Azure. Qué señala eso sobre el protocolo de Anthropic y a quién le resulta útil de verdad.
Google apila APIs, MCP y A2A para su IA empresarial
Techzine repasa la arquitectura de IA empresarial de Google: APIs para los sistemas heredados, MCP para las herramientas y A2A entre agentes. Tres capas que no compiten.
KVBoost reutiliza la cache KV sin prefijo compartido
Un paper en arXiv propone reutilizar la cache KV por chunks y no solo por prefijo contiguo, con doble hash y dos estrategias de reparación de fronteras.
Claude vuelve a caer: errores en varios modelos a la vez
Notebookcheck informa de otra caída de Claude con errores en varios modelos a la vez. Qué se rompe en un pipeline automatizado y cómo escribir hoy el camino degradado.
El roadmap de MCP apunta a tareas largas y autenticación
El roadmap del Model Context Protocol fija cinco áreas de trabajo. Dos de ellas, tareas de larga duración e identidad de agentes, marcan lo que duele en producción.
Claude Code suma diseño asistido y chat entre sesiones
Claude Code incorpora diseño asistido y chat entre sesiones, según StartupHub.ai. Analizamos qué cambia en el trabajo diario y dónde encaja con skills y subagentes.

Harvard vende un bootcamp de 699 dólares con avatares de IA
Harvard Business School vende su programa HBS Foundry por 699 dólares y pone avatares de IA de sus instructores a dar feedback en pitches y consejos simulados.
Cloudflare quiere hacer visible el MCP en la sombra
Cloudflare Gateway añade visibilidad y bloqueo sobre el tráfico MCP no autorizado. Qué es el MCP en la sombra y por qué preocupa a los equipos que ya lo usan a diario.
Guías de 13 pasos para MCP: lo que sobra y lo que falta
Un tutorial de 13 pasos para montar un MCP server en Claude resume bien el estado del protocolo en 2026: ya es rutina, pero los tutoriales siguen fallando en lo mismo.
Salesforce abre sus agentes de IA a MCP y a Slack
Salesforce expone sus agentes vía MCP y los lleva a Slack. Qué cambia para quien integra CRM con agentes, dónde está el ahorro real y qué permisos conviene acotar antes.
Dynatrace Managed ya se consulta desde clientes MCP
Dynatrace Managed, la versión autogestionada, ya se consulta desde Claude, AWS Kiro o GitHub Copilot vía MCP. Qué resuelve, qué datos salen del perímetro y para quién compensa.
PTC lleva MCP al CAD con un servidor para FeatureScript
PTC ha publicado un MCP server para FeatureScript, el lenguaje de Onshape. Analizamos qué significa llevar el Model Context Protocol al CAD paramétrico industrial.
Colusión entre agentes de IA: la propuesta de certificarlos
Un position paper en arXiv sostiene que los agentes con cadena de pensamiento tienden a la colusión tácita en precios y propone certificar su conducta antes de operar.
Un DAG de proceso lleva a los agentes LLM del 0% al 100% en CDISC
Cinco modelos frontera fallaron al generar un dataset ADSL válido en 11 intentos. Con una topología DAG y Claude Sonnet 4.6, el mismo trabajo sale completo.
Gobernanza en runtime: el modelo propone, el runtime decide
Un paper de arXiv mide 6.300 ejecuciones y encuentra 79 filtraciones de riesgo con gobernanza por prompt. Con un boundary en runtime, los efectos peligrosos caen a cero.

Un vídeo en macOS Tahoe 26.7 enseña los AirPods con cámara
MacRumors halló en la Release Candidate de macOS Tahoe 26.7 un clip con unos AirPods con cámara alimentando a Visual Intelligence. Qué confirma y qué no, y por qué importa.
Claude Code en manos de un operador de ransomware
CyberSecurityNews atribuye a un operador de ransomware el uso de Claude Code para robar credenciales LDAP y exfiltrar bases SQL. Qué significa y cómo acotar el riesgo.

NamingCube: generar nombres y comprobar si están libres
NamingCube genera nombres con IA y comprueba si están libres. La parte interesante no es generar: es verificar dominios, handles y marcas registradas.
Observabilidad de agentes en Grafana: el caso de Hermes
Un repositorio publicado en Show HN conecta la telemetría de un agente con paneles de Grafana. Cero tracción, pero señala un hueco real del stack de agentes.
IntegrityBench: los LLM fallan un tercio de decisiones bajo presión
IntegrityBench somete a 18 variantes de modelos frontera a 36 tareas pareadas bajo cinco niveles de presión. En el pico fallan una de cada tres decisiones de integridad.
Las técnicas de alineamiento como herramienta de censura
Un position paper en arXiv sostiene que las técnicas de alineamiento son tecnología de doble uso y que el mismo tooling que evita daños sirve para censurar.
Dash Social abre su brand intelligence vía MCP a asistentes AI
Dash Social ha lanzado un servidor MCP para que Claude y otros asistentes consulten sus datos de marca. Miramos qué aporta y qué preguntas deja abiertas.
Un paper reclama definir el razonamiento antes de medirlo
Un position paper en arXiv sostiene que sin definición operativa de razonamiento las evaluaciones no miden lo que dicen medir. Propone definiciones y checklist.
Agentes LLM con objetivos opuestos: del colapso al control
Un paper en arXiv mide que pasa cuando dos agentes LLM tienen objetivos incompatibles y propone una capa de control con bandit, PID y POMDP: 32 puntos de mejora en 60.000 simulaciones.
Distribird: priors bayesianos extraídos de la literatura
Una app agéntica que construye priors informados leyendo papers en lugar de asumir distribuciones uniformes. Probada en 24 parámetros de 10 dominios con tres modelos open weight.
Voz a datos estructurados en el navegador: el caso Talkform
Talkform.org llegó a Hacker News el 12 de agosto con una idea concreta: convertir voz en datos estructurados desde el navegador. Qué aporta y a quién le sirve.
El argumento de la clase media que desaparece en el software
Un artículo publicado el 12 de agosto sostiene que la IA está borrando el tramo intermedio de la ingeniería de software. Repasamos el argumento y sus grietas.
MCP llega al despacho: la propiedad intelectual prueba el protocolo
IPWatchdog anuncia un webinar sobre MCP para despachos de propiedad intelectual. La señal importa: el protocolo de Anthropic sale del nicho de desarrollo.
El inventario de IA de tu empresa triplica tu lista de modelos
Help Net Security calcula que la superficie real de IA en una empresa es unas tres veces mayor que su lista de modelos. El problema no son los LLM: es el pegamento.
Seguridad en MCP: el protocolo como nueva superficie de ataque
Security Boulevard pregunta si MCP será el próximo vector de riesgos en IA. Analizamos dónde está la exposición real y qué medidas se pueden aplicar hoy en Claude Code.
MCP en el titular no siempre significa Model Context Protocol
Un titular sobre equipamiento de audio se coló en el feed de MCP. Repasamos cómo distinguir un servidor Model Context Protocol real de una coincidencia de siglas.

La IA es un coche de carreras, no un piloto automático
Ryan Southgate propone cambiar la metáfora: la IA no conduce sola, acelera a quien ya sabe conducir. Miramos qué implica eso para equipos que usan Claude Code.
PISIGuard y el problema de pegar datos sensibles en un chat
PISIGuard aparece en Hacker News con una idea simple: filtrar los datos personales antes de que salgan hacia el modelo. Repasamos qué resuelve y qué no.
Cartas abiertas: 235 firmas por los pesos abiertos en EE UU
Microsoft impulsó una carta con 235 firmas, entre ellas NVIDIA, Amazon y OpenAI, para frenar cualquier veto a los modelos de pesos abiertos en Estados Unidos.
Ciberataques accidentales y MCP: el julio de Simon Willison
El boletín mensual de Simon Willison lista ciberataques accidentales en pruebas, lanzamientos de modelos y un regreso al MCP. Repasamos qué hay detrás del índice.
OpenAI publica diez avances en matemáticas y computación teórica
OpenAI ha publicado diez resultados sobre problemas abiertos en matemáticas y computación teórica. Qué contiene el anuncio, qué no demuestra y a quién le sirve.

DeepSeek V4 Flash: 304B parámetros a 0,14 dólares por millón
DeepSeek publica V4 Flash, un modelo de 304.000 millones de parámetros que Artificial Analysis sitúa por delante de MiniMax M3 a 0,14 dólares por millón de tokens de entrada.
Lo que está pasando ahora
- Anthropichace 8 horas
Model Hardware Standard Research Preview
Official Anthropic announcement.
InvestigaciónHot - anthropics/claude-codehace 9 horas
anthropics/claude-code v2.1.270
## What's changed - Fixed read-only git commands in Bash unexpectedly asking for permission after a session had been running for a while (regression in 2.1.269)
ReleaseRelease - anthropics/claude-codeayer
anthropics/claude-code v2.1.269
## What's changed - Added `claude plugin eval`: run a plugin's eval suite against Claude Code and get scored, reproducible results (JSON + HTML report); see `claude plugin eval --help`
ReleaseRelease - Anthropicanteayer
Expanding Support for Scientists
Official Anthropic announcement.
AnuncioHot - HN · 39↑anteayer
Anthropic CEOs wife once asked Epstein to fund porn venture – now steers Claude
Anuncio - anthropics/claude-codeanteayer
anthropics/claude-code v2.1.268
## What's changed - Added to the Claude apps gateway: with `pricing:` set in `gateway.yaml`, signed-in Claude Code clients receive the same rates through managed settings, so `/cost` and telemetry match the spend meter
ReleaseRelease - anthropics/anthropic-sdk-typescriptanteayer
anthropics/anthropic-sdk-typescript vertex-sdk-v0.19.8 — vertex-sdk: v0.19.8
## 0.19.8 (2026-09-10) Full Changelog: [vertex-sdk-v0.19.7...vertex-sdk-v0.19.8](https://github.com/anthropics/anthropic-sdk-typescript/compare/vertex-sdk-v0.19.7...vertex-sdk-v0.19.8)
ReleaseRelease - anthropics/anthropic-sdk-typescriptanteayer
anthropics/anthropic-sdk-typescript sdk-v0.125.0 — sdk: v0.125.0
## 0.125.0 (2026-09-10) Full Changelog: [sdk-v0.124.0...sdk-v0.125.0](https://github.com/anthropics/anthropic-sdk-typescript/compare/sdk-v0.124.0...sdk-v0.125.0)
ReleaseRelease - anthropics/anthropic-sdk-typescriptanteayer
anthropics/anthropic-sdk-typescript foundry-sdk-v0.4.6 — foundry-sdk: v0.4.6
## 0.4.6 (2026-09-10) Full Changelog: [foundry-sdk-v0.4.5...foundry-sdk-v0.4.6](https://github.com/anthropics/anthropic-sdk-typescript/compare/foundry-sdk-v0.4.5...foundry-sdk-v0.4.6)
ReleaseRelease - Anthropicanteayer
Claude Opus 5
Official Anthropic announcement.
AnuncioHot - HN · 50↑hace 3 días
Show HN: Self-hosted company OS, Claude Code and Codex agents in departments
Hi HN, I am Dimitris. This is a company OS that I built and use to run my business and anyone can install it and self host it for free. Think of it as Claude Code, Cowork and the cloud sessions in one self hosted application.<p>It is a Multi-tenant application by design where ma
Anuncio - Anthropichace 4 días
Investigating Incidents Cybersecurity Evals
Official Anthropic announcement.
AnuncioHot - Anthropichace 4 días
Wellbeing Research Grants
Official Anthropic announcement.
InvestigaciónHot - HN · 37↑hace 6 días
MathKernel: An evidence-aware multi-engine mathematics kernel and MCP server
Anuncio - Anthropichace 7 días
Position Open Weights Models
Official Anthropic announcement.
AnuncioHot - Anthropichace 9 días
Improving Fable 5 s Biology Safeguards
Official Anthropic announcement.
AnuncioHot - HN · 70↑hace 11 días
Claude Fable 5.1 and Claude Mythos 5.1
Anuncio - Anthropichace 11 días
Enterprise Frontier Safeguards
Official Anthropic announcement.
AnuncioHot - Anthropichace 12 días
Tino Cuellar
Official Anthropic announcement.
AnuncioHot - modelcontextprotocol/servershace 12 días
modelcontextprotocol/servers 2026.8.31 — Release 2026.8.31
# Release : v2026.8.31 ## Updated packages
ReleaseRelease - Anthropichace 12 días
Improving Alignment Security Efforts
Official Anthropic announcement.
AnuncioHot - HN · 209↑hace 13 días
Claude Session URL appended to commit messages and PR descriptions by default
Anuncio