Para agosto de 2026, Anthropic había confirmado un equipo interno de silicio y un “enfoque multichip” para Claude, aunque no había mostrado un chip en producción. Documentos para inversionistas revisados por The Wall Street Journal situaron los costos de inferencia por encima de la mitad de los ingresos tanto en Anthropic como en OpenAI. Esos documentos evidencian presión sobre la economía del servicio, pero no explican por qué Anthropic creó el equipo.

Puntos clave

  • Materiales para inversionistas revisados por The Wall Street Journal en abril de 2026 situaron los costos de inferencia por encima de la mitad de los ingresos tanto en Anthropic como en OpenAI.
  • Anthropic informó que su experimento de compilador de C basado en Rust generó cerca de $20,000 en costos de API.
  • El 22 de agosto de 2026, Anthropic confirmó que estaba sentando las bases para semiconductores personalizados y que había adoptado un enfoque multichip.
  • El experimento de compilador de Anthropic del 6 de febrero usó 16 agentes Claude Opus 4.6 en paralelo durante casi 2,000 sesiones.
  • Anthropic dijo que el tráfico propio y de terceros en modelos de la clase Mythos se conservaría durante 30 días.

Business Insider informó el 5 de agosto que Anthropic planea codiseñar hardware y modelos conforme aumenta la demanda de Claude. Ese trabajo podría reducir gastos, añadir capacidad, mejorar el rendimiento o diversificar el suministro. La evidencia disponible respalda una conclusión más acotada: Anthropic está incorporando una opción de diseño de hardware mientras la inferencia recurrente ya domina su estructura de costos, pero la empresa no ha dicho qué problema resolverá su primer chip.

Los agentes convierten los proyectos en calendarios de cómputo

La inferencia se repite cada vez que un cliente usa un modelo entrenado. Los materiales para inversionistas de abril de 2026 revisados por The Wall Street Journal situaron ese gasto por encima de la mitad de los ingresos, pero no revelaron el costo de Anthropic por modelo, cliente o carga de trabajo.

El propio trabajo de ingeniería de Anthropic muestra cómo puede acumularse el uso de agentes. El 6 de febrero, la empresa describió el uso de 16 agentes Claude Opus 4.6 en paralelo para construir un compilador de C basado en Rust de 100,000 líneas durante casi 2,000 sesiones.

Costo de API reportado para el proyecto de compilador de C de Anthropic

Ese proyecto es un experimento de ingeniería, no una referencia para cargas de trabajo habituales de clientes. No establece una cantidad típica de llamadas al modelo por tarea. Sí muestra que un proyecto con agentes puede generar muchas sesiones de pago sin requerir una nueva instrucción humana para cada paso.

Cuando el software continúa a través de una secuencia de decisiones y llamadas a herramientas, Anthropic debe decidir qué modelo atiende cada paso y cuánta latencia, capacidad y contexto justifica ese paso. La empresa no ha revelado la economía de ese enrutamiento. La medida útil sería el costo por tarea de agente completada después del enrutamiento y el almacenamiento en caché, en lugar del precio de una respuesta aislada.

El plan de chips de Anthropic sigue siendo una opción

El “enfoque multichip” de Anthropic deja abierta la forma en que dividirá el trabajo entre silicio personalizado, aceleradores externos y capacidad en la nube. Business Insider dijo que la empresa pretende codiseñar hardware y modelos, pero su informe de agosto no identificó un calendario de producción, socio de manufactura ni primera carga de trabajo.

Anthropic también contrató a Amir Salek, quien dirigió el negocio de TPU de Google hasta 2022, para su equipo de cómputo. Los mismos reportes de agosto describieron el chip de servidor personalizado de Anthropic como una iniciativa temprana y dijeron que la empresa había sostenido conversaciones preliminares de manufactura con Samsung. Anthropic no ha demostrado que pueda sustituir capacidad de hiperescaladores o proveedores de GPU.

El 2 de mayo, The Information informó que Anthropic estaba en conversaciones iniciales para comprar chips de inferencia de Fractile, con sede en Reino Unido, cuando estén disponibles en 2027. El informe describió a Fractile como una posible incorporación a proveedores como Google, Amazon y Nvidia; no vinculó esas conversaciones con el programa interno de diseño de Anthropic.

En conjunto, los reportes apuntan a diversificación del suministro además de diseño personalizado. Anthropic podría comparar el comportamiento de los modelos, el enrutamiento y la arquitectura de hardware dentro de un mismo ciclo de decisión, y luego reservar silicio personalizado para una carga de trabajo recurrente. El registro público no identifica esa carga de trabajo, su volumen ni los ahorros necesarios para recuperar la inversión de diseño.

El software puede mover la frontera antes de que llegue el silicio

El 1 de julio, The Information informó que ingenieros de OpenAI habían dicho a colegas que encontraron un método de software capaz de reducir a más de la mitad los costos de inferencia. El informe se refiere a OpenAI y no establece que Anthropic haya logrado el mismo resultado.

Sí muestra por qué la decisión de Anthropic entre fabricar o comprar sigue siendo flexible. Una optimización de software puede extenderse al hardware ya instalado, mientras que un chip personalizado requiere trabajo de diseño y compromisos de manufactura antes de atender una solicitud. Si el software elimina primero gran parte del costo de una carga de trabajo, Anthropic tiene menos razones para internalizar esa carga de trabajo en silicio.

Anthropic debe comparar esas rutas carga de trabajo por carga de trabajo. El hardware personalizado ofrece una coordinación más estrecha cuando el volumen recurrente es estable; los proveedores externos distribuyen los costos de desarrollo entre más clientes y productos. Anthropic no ha revelado ni la comparación ni las cargas de trabajo seleccionadas para silicio interno.

El financiamiento sigue siendo prospectivo

Para agosto de 2026, los banqueros de Anthropic supuestamente habían dicho a posibles inversionistas que una OPI podría recaudar más de $100 mil millones con una valuación de $2 billones. Esas cifras siguen siendo prospectivas y no confirmadas. Describen el capital en discusión, no dinero que Anthropic ya pueda desplegar.

Por separado, se informó que Broadcom estaba en conversaciones por más de $60 mil millones de deuda para un acuerdo de financiamiento de chips de IA que se esperaba beneficiara a Anthropic y otras empresas. Esas conversaciones seguían incompletas. También se informó que OpenAI y Broadcom habían discutido financiar aproximadamente $18 mil millones de producción inicial de chips personalizados, condicionado a que Microsoft comprara cerca de 40% de los chips.

En la propuesta reportada de OpenAI, Microsoft convertiría demanda incierta en compras contratadas que prestamistas y proveedores podrían financiar. Ningún informe público identifica un comprador ancla equivalente para el esfuerzo de chips de Anthropic. Su diseño podría fallar, la manufactura podría retrasarse y la capacidad reservada podría llegar después de que cambie la carga de trabajo.

Las reglas de acceso restringen el enrutamiento de modelos

Los controles de servicio de Anthropic regulan tanto el acceso como la asignación. El 22 de agosto, la empresa dijo que Mythos 5 estaba en beta pública a través de Claude Security para usuarios Enterprise y que trabajaba con proveedores para integrar el modelo en herramientas defensivas. Anthropic no ofreció acceso directo sin restricciones.

Un informe de CyberScoop del 10 de junio dijo que las pruebas de red team de Anthropic no encontraron jailbreaks universales para Fable 5 y que el tráfico propio y de terceros en modelos de la clase Mythos se conservaría durante 30 días. Esas reglas definen quién puede enviar solicitudes y qué registros deben persistir. Las fuentes citadas no las vinculan con el programa de silicio de Anthropic ni afirman que reduzcan los costos de inferencia.

Aun así importan para el stack de servicio porque los enrutadores de Anthropic deben aplicar la elegibilidad de modelos, los permisos empresariales y los requisitos de retención antes de asignar una carga de trabajo. La política de acceso cambia qué solicitudes pueden ejecutarse; la evidencia no muestra que haga más baratas esas solicitudes.

Preguntas frecuentes

¿Cuándo podría Anthropic presentar públicamente una solicitud para una OPI?

Las fuentes dijeron que Anthropic se preparaba para presentar públicamente la solicitud tan pronto como a finales de agosto de 2026. Ese momento fue reportado como prospectivo, no como una presentación completada ni una fecha anunciada de OPI.

¿Podrían las empresas mantener la retención obligatoria de datos de 30 días de Anthropic en sus propios entornos de nube?

Según reportes, Anthropic planeaba un cambio que permitiría a las empresas conservar los datos obligatorios de 30 días en sus propios sistemas de nube. La evidencia caracteriza el cambio como un rumor, no como algo confirmado.

¿Comprar chips de inferencia de Fractile significaría que Anthropic produjo su propio chip personalizado?

No. Las conversaciones reportadas con Fractile se referían a una posible compra de chips de inferencia suministrados externamente cuando estén disponibles en 2027; los reportes no vincularon ese posible acuerdo de suministro con el esfuerzo interno de diseño de chips de Anthropic.

La cifra equivalente a la mitad de los ingresos pone en mayor relieve el anuncio de chips de Anthropic de agosto. Su experimento de compilador muestra una forma en que el trabajo con agentes puede acumular una factura sustancial de servicio, mientras que el plan multichip da a Anthropic más control sobre cómo se ejecuta ese trabajo. Un equipo, conversaciones preliminares con proveedores y una estrategia de codiseño todavía no establecen un sistema de producción más barato. Anthropic ahora tiene el medidor dentro de su ciclo de diseño; la factura más baja sigue sin comprobarse.