En una empresa de 40 personas, quien dirige las finanzas prepara en Excel los modelos de presupuesto y de flujo de caja. Cada trimestre presenta el informe para el consejo, el conjunto de estados financieros que revisa el consejo de administración. Quiere que la IA le ayude con dos tareas. La primera es construir modelos nuevos. La segunda importa más : auditar los libros de Excel que ya existen, es decir, revisarlos en busca de referencias rotas y errores silenciosos. Una referencia rota es una fórmula que apunta a celdas que se movieron o se borraron. Un error silencioso es una fórmula que devuelve un número perfectamente creíble que, sin embargo, está mal. Siempre aparecen las mismas tres herramientas de IA, cada una de una empresa distinta. Claude for Excel, de Anthropic, es un complemento, un pequeño programa que funciona dentro de Excel, y viene incluido en los planes de pago de Claude. Microsoft 365 Copilot, de Microsoft, también funciona dentro de Excel. Gemini, de Google, funciona dentro de Google Sheets, la hoja de cálculo en línea de Google. La empresa trabaja con Microsoft 365, la suscripción de Microsoft que reúne Excel, Word, Outlook y sus demás aplicaciones de oficina, aunque algunos compañeros usan Sheets.
Polora planteó ese caso a modelos de IA creados por Anthropic, OpenAI y Google. Tres modelos especialistas dieron cada uno su recomendación. Un modelo investigador contrastó sus precios y afirmaciones con fuentes publicadas, y un modelo moderador dio la respuesta final. Lo que sigue es su comparación, incluidos los puntos en que se equivocaron con las cifras y aquellos en que la información pública ya no alcanza.
Los modelos de IA coincidieron en un reparto : Copilot para crear y Claude for Excel para auditar
Los tres modelos especialistas llegaron al mismo reparto de tareas. El Analista de Ecosistemas Empresariales, un modelo de OpenAI, defendió que Copilot se encargara de construir. Su razón no era que Copilot razone mejor las finanzas, sino que trabaja dentro del entorno donde ya vive el modelo financiero, con sus permisos, sus archivos compartidos y el proceso de preparación del informe para el consejo. La pregunta mencionaba el Agent Mode de Copilot, pero puede que ese no sea el nombre que usted vea. El Analista señaló que Microsoft ahora lo llama Edit with Copilot, y la documentación actual de Microsoft describe tres formas de trabajar en Excel : Edit, Plan y Chat. El modelo moderador recomendó comprobar qué nombres y funciones aparecen en la configuración de su propia empresa en lugar de fiarse de una etiqueta. El Analista aconsejó usar Plan antes de permitir cualquier edición directa. El Especialista en Ingeniería de Hojas de Cálculo, un modelo de Anthropic, calificó esa costumbre de planificar antes de tocar las celdas como la garantía de seguridad más importante cuando una herramienta genera un modelo financiero nuevo.
Para auditar, los tres eligieron Claude for Excel, incluido el Estratega de Riesgos y Auditoría, que es un modelo de Google. Lo que inclinó la balanza fue que Claude señala celdas concretas. Anthropic afirma que el complemento puede explicar un libro, seguir sus cambios y llevarle a usted a las celdas que menciona. El Especialista en Ingeniería de Hojas de Cálculo lo resumió sin rodeos : un hallazgo de auditoría que no se puede rastrear hasta una referencia de celda no es un hallazgo de auditoría, es un rumor.
El modelo moderador marcó la distinción que más necesita el lector. Esto es una recomendación sobre cómo organizar el trabajo, no una prueba de que Claude detecte más errores silenciosos que Copilot. El modelo investigador añadió que, cuando tres modelos razonan a partir de material público que en buena parte es el mismo, su acuerdo llama la atención pero no demuestra nada, porque pueden compartir el mismo punto ciego.
Por qué los modelos de IA dejaron a Gemini fuera del modelo de Excel que usa el consejo
Ninguno de los modelos de IA dijo que Gemini fuera flojo. Su objeción era de estructura. Google indica que Gemini funciona mejor en archivos nativos de Google Sheets y pide guardar el archivo de Excel como archivo de Sheets para usar sus funciones. En un libro con varias hojas y lleno de vínculos entre pestañas, esa conversión crea una segunda versión de las cifras financieras de la empresa. El Especialista en Ingeniería de Hojas de Cálculo advirtió que la propia conversión puede introducir justo el tipo de error que la herramienta debería encontrar : referencias rotas, fórmulas que ya no rellenan un bloque de celdas como antes y redondeos distintos.
El Analista de Ecosistemas Empresariales señaló además los límites de la fórmula de IA de Gemini, que se escribe en una celda como =AI() para preguntarle algo a Gemini y recibir su respuesta en esa misma celda. Solo devuelve texto, no ve el libro completo y no puede colocarse dentro de otras fórmulas. El Estratega de Riesgos y Auditoría afirmó que Google había lanzado en junio de 2026 una función específica para corregir errores, pero el modelo investigador no pudo confirmar ni la función ni la fecha. El consejo común de los modelos fue que Gemini tiene sentido para los compañeros cuyo trabajo ya está en Sheets y que lo tienen incluido en su plan, pero no como auditor del modelo del que depende el consejo.
Cuánto le costarían Copilot, Claude for Excel y Gemini a una empresa de 40 personas
Dos de los modelos especialistas se equivocaron con los precios, y el modelo investigador los corrigió. Para una empresa de este tamaño, Microsoft 365 Copilot Business figura a 21 dólares por usuario al mes con facturación anual, a 18 dólares con una oferta promocional o a 25,20 dólares con pago mensual, para organizaciones de hasta 300 usuarios. Los 30 dólares que citó uno de los modelos corresponden al precio para grandes empresas. Copilot nunca se vende por separado. Requiere un plan base de Microsoft 365 que cumpla los requisitos, como Microsoft 365 Business Standard a 14 dólares por usuario al mes, así que el precio del complemento se queda corto frente al coste real. Las fuentes públicas no coinciden en cuándo termina la promoción. La página de la propia Microsoft dice que el 31 de diciembre de 2026 y limita la tarifa de 18 dólares al compromiso anual y solo durante el primer año. Otras fuentes hablan del 30 de septiembre, que está a pocos días. El investigador sugirió comprobar el presupuesto en el centro de administración de Microsoft 365, la consola desde la que el administrador de TI de una empresa gestiona cuentas y licencias.
Al hacer las cuentas, el Analista de Ecosistemas Empresariales calculó que Copilot para las 40 personas saldría por unos 720 dólares al mes con la tarifa anual de 18 dólares, o 1008 dólares al mes con pago mensual, sin contar el plan base. Propuso empezar, en cambio, con entre cinco y ocho puestos, es decir, licencias individuales de usuario, para quienes de verdad construyen y presentan las cifras.
Claude for Excel no tiene precio propio. Viene con los planes de pago de Claude : Pro a 20 dólares al mes, Max desde 100 dólares y Team. Según la lectura del moderador, la tarifa actual de Team es de 20 dólares por puesto al mes con facturación anual o 25 dólares con pago mensual, con un mínimo de dos puestos, por debajo de los 25 y 30 dólares con un mínimo de cinco puestos que había dado el Analista. Usar Claude en Excel exige una cuenta profesional de Microsoft 365, pero no una licencia de Copilot.
Gemini en Sheets arranca con Google Workspace Business Standard a 14 dólares por usuario al mes con facturación anual. Como la IA va incluida en el paquete, todos los usuarios del plan la pagan, la usen o no. El Especialista en Ingeniería de Hojas de Cálculo añadió una advertencia sobre Copilot. Además del precio por puesto, se pueden cobrar tarifas por uso cada vez que la IA realiza ciertas tareas, y varios de esos cargos pueden acumularse a la vez, así que aconsejó fijar límites de gasto desde el primer día.
Un plan de Claude de 20 dólares puede agotarse a mitad de la auditoría de un libro grande
El Especialista en Ingeniería de Hojas de Cálculo, uno de los modelos de IA de la comparación, dijo que los límites de uso eran su advertencia práctica más seria. Hay usuarios que cuentan haber alcanzado el límite del plan Pro en cuestión de minutos, tras unas pocas tareas de formato y una sola revisión de errores, con el trabajo a medio hacer. El complemento consume la cuota mucho más deprisa que el chat, porque cada petición lee el libro, razona sobre él y ejecuta varias acciones por separado. Auditar un libro grande y lleno de vínculos es casi lo más exigente que se le puede pedir.
Una reseña independiente que encontró el modelo investigador coincide. Pro sirve para el trabajo analítico diario, mientras que el plan Max de 100 dólares da mucho más margen para modelos financieros pesados. El Especialista lo planteó como una elección : pagar un nivel superior como Max si se quiere auditar el informe para el consejo de una sola vez, o aceptar auditar una pestaña por sesión, en lugar de contratar por inercia el plan de 20 dólares. Señaló que las quejas son de marzo de 2026 y que los límites pueden haber cambiado desde entonces, así que la prueba de verdad será la primera semana de uso real.
En qué no coinciden las reseñas públicas sobre Claude y Copilot en Excel
La pregunta pedía mostrar los desacuerdos, no zanjarlos, y los modelos de IA encontraron varios. Una reseña dice que la mayoría de quienes probaron ambas herramientas prefiere Claude a Copilot, pero se trata de opiniones declaradas por los propios usuarios, y esa misma reseña advertía de problemas de instalación y de fiabilidad a fecha de marzo de 2026. El veredicto de un consultor, revisado en agosto de 2026, considera a Claude la mejor herramienta para el análisis, para construir modelos y para desentrañar libros heredados, y afirma que Copilot conserva la ventaja en tareas rápidas desde la barra de menús de Excel. Es la opinión de una sola persona con experiencia.
Microsoft informó de mejoras en uso, permanencia y satisfacción de Excel durante su versión preliminar, el periodo de prueba anterior al lanzamiento completo. El Especialista en Ingeniería de Hojas de Cálculo señaló que esas cifras miden cuánto usó la gente el producto, no si sus fórmulas eran correctas. Anthropic ha citado un resultado de Claude en una prueba de referencia financiera, un examen estandarizado que sirve para comparar modelos de IA, y Microsoft informa de mejoras en fiabilidad. Según el Analista de Ecosistemas Empresariales, ninguna de las dos afirmaciones muestra cómo se comportará cada herramienta con las pestañas ocultas, los vínculos a otros archivos y las convenciones de su propia empresa. La conclusión del modelo investigador fue tajante. No encontró ninguna prueba de referencia independiente y auditada que compare estas tres herramientas en la auditoría de modelos financieros. Afirmar que una es mediblemente mejor en esa tarea va más allá de lo que muestran los datos.
¿Vale la pena usar dos herramientas de IA sobre el mismo modelo de Excel? Los modelos de IA dijeron que sí
El Especialista en Ingeniería de Hojas de Cálculo, un modelo de Anthropic, basó su argumento en la separación de funciones, la regla contable según la cual quien registra una operación en los libros no es quien la aprueba. Un modelo que revisa su propio trabajo arrastra sus propios puntos ciegos. Si Copilot interpreta mal la pestaña de supuestos al escribir una fórmula y luego revisa esa misma fórmula, el error pasa por los dos pasos y parece una confirmación. Un revisor creado por otra empresa, con otro entrenamiento, falla de otras maneras. A juicio del Especialista, que los dos coincidan es una prueba débil, y que discrepen señala exactamente la celda que una persona debería mirar.
El modelo moderador acotó la propuesta. Sugirió dar a unos pocos usuarios de finanzas Copilot para redactar y Claude para revisar, cada uno trabajando sobre una copia distinta del libro y nunca los dos editando el modelo aprobado. La prueba que propuso era un piloto breve con errores pasados ya conocidos y con errores introducidos a propósito, en el que se mide cuántos errores importantes se detectan, cuántas falsas alarmas aparecen, si hay cambios no deseados y si cada hallazgo indica una celda exacta y su consecuencia para el negocio. Aconsejó añadir licencias solo si la segunda herramienta justifica su coste. El Analista de Ecosistemas Empresariales advirtió que no conviene pedir a ninguna de las dos que lo arregle todo de una vez, porque el resultado es un libro de aspecto impecable cuya lógica ha cambiado en decenas de sitios. La rutina del propio moderador apunta en la misma dirección : un cambio propuesto cada vez.
Antes de instalar Claude for Excel : la aprobación de TI y un posible hueco en el registro de cambios de la IA
Una implantación en toda la organización pasa por el centro de administración de Microsoft 365, desde donde un administrador de TI instala el complemento para todos, para usuarios concretos o para grupos. El Especialista en Ingeniería de Hojas de Cálculo, uno de los modelos de IA, señaló que el administrador también debe aprobar a Anthropic como empresa externa autorizada a tratar datos de la compañía. Como un modelo de flujo de caja contiene cifras de las que se pueden deducir las nóminas, dijo que esa conversación debe tener lugar antes de la instalación. El complemento necesita versiones recientes de Office. Office 2016 y 2019 no son compatibles.
El modelo investigador planteó un hueco que los demás habían pasado por alto. Una reseña de marzo de 2026 decía que el complemento todavía no guardaba el tipo de registro detallado que esperan los auditores. Si eso sigue siendo así y un contable externo o el consejo preguntan qué cambió la IA y cuándo, un registro de cambios llevado a mano puede ser la única constancia. El investigador indicó que conviene confirmar la situación actual, ya que la reseña tiene seis meses.
Para comprobar una fórmula de Excel escrita por IA, explique su lógica con sus propias palabras y mire a qué celdas apunta
Todos los modelos de IA coincidieron en cómo debería aprobar una fórmula alguien que no programa, y ninguno de los pasos depende de qué IA la haya escrito. Se trabaja sobre una copia y con un solo cambio propuesto cada vez. Primero, se le pide a la IA que no edite nada, que proponga la fórmula, que explique cada referencia en lenguaje llano y que sugiera casos de prueba. Después, se reformula la regla con palabras propias, por ejemplo : la caja final es igual a la caja inicial más los cobros menos los pagos. Si esa frase y la explicación de la IA no coinciden, hay que detenerse ahí.
A continuación, se hace clic en la celda y se pulsa la tecla F2, que abre la fórmula para editarla. Excel rodea entonces con un color distinto cada celda o rango que usa la fórmula, de modo que no se trata de leer código, sino de comprobar si los recuadros de colores cubren la hoja correcta, el periodo correcto y todas las filas. El Especialista en Ingeniería de Hojas de Cálculo dijo que esta es la comprobación más productiva de todas, porque en segundos detecta un rango que se queda una fila corto o una columna desplazada. Rastrear precedentes y Rastrear dependientes muestran con flechas qué alimenta la celda y a qué alimenta ella. Evaluar fórmula recorre el cálculo paso a paso y muestra el valor en cada etapa, así que se ve en qué punto el número deja de tener sentido.
Luego se copia la fórmula un mes a la derecha y una fila hacia abajo, y se vuelve a mirar. Muchas fórmulas funcionan en una celda y se rompen al copiarlas. Hay que revisar el primer mes de la previsión, un cierre de año, el inicio del siguiente ejercicio fiscal y el último mes, no solo un mes cómodo del medio.
※ Rastrear precedentes (Trace Precedents en la versión en inglés) : un comando de Excel de la pestaña Fórmulas que dibuja flechas desde una celda hasta las celdas que usa su fórmula.
Una fórmula de Excel escrita por IA se prueba con resultados que uno mismo puede calcular
Se cambian los datos de entrada en la copia y se observa qué ocurre. Los modelos de IA propusieron tres casos : un ejemplo sencillo que se pueda resolver de cabeza, un caso de cero o de límite, como ingresos nulos o el primer mes de la previsión, y un caso de tensión, como un aumento del 10 % en las nóminas o cobros que se retrasan 30 días. Una fórmula de descuento con una tasa de cero debe devolver el importe sin descontar. El Estratega de Riesgos y Auditoría, un modelo de Google, añadió una prueba rápida. Si un resultado no se mueve al introducir un dato extremo, probablemente la IA ha escrito un número fijo donde debería haber un vínculo.
Después se compara con un cálculo hecho aparte, con una calculadora o una hoja auxiliar sencilla, y no con otra explicación de una IA. Unidades por precio deben dar los ingresos. Plantilla por coste mensual debe dar las nóminas. Caja inicial más movimiento neto debe dar la caja final en cada periodo.
Por último, hay que buscar los errores que nunca muestran #¡REF!, el aviso que da Excel cuando una referencia está rota. Entre ellos están los números escritos a mano dentro de filas de fórmulas, los totales cuyo rango de SUMA (el bloque de celdas que se suma) termina antes de la última línea, los signos invertidos en las salidas de caja y los vínculos al año pasado en lugar de al mes pasado. El Especialista en Ingeniería de Hojas de Cálculo destacó uno como el más peligroso en los modelos financieros generados por IA : una fórmula envuelta en SI.ERROR para que una rotura real aparezca como un cero bien presentado. Aconsejó buscar en el libro todos los SI.ERROR y justificar cada uno.
※ SI.ERROR (IFERROR en la versión en inglés) : una función de Excel que muestra un valor elegido, a menudo cero o una celda vacía, siempre que la fórmula fuera a mostrar un error.
En lo que puede confiar un consejo es en una lógica probada, no en la seguridad de la IA
El último paso de la rutina de los modelos de IA es cuadrar el modelo completo. Hay que comprobar que la caja final de cada periodo pasa como caja inicial del siguiente, que los totales que deben coincidir coinciden de verdad y que las cifras del informe para el consejo concuerdan con los cuadros de detalle que tienen debajo. El Especialista en Ingeniería de Hojas de Cálculo propuso filas de control permanentes en la parte superior de cada hoja que muestren cero cuando todo cuadra y se pongan en rojo cuando algo se rompe, un control que sigue funcionando el trimestre siguiente aunque nadie esté mirando. Conviene guardar una versión antes de que la IA toque nada, comparar los resultados después y explicar cada cambio importante. Cada cambio se anota en un registro sencillo con la celda, la fórmula anterior y la nueva, el motivo, las pruebas realizadas y quién lo aprobó.
La regla del Especialista resume todo lo demás. Las dos herramientas explican una fórmula equivocada con el mismo tono fluido y seguro que usan para una correcta, así que la seguridad de la IA no cuenta como prueba de nada. El modelo moderador terminó en el mismo punto. La IA puede acelerar la redacción y señalar celdas sospechosas, pero en un modelo del que depende el consejo, lo que da el visto bueno es una lógica de negocio que alguien ha probado y cuadrado. El primer paso práctico que propuso el Especialista fue pedir al revisor elegido que audite un modelo ya aprobado, cuyas respuestas correctas se conocen, para ver qué detecta, qué se le escapa y qué se inventa.








