Aurxo Baseline v1.0 · Evidencia revisada el 27 de julio de 2026

Lo que respalda la evidencia.

Aurxo separa las evaluaciones actuales de productos de las referencias de modelos con alcance definido. Un guion no es una mala nota. Significa que la evidencia no es suficientemente completa o comparable para una etiqueta universal del producto.

Solo Gemini recibe una nota de impacto actual a nivel de producto en esta primera línea base. Las demás filas hacen visibles la evidencia ausente y los estudios de referencia disponibles, en lugar de convertirlos en puntuaciones inventadas del producto.

Evaluaciones actuales de productos

Producto / alcance
Nota
Confianza
Lo que Aurxo puede afirmar responsablemente
Gemini Apps
Petición de texto mediana en producción · mayo de 2025
A
Moderada
Google declara 0,24 Wh, 0,03 gCO₂e y 0,26 mL en toda la infraestructura de servicio. Es un estudio de producción elaborado por el proveedor, no una auditoría de Aurxo.
ChatGPT
Producto actual con enrutamiento
Baja
OpenAI declara la energía y el agua de una consulta media, pero no un valor de carbono comparable del producto actual ni un límite reproducible del producto con enrutamiento. A continuación aparece una referencia histórica de GPT-4o con alcance definido.
Claude
Producto actual con enrutamiento
Insuficiente
Anthropic ofrece amplia información sobre modelos y seguridad, pero Aurxo no encontró métricas completas y actuales de energía, carbono y agua a nivel de producto. A continuación aparece una referencia de Claude 3.7.
Microsoft Copilot
Producto de consumo actual
Insuficiente
Microsoft Research publica evidencia valiosa sobre inferencia a nivel sectorial, incluida una mediana de 0,31 Wh para una distribución optimizada de escala frontera, pero no una huella completa específica de Copilot.
Perplexity
Producto actual
Insuficiente
Aurxo no identificó suficiente evidencia pública comparable a nivel de producto para emitir una nota de impacto en esta revisión.
Le Chat
Respuesta de ciclo de vida de 400 tokens
Moderada
Mistral declara 1,14 gCO₂e y 45 mL bajo un amplio límite de ciclo de vida, pero no un valor energético separado por respuesta. Por ello no se publica la nota global.
DeepSeek
Ruta actual del producto
Insuficiente
Las referencias independientes muestran grandes diferencias entre los escenarios alojados por DeepSeek y los alojados en Azure. Es necesario conocer la ruta actual del producto antes de emitir una nota universal.

Etiquetas de referencia con alcance definido

Solo son válidas para el modelo histórico, el tamaño de petición y los supuestos de despliegue indicados. No son notas universales actuales del producto.

Modelo de referencia / alcance
Etiqueta
Evidencia
Métricas y limitación
GPT-4o · marzo de 2025
100 tokens de entrada / 300 de salida
Referencia de ChatGPT
B
Modelo independiente
0,423 Wh · 0,148 gCO₂e · 1,953 mL. No es telemetría de todas las rutas actuales de ChatGPT.
Claude 3.7 Sonnet
100 tokens de entrada / 300 de salida
Referencia de Claude
C
Modelo independiente
0,950 Wh · 0,273 gCO₂e · 5,005 mL. Referencia histórica del modelo, no telemetría de las rutas actuales de Claude.
DeepSeek V3
Alojado por DeepSeek · 100 de entrada / 300 de salida
D
Modelo independiente
2,777 Wh · 1,666 gCO₂e · 19,33 mL. Una ruta de alojamiento diferente requiere una etiqueta diferente.
DeepSeek R1
Alojado por DeepSeek · 100 de entrada / 300 de salida
E
Modelo independiente
19,251 Wh · 11,551 gCO₂e · 134,004 mL. La profundidad de razonamiento y el despliegue afectan materialmente al resultado.