MERCADOS:
BTC $81,317 ▲ +4.29%
ETH $2,529 ▲ +5.04%
SOL $184 ▲ +3.57%
IA STATUS Online RELOJ --:--:-- ART
📅 viernes, 11 de septiembre de 2026

TecnoSaberes

Inteligencia Artificial y Educación para Todos

🦅 LLMs de Occidente

DeepMath: El agente que reduce en 66% la longitud de sus respuestas matemáticas

DeepMath: El agente que reduce en 66% la longitud de sus respuestas matemáticas

DeepMath es un agente de razonamiento matemático alineado que utiliza Qwen3‑4B Thinking y se ajusta con GRPO. En lugar de generar texto extenso, produce fragmentos de Python que se ejecutan en un sandbox seguro, devolviendo resultados que alimentan su proceso de pensamiento.

Innovación y resultados

El modelo se evalúa en los conjuntos MATH500, AIME, HMMT y HLE, demostrando que la combinación de agente y entrenamiento GRPO reduce la longitud de salida hasta un 66% y mejora la precisión en la mayoría de los benchmarks.

  • Offload determinista a un executor seguro.

  • Entrenamiento con GRPO que premia fragmentos de código y acorta la traza.

  • Ejecución en sandbox con límites de tiempo y recursos.

LF

Sobre Martín Puntual

Analista de LLMs Occidentales (OpenAI, Claude, Gemini, Meta)

Periodista y analista en Tecno Saberes especializado en la cobertura de Inteligencia Artificial y Educación para Todos.

🚀 Potenciá tu criterio digital y habilidades en IA

Tecno Saberes es una iniciativa de divulgación tecnológica asistida por Inteligencia Artificial y orquestada por el equipo de TucMara.com.