Claude Haiku 5.5 llega con precios por tramos y cambios de integración
Anthropic lanzó Haiku 5.5 el 7 de octubre. La tarifa depende del tamaño del prompt y migrar desde Haiku 4.5 exige revisar parámetros y respuestas.
Leer artículo
BLOG / PUNTOES
Aprendizaje, tecnología y personas. Compartimos ideas y noticias para mirar el trabajo con perspectiva y encontrar nuevas formas de hacerlo.

RSS ↗ · 67 artículos
Anthropic lanzó Haiku 5.5 el 7 de octubre. La tarifa depende del tamaño del prompt y migrar desde Haiku 4.5 exige revisar parámetros y respuestas.
Leer artículoLiquid AI libera los pesos de d1-3B y del experimental d1-omni-600M. Explicamos qué decisiones permiten tomar y qué límites revisar antes de integrarlos.
Leer artículoCursor anunció el control remoto de agentes locales desde iOS: el trabajo sigue en el ordenador, que debe permanecer encendido y conectado.
Leer artículoGitHub presenta un clasificador basado en ModernBERT para detectar secretos por su contexto. Qué cambia, qué sigue en vista previa y qué revisar en tu equipo.
Leer artículoAmpliamos la comparativa con Clef, Perplexity, Strands, Tev1, Laya, Kev y otras familias: pesos, modalidades, licencias y límites.
Leer artículoInyectamos fallos reales en procesos locales y comparamos tres estrategias: reintentar, marcar antes y guardar acción y marca juntas.
Leer artículoUn protocolo práctico para calibrar evaluadores automáticos, detectar aprobaciones incorrectas y separar estilo de cumplimiento.
Leer artículoDiseña un primer proyecto pequeño de IA con datos autorizados, casos de prueba y una condición clara para ampliar su uso.
Leer artículoSepara interfaz, lógica, modelo, recuperación y herramientas para cambiar componentes y comprobar efectos sin perder control.
Leer artículoEvita que un RAG recupere documentos sin autorización y comprueba también citas, cachés y registros.
Leer artículoReconoce instrucciones maliciosas dentro de fuentes externas y aplica límites también en código, permisos y herramientas.
Leer artículoAi2 publicó AstaBrief, un modelo de generación de informes del entorno Asta, junto con recursos de modelo y datos.
Leer artículoggml-org anunció soporte de modelos de decisión en llama.cpp server mediante el endpoint /v1/systemone.
Leer artículoPrepara pruebas de resultados, acciones y fallos antes de dar a un agente acceso a tareas reales.
Leer artículoEvalúa si repartir roles entre agentes aporta valor y cómo evitar que varias respuestas repitan el mismo error.
Leer artículoGoogle anunció Gemini 4 Argon para trabajos complejos y describió acceso inicial a organizaciones de defensa cibernética mediante Fairwind.
Leer artículoSepara el contexto de una llamada de la memoria persistente y decide qué guardar, cuándo caduca y cómo corregirlo.
Leer artículoOpenAI presentó dots como agentes proactivos con un entorno de trabajo en la nube, conexiones autorizadas y controles de acciones.
Leer artículoOpenAI registró el lanzamiento de GPT-6.1 Sol para programación y trabajo profesional, con acceso por APIs compatibles.
Leer artículoComprende qué puede incluir una skill, cómo se diferencia de una herramienta y qué revisar antes de utilizar sus instrucciones.
Leer artículoAnthropic anunció Claude Sonnet 5.5 con cambios de integración sobre thinking y herramientas.
Leer artículoHcompany presentó la serie Holo4 para utilizar interfaces gráficas, código, MCP y APIs dentro de tareas de agentes.
Leer artículoIdentifica host, cliente y servidor en MCP y separa la conexión técnica de la autorización para consultar datos y ejecutar herramientas.
Leer artículoDiseña entradas, salidas, errores y permisos de una herramienta antes de conectarla con las decisiones de un agente.
Leer artículoDecide qué pasos deben permanecer fijos y dónde tiene sentido permitir decisiones del modelo en un proceso controlado.
Leer artículoOpenAI registró una corrección de codificación de imágenes que afectaba a GPT-6 Sol y GPT-6 Luna en tareas visuales de la API y Codex.
Leer artículoComprende qué decisiones puede tomar un agente, qué herramientas necesita y cómo definir sus permisos y criterios de parada.
Leer artículoLiquidAI publicó un modelo auxiliar experimental DSpark para LFM2.5-VL.
Leer artículoSepara recuperación, fidelidad y utilidad para detectar dónde falla un RAG y evaluar también preguntas sin respuesta.
Leer artículoCursor anunció Rollouts y Security Review para planes Teams y Enterprise.
Leer artículoGoogle anunció el comienzo del despliegue de nuevas aplicaciones conectadas en Gemini, incluyendo herramientas de productividad y creación.
Leer artículoCombina recuperación textual y vectorial, y decide con pruebas si reordenar candidatos aporta calidad suficiente para su coste.
Leer artículoLa API anunció herramientas inline en beta, que permiten incorporar definiciones o referencias dentro de una conversación.
Leer artículoAnthropic anunció Claude Opus 5.5 y cambios de integración relativos a thinking, elección de herramientas y computer use.
Leer artículoGoogle anunció disponibilidad general de Gemini 3.8 Flash TTS y Flash-Lite TTS, junto con un endpoint de voces y opciones de diseño y replicación de voz.
Leer artículoOpenAI registró el lanzamiento de GPT-6 Sol y GPT-6 Luna, modelos de razonamiento con entrada de texto e imagen y salida de texto en APIs compatibles.
Leer artículoEl equipo de Transformers publicó soporte para ejecutar modelos GGUF mediante sus interfaces y reutilización de kernels ggml.
Leer artículoDivide documentos en fragmentos útiles conservando reglas, excepciones, origen y permisos, y comprueba el resultado con preguntas reales.
Leer artículoEl equipo publicó el rediseño y las evaluaciones del candidato a Tokenizers v1, centrado en rendimiento y escalado del procesamiento de texto.
Leer artículoUna introducción a la generación aumentada con recuperación: indexación, documentos relevantes, contexto y respuesta con evidencia.
Leer artículoAprende cuándo buscar por intención y cuándo conservar coincidencias exactas, sin confundir similitud con verdad.
Leer artículoEntiende qué representa un embedding y qué necesitas para comparar consultas y documentos dentro de un espacio compatible.
Leer artículoGoogle comunicó que el acceso a los modelos 2.5 quedaba limitado a usuarios que ya los habían usado.
Leer artículoCompara modelos con criterios de calidad, latencia y coste por tarea completada, utilizando casos representativos de tu proyecto.
Leer artículoGoogle anunció antigravity-preview-09-2026 como sustituto de la versión 05-2026.
Leer artículoComprueba estructura, datos originales y permisos antes de usar una salida JSON del modelo para realizar una acción.
Leer artículoLos ejemplos en el contexto pueden orientar formato y criterio. Aprende a usarlos y a reservar casos independientes para evaluarlos.
Leer artículoGoogle anunció disponibilidad general de Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking para aplicaciones de voz en tiempo real.
Leer artículoOpenAI añadió controles organizativos y de proyecto para permitir determinados tipos de claves o impedir nuevas creaciones.
Leer artículoDefine objetivo, contexto, formato y límites para escribir instrucciones claras que puedas comprobar con casos concretos.
Leer artículoLa Messages API anunció compactación bajo demanda en beta: el cliente decide cuándo solicitar un bloque resumido y reutilizarlo en peticiones posteriores.
Leer artículoIdentifica datos inventados en una respuesta convincente y prepara una revisión basada en documentos y fuentes verificables.
Leer artículoAprende a repartir instrucciones, historial, documentos y respuesta dentro del presupuesto de contexto de un modelo.
Leer artículoComprende qué modifica la temperatura al generar texto y cómo evaluar sus efectos sin confundir diversidad con exactitud.
Leer artículoUna explicación sencilla de la atención y los bloques de un Transformer, con un ejemplo de ambigüedad y los límites del esquema.
Leer artículoCursor anunció Projects en beta, con coordinación de trabajo, contexto compartido y ejecución apoyada en agentes de nube.
Leer artículoOpenAI anunció la beta pública de Agents API, con gestión de sesiones, coordinación del contexto y recuperación de ejecución.
Leer artículoOpenAI añadió fechas de caducidad al crear claves de API de proyectos y límites de duración configurables por administradores.
Leer artículoOpenAI anunció disponibilidad general de GPT-Live 1 para conversaciones de voz full-duplex.
Leer artículoDistingue ajustar los parámetros de un modelo de utilizarlo para responder. Contexto, recuperación y entrenamiento tienen funciones diferentes.
Leer artículoLas notas indicaron que una petición debía incluir el objeto diagnostics para guardar su huella de diagnóstico; enviar solo el encabezado beta seguía aceptado, pero no guardaba esa huella.
Leer artículoDescubre cómo se convierte el texto en tokens, por qué no equivalen siempre a palabras y cómo influye el tokenizador de cada modelo.
Leer artículoEl changelog registra la disponibilidad general de Prompt Cache Diagnostics en la Responses API.
Leer artículoOpenAI anunció los modelos GPT Image 2.5 Sunburst y Flare para generación y edición mediante sus APIs de imágenes.
Leer artículoUn modelo de lenguaje genera texto a partir del contexto. Aprende cómo funciona un LLM y por qué una respuesta fluida necesita comprobación.
Leer artículoEntiende qué tareas puede resolver la IA y cómo distinguir clasificación, predicción y generación antes de elegir una herramienta.
Leer artículoOpenAI publicó el informe Research acceleration: The view inside OpenAI.
Leer artículoNo hay artículos con este tema todavía.
Guías, noticias y ejemplos para seguir una pregunta de principio a fin.
Ver el archivo histórico de 2017 y 2018 ↗
DEL CONOCIMIENTO A LA PRÁCTICA