API & product launches
media TLDR AI · hace 22 h · 15 vistas

Anthropic lanza Claude Projects v2; Google presenta un agente familiar

Anthropic ha lanzado Claude Projects v2, rediseñando la función desde una estructura basada en carpetas a una interfaz impulsada por conversaciones que gestiona compilaciones mediante delegación de tareas e hilos paralelos. Simultáneamente, Google está probando un agente familiar que opera en una computadora en la nube dedicada para coordinar actividades para hasta seis miembros del hogar.

lab xAI News · hace 1 d · 19 vistas

SpaceXAI utiliza Grok Bot para gestionar un aumento del 175% en tickets sin contratar

SpaceXAI integró su agente de IA Grok Bot en su operación combinada de atención al cliente tras la adquisición de Cursor, permitiendo al equipo gestionar un aumento del 175% en tickets de soporte sin añadir personal. La empresa evitó contratar aproximadamente a 200 empleados adicionales y redujo los costos de resolución entre $0.20 y $0.30 por ticket aprovechando el modelo de precios basado en el uso de Grok Bot.

lab OpenAI News · hace 1 d · 27 vistas

OpenAI mejora el almacenamiento en caché de prompts de GPT-6 con mayores tasas de acierto y diagnósticos

OpenAI ha lanzado un sistema mejorado de almacenamiento en caché de prompts para la familia GPT-6 que ofrece tasas de acierto de caché más altas por defecto y proporciona descuentos de hasta el 90% en los tokens de entrada almacenados en caché. La actualización introduce nuevas herramientas para ayudar a los desarrolladores a monitorizar el rendimiento, diagnosticar fallos de caché y optimizar sus integraciones.

lab OpenAI News · hace 1 d DeepSWE · 68.8% · 22 vistas

OpenAI lanza GPT-6 Sol y Luna con menor costo y mejor almacenamiento en caché

OpenAI ha presentado dos nuevos modelos, GPT-6 Sol y GPT-6 Luna, diseñados para distribuir los beneficios de la inteligencia de vanguardia mediante una mayor eficiencia de costos. Estos modelos utilizan métodos de entrenamiento similares a los de GPT-6 Astra, pero se centran en ofrecer un rendimiento más rápido y asequible para tareas y aplicaciones cotidianas.

media MarkTechPost · hace 2 d GDPval-AA (Elo) · 1695.0Elo · 13 vistas

SpaceXAI lanza Grok 4.7 con un modelo base más grande y mejores resultados en benchmarks

SpaceXAI ha lanzado Grok 4.7, un nuevo modelo insignia para codificación, tareas agénticas y trabajo de conocimiento que utiliza un modelo base más grande y una ejecución de aprendizaje por refuerzo extendida en comparación con Grok 4.6. El modelo mantiene la misma estructura de precios que su predecesor mientras ofrece capacidades mejoradas en autoverificación, manejo de contexto largo y seguridad.

media Together AI Blog · hace 2 d · 12 vistas

Together AI introduce despliegues Canary para actualizar modelos en producción sin tiempo de inactividad

Together AI ha introducido los despliegues Canary, una función que migra el tráfico en vivo desde un modelo actual a un nuevo punto de control en pasos con compuerta. Este sistema automatiza el mecanismo de seguridad para intercambiar modelos ejecutando comprobaciones de salud y compuertas de métricas opcionales antes de mover el tráfico, lo que permite pausas y reversiones automáticas si el rendimiento se degrada.

media MarkTechPost · hace 3 d DeepSWE · 67.7% · 18 vistas

StepFun lanza la versión preliminar de Step 5, un modelo MoE de 600B con contexto de 1M para trabajo agente

StepFun ha lanzado Step 5 Preview, su nuevo modelo insignia disperso de Mezcla de Expertos (MoE) diseñado para ingeniería de software, trabajo de conocimiento profesional y finanzas. El modelo cuenta con 600 mil millones de parámetros totales con 27 mil millones activos por token, una ventana de contexto de 1M tokens y soporte para entrada de texto, imagen y video.

media MarkTechPost · hace 4 d · 21 vistas

El equipo de Alibaba Qwen lanza Qwen3.8-LiveTranslate con arquitectura Interleave

El equipo de Alibaba Qwen ha lanzado Qwen3.8-LiveTranslate, un modelo de interpretación simultánea en tiempo real de nueva generación que escucha el habla en vivo y devuelve texto y audio traducidos mientras el hablante aún está hablando. El lanzamiento introduce una nueva arquitectura Interleave diseñada para reducir la latencia y mejorar la calidad de la traducción.