Skip to content
Costo real del cómputo AI & Nuevos chips para inferencia - Noticias de IA (25 jul 2026) episode artwork

EPISODE · Jul 25, 2026 · 5 MIN

Costo real del cómputo AI & Nuevos chips para inferencia - Noticias de IA (25 jul 2026)

from The Automated Daily - AI News Edition · host TrendTeller

Por favor, apoya este pódcast visitando a nuestros patrocinadores: - KrispCall: Telefonía en la nube agéntica - https://try.krispcall.com/tad - Invierte como los profesionales con StockMVP - https://www.stock-mvp.com/?via=ron - Diseño con IA sin esfuerzo para presentaciones, sitios web y más con Gamma - https://try.gamma.app/tad Apoya directamente a The Automated Daily: Cómprame un café: https://buymeacoffee.com/theautomateddaily Temas de hoy: Costo real del cómputo AI - El mercado de GPUs parece abundante, pero cuando una empresa necesita varias tarjetas juntas en la misma máquina, la oferta real se reduce mucho. También repasamos el impacto financiero del boom de centros de datos, con palabras clave como GPU, clúster, Oracle e Intel. Nuevos chips para inferencia - AMD, Cerebras y Etched muestran que la batalla ya no es solo por entrenar modelos, sino por ejecutar inferencia con más velocidad y menos consumo. La tendencia clave es infraestructura heterogénea, latencia baja y eficiencia energética. Modelos más eficientes y útiles - Poolside y Kimi K3 apuntan a una idea importante: no siempre hace falta un modelo enorme para lograr mejores resultados. Con mejor post-entrenamiento, más razonamiento y planificación interna, la calidad en código y frontend puede subir bastante. IA abierta y competencia global - DeepSeek, Nvidia y el caso de Huawei reabren el debate sobre modelos abiertos, acceso al cómputo y soberanía tecnológica. Los términos clave aquí son open weights, código abierto, chips Ascend y competencia en IA. Cómo se usa la IA - El nuevo ATLAS de Google sugiere que la IA ya se usa en muchos trabajos, pero todavía como apoyo y no como reemplazo total. Destacan Gemini, adopción laboral, tareas administrativas y brecha digital. Agentes, salud y productividad - OpenAI lleva ChatGPT más cerca de la salud personal, mientras que OpenWorker y la compra de TakeOff por Sierra reflejan el avance de agentes que hacen trabajo concreto. Los temas centrales son privacidad, automatización, escritorio y agentes de larga duración. - CoderPad Webinar Examines How AI Is Changing Hiring - Algolia Releases Ebook on No-Code, AI-Assisted Data Cleaning - Poolside’s Eiso Kant on Building a Model Factory and Open AI - Black Forest Labs Launches FLUX 3 Multimodal AI Model in Early Access - Kimi K3’s Long Reasoning Traces May Explain Its Frontend Lead - Why GPU-Hour Prices Miss the Cost of Real Clusters - DeepSeek Founder Liang Wenfeng Explains the Company’s AGI Strategy - Huawei Report Claims DeepSeek Post-Training on Ascend Chips - Etched Unveils Progress on Frontier AI Inference Hardware - Morgan Stanley Says SpaceX Selloff Leaves AI Value Unpriced - Google Launches ATLAS Study of AI Use in Work and Daily Life - OpenAI Launches Health Feature in ChatGPT for U.S. Users - AMD and Cerebras Partner on Low-Latency AI Inference System - Anthropic Upgrades Claude Voice Mode With Smarter Models and App Access - Cognition Welcomes Poke Maker The Interaction Company - Why Overly Complex AI Coding Workflows Hurt More Than They Help - Runway Launches Media Router for Generative Media Models - Nvidia Calls for Open-Weight AI to Support U.S. Leadership - Andrew Ng Releases OpenWorker, a Local-First AI Coworker - Microsoft Releases New In-House Image and Voice AI Models - Sakana AI Releases Fugu-Ultra v1.1 With Better Benchmark Performance - OpenAI Adds Full-Duplex Voice Control to Codex and ChatGPT Desktop - Intel Posts Strong AI-Driven Revenue Growth but Shares Fall - Oracle layoffs and credit downgrade expose AI spending risks - Sierra Acquires TakeOff to Expand into Long-Horizon AI Agents Transcripcion del Episodio Costo real del cómputo AI Empezamos por la infraestructura, porque ahí está una de las historias más reveladoras del día. Un análisis del mercado de alquiler de GPUs muestra que el precio por hora puede ser engañoso: una cosa es alquilar una sola GPU y otra muy distinta conseguir cuatro u ocho iguales, en la misma máquina y disponibles al mismo tiempo. Para entrenamiento serio o inferencia a escala, esa diferencia cambia todo. En otras palabras, el cómputo no escasea solo por cantidad, sino por topología, fiabilidad y tiempo de disponibilidad. Nuevos chips para inferencia Ese cuello de botella encaja con otra señal del mercado. Oracle está sintiendo el peso financiero del boom de centros de datos tras su enorme apuesta por capacidad para OpenAI, mientras Intel presentó resultados fuertes impulsados por la demanda de infraestructura AI. La lectura conjunta es clara: el negocio sigue creciendo, pero el despliegue de capacidad se está volviendo más caro, más complejo y más riesgoso. La fiebre por la IA no solo consume chips; también tensiona balances, empleo y hasta relaciones con reguladores y redes eléctricas. Modelos más eficientes y útiles En hardware, la carrera también se está fragmentando. AMD y Cerebras anunciaron una alianza para repartir el trabajo de inferencia entre sistemas distintos: uno optimizado para procesar el contexto inicial y otro para generar respuestas con mínima latencia. Etched, por su parte, dice estar validando racks propios para inferencia de frontera. Más allá de cada empresa, lo importante es la tendencia: la infraestructura AI se aleja del modelo único y va hacia diseños especializados para tareas concretas. Ya no se trata solo de tener más potencia, sino de usarla mejor. IA abierta y competencia global Pasando a los modelos, hubo dos señales interesantes sobre eficiencia. Poolside sostiene que su nueva fábrica de modelos puede llevar un sistema desde entrenamiento hasta lanzamiento en pocas semanas, y defiende que modelos más pequeños pueden rendir mucho mejor de lo esperado si se entrenan para insistir, verificar y corregirse. En paralelo, un análisis sobre Kimi K3 sugiere que su ventaja en generación de frontend viene de dedicar muchos más tokens al razonamiento interno y a una especie de planificación previa. El mensaje de fondo es potente: mejorar el proceso y el comportamiento del modelo puede ser tan importante como escalarlo. Cómo se usa la IA También sigue creciendo el debate sobre apertura y competencia. El fundador de DeepSeek volvió a defender una visión muy poco convencional para el sector: menos obsesión por el beneficio inmediato, más investigación a largo plazo y modelos fuertes publicados de forma abierta. Nvidia, desde otro ángulo, publicó un argumento parecido a favor de los open weights, diciendo que son clave para evitar dependencia excesiva y mantener un ecosistema más competitivo. Y en medio de esa discusión apareció un informe liderado por Huawei que asegura haber post-entrenado modelos de DeepSeek con chips Ascend. Es una señal relevante para China, aunque por ahora parece demostrar más capacidad en post-entrenamiento e inferencia que en entrenamiento de frontera completo. Agentes, salud y productividad Sobre uso real de la IA, Google lanzó la primera versión de su proyecto ATLAS, basado en millones de interacciones con Gemini. La conclusión no es que la IA ya esté reemplazando trabajos enteros, sino algo más matizado y probablemente más útil: se está usando mucho, pero en partes concretas del trabajo. Predominan tareas de apoyo como investigación, escritura, coordinación y resolución de dudas. Y no solo en oficinas; también aparece en trabajos técnicos y manuales para diagnóstico o soporte. Eso ayuda a bajar el ruido: la adopción es amplia, pero todavía bastante parcial, y además sigue muy ligada al nivel de riqueza de cada país. Story 7 Cerramos con dos movimientos que apuntan a una IA cada vez más personal y más activa. OpenAI comenzó a desplegar en Estados Unidos una función de salud para ChatGPT que permite conectar datos de Apple Health y algunos historiales médicos, con la idea de dar contexto en conversaciones sobre sueño, actividad, medicación o resultados de laboratorio. Es un paso ambicioso, útil en teoría, pero que eleva mucho la exigencia en privacidad, precisión y criterio clínico. Al mismo tiempo, Andrew Ng presentó OpenWorker, un asistente de escritorio orientado a hacer trabajo práctico con herramientas como Slack, Gmail o GitHub, y Sierra anunció la compra de TakeOff, una apuesta por agentes de tareas largas. La dirección es bastante clara: la IA quiere salir del chat y empezar a ejecutar trabajo real, con más autonomía y también con más responsabilidad. Suscríbete a fuentes específicas por edición: - Space news * Apple Podcast English * Spotify English * RSS English Spanish French - Top news * Apple Podcast English Spanish French * Spotify English Spanish French * RSS English Spanish French - Tech news * Apple Podcast English Spanish French * Spotify English Spanish Spanish * RSS English Spanish French - Hacker news * Apple Podcast English Spanish French * Spotify English Spanish French * RSS English Spanish French - AI news * Apple Podcast English Spanish French * Spotify English Spanish French * RSS English Spanish French Visit our website at https://theautomateddaily.com/ Send feedback to [email protected] Youtube LinkedIn X (Twitter)

Episode metadata supplied by the publisher feed · Published Jul 25, 2026

Embed this episode

Por favor, apoya este pódcast visitando a nuestros patrocinadores: - KrispCall: Telefonía en la nube agéntica - https://try.krispcall.com/tad - Invierte como los profesionales con StockMVP - https://www.stock-mvp.com/?via=ron - Diseño con IA sin esfuerzo para presentaciones, sitios web y más con Gamma - https://try.gamma.app/tad Apoya directamente a The Automated Daily: Cómprame un café: https://buymeacoffee.com/theautomateddaily Temas de hoy: Costo real del cómputo AI - El mercado de GPUs parece abundante, pero cuando una empresa necesita varias tarjetas juntas en la misma máquina, la oferta real se reduce mucho. También repasamos el impacto financiero del boom de centros de datos, con palabras clave como GPU, clúster, Oracle e Intel. Nuevos chips para inferencia - AMD, Cerebras y Etched muestran que la batalla ya no es solo por entrenar modelos, sino por ejecutar inferencia con más velocidad y menos consumo. La tendencia clave es infraestructura heterogénea, latencia baja y eficiencia energética. Modelos más eficientes y útiles - Poolside y Kimi K3 apuntan a una idea importante: no siempre hace falta un modelo enorme para lograr mejores resultados. Con mejor post-entrenamiento, más razonamiento y planificación interna, la calidad en código y frontend puede subir bastante. IA abierta y competencia global - DeepSeek, Nvidia y el caso de Huawei reabren el debate sobre modelos abiertos, acceso al cómputo y soberanía tecnológica. Los términos clave aquí son open weights, código abierto, chips Ascend y competencia en IA. Cómo se usa la IA - El nuevo ATLAS de Google sugiere que la IA ya se usa en muchos trabajos, pero todavía como apoyo y no como reemplazo total. Destacan Gemini, adopción laboral, tareas administrativas y brecha digital. Agentes, salud y productividad - OpenAI lleva ChatGPT más cerca de la salud personal, mientras que OpenWorker y la compra de TakeOff por Sierra reflejan el avance de agentes que hacen trabajo concreto. Los temas centrales son privacidad, automatización, escritorio y agentes de larga duración. - CoderPad Webinar Examines How AI Is Changing Hiring - Algolia Releases Ebook on No-Code, AI-Assisted Data Cleaning - Poolside’s Eiso Kant on Building a Model Factory and Open AI - Black Forest Labs Launches FLUX 3 Multimodal AI Model in Early Access - Kimi K3’s Long Reasoning Traces May Explain Its Frontend Lead - Why GPU-Hour Prices Miss the Cost of Real Clusters - DeepSeek Founder Liang Wenfeng Explains the Company’s AGI Strategy - Huawei Report Claims DeepSeek Post-Training on Ascend Chips - Etched Unveils Progress on Frontier AI Inference Hardware - Morgan Stanley Says SpaceX Selloff Leaves AI Value Unpriced - Google Launches ATLAS Study of AI Use in Work and Daily Life - OpenAI Launches Health Feature in ChatGPT for U.S. Users - AMD and Cerebras Partner on Low-Latency AI Inference System - Anthropic Upgrades Claude Voice Mode With Smarter Models and App Access - Cognition Welcomes Poke Maker The Interaction Company - Why Overly Complex AI Coding Workflows Hurt More Than They Help - Runway Launches Media Router for Generative Media Models - Nvidia Calls for Open-Weight AI to Support U.S. Leadership - Andrew Ng Releases OpenWorker, a Local-First AI Coworker - Microsoft Releases New In-House Image and Voice AI Models - Sakana AI Releases Fugu-Ultra v1.1 With Better Benchmark Performance - OpenAI Adds Full-Duplex Voice Control to Codex and ChatGPT Desktop - Intel Posts Strong AI-Driven Revenue Growth but Shares Fall - Oracle layoffs and credit downgrade expose AI spending risks - Sierra Acquires TakeOff to Expand into Long-Horizon AI Agents Transcripcion del Episodio Costo real del cómputo AI Empezamos por la infraestructura, porque ahí está una de las historias más reveladoras del día. Un análisis del merca...

Distinct summary based on available episode metadata or transcript content.

Ready to play

Costo real del cómputo AI & Nuevos chips para inferencia - Noticias de IA (25 jul 2026)

0:00 5:33

No transcript for this episode yet

We transcribe on demand. Request one and we'll notify you when it's ready — usually under 10 minutes.

No similar episodes found.

No similar podcasts found.

Frequently Asked Questions

How long is this episode of The Automated Daily - AI News Edition?

This episode is 5 minutes long.

When was this The Automated Daily - AI News Edition episode published?

This episode was published on July 25, 2026.

Can I download this The Automated Daily - AI News Edition episode?

Yes. Use the download control on the episode player to save the publisher-provided media file.
URL copied to clipboard!