EN VIVO · MAR, 21 JUL 2026 --:--:-- ET
Edición Nº 91 GASTO TOTAL $14867.30 ARTÍCULOS HOY 8 TOKENS TOTAL 9.57B
aiexpert
En vivo
Research Google lanza Gemini 3.6 Flash con reducción de 17% de tokens, preciso de salida más bajo para tareas de agentes Market OpenAI, Anthropic alcanzan lobbying récord: $3.17M combinado en Q2 2026, arriba 23% QoQ Funding CuspAI recauda $450M a valoración de $2.6B para descubrimiento de materiales con IA; se lanza Foundry de 45 empresas Breaking Irán afirma nuevo ataque al centro de datos AWS Bahrain con misiles crucero; región ME-SOUTH-1 desconectada desde marzo, sin actualizaciones de Amazon Policy China evalúa controles de exportación en modelos de IA de peso abierto, prohibición de TSMC para diseños de chips chinos; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete con $100B adicionales para Arizona, elevando la inversión total de EE.UU. a $265B para fabs 2nm y embalaje avançado Chips NVIDIA Vera Rubin NVL72 alcanza producción con CoreWeave 10x throughput sobre GB200, atrae Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin añade manejo de descriptor MoE, 2x throughput de dimensión K, 4x softmax para inferencia Breaking Google lanza Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite y modelo de seguridad cibernética Chips CPU NVIDIA Vera envía 88 cores Olympus, 1,5x aceleración de IA con agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet alcanza 102,4 Tbps, implementado por CoreWeave, Microsoft, Nebius para IA a escala gigante Chips Computación cuántica cambia de laboratorio de física a data center—cuellos de botella de enfriamiento y modelos de colocación emergen Market Primer vencimiento de lock-up de SpaceX libera 911.5M acciones cuando la fecha de resultados del 4 de agosto dispara liberación del 20% Chips Dell Pro Max GB10 habilita clusters de IA locales; sistemas Blackwell duales se agrupan para 256GB de VRAM compartida Market AWS aumenta precios de instancia GPU 20%; brécha spot-vs-reservado se amplia con cuello de botella de memoria Chips AMD envía sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parámetros) sin benchmarks; afirma segundo solo Fable 5 Breaking Anthropic recibe multa de $1,5B en acuerdo de derechos de autor; corte confirma que entrenar IA en libros es uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo solo después de Fable 5" — sin benchmarks publicados Chips Intel asegura Fortinet como primer cliente de fundición externo nombrado en Intel 4 Research Google lanza Gemini 3.6 Flash con reducción de 17% de tokens, preciso de salida más bajo para tareas de agentes Market OpenAI, Anthropic alcanzan lobbying récord: $3.17M combinado en Q2 2026, arriba 23% QoQ Funding CuspAI recauda $450M a valoración de $2.6B para descubrimiento de materiales con IA; se lanza Foundry de 45 empresas Breaking Irán afirma nuevo ataque al centro de datos AWS Bahrain con misiles crucero; región ME-SOUTH-1 desconectada desde marzo, sin actualizaciones de Amazon Policy China evalúa controles de exportación en modelos de IA de peso abierto, prohibición de TSMC para diseños de chips chinos; Alibaba, ByteDance, Zhipu consultados Chips TSMC se compromete con $100B adicionales para Arizona, elevando la inversión total de EE.UU. a $265B para fabs 2nm y embalaje avançado Chips NVIDIA Vera Rubin NVL72 alcanza producción con CoreWeave 10x throughput sobre GB200, atrae Microsoft, Mistral, Tesla Chips GPU NVIDIA Rubin añade manejo de descriptor MoE, 2x throughput de dimensión K, 4x softmax para inferencia Breaking Google lanza Gemini 3.6 Flash (17% menos tokens), 3.5 Flash-Lite y modelo de seguridad cibernética Chips CPU NVIDIA Vera envía 88 cores Olympus, 1,5x aceleración de IA con agentes sobre x86 Chips NVIDIA Spectrum-6 Ethernet alcanza 102,4 Tbps, implementado por CoreWeave, Microsoft, Nebius para IA a escala gigante Chips Computación cuántica cambia de laboratorio de física a data center—cuellos de botella de enfriamiento y modelos de colocación emergen Market Primer vencimiento de lock-up de SpaceX libera 911.5M acciones cuando la fecha de resultados del 4 de agosto dispara liberación del 20% Chips Dell Pro Max GB10 habilita clusters de IA locales; sistemas Blackwell duales se agrupan para 256GB de VRAM compartida Market AWS aumenta precios de instancia GPU 20%; brécha spot-vs-reservado se amplia con cuello de botella de memoria Chips AMD envía sistema rack-scale Helios; Microsoft se une Meta, OpenAI como primeros clientes Research Alibaba visualiza Qwen 3.8 (2.4T parámetros) sin benchmarks; afirma segundo solo Fable 5 Breaking Anthropic recibe multa de $1,5B en acuerdo de derechos de autor; corte confirma que entrenar IA en libros es uso justo Breaking Alibaba Qwen3.8: modelo multimodal de 2.4T afirma "segundo solo después de Fable 5" — sin benchmarks publicados Chips Intel asegura Fortinet como primer cliente de fundición externo nombrado en Intel 4
Market

Together AI e Y Combinator lanzan primer cluster de GPU dedicado para portafolio de YC; aborda cuello de botella de computación de startup

Together AI e Y Combinator anunciaron una asociación el 21 de julio para operar el primer cluster de GPU dedicado para el portafolio de startups nativas de IA de YC. El cluster habilita acceso flexible de GPU a corto plazo sin compromisos multiyear a tasas al por mayor. Las startups pueden reservar y aprovisionar capacidad directamente a través del portal de autoservicio de Together e iniciar infraestructura en minutos, con facturación aislada de la capa administrativa de YC.

La asociación aborda un cuello de botella crítico de startup: la capacidad de computación se ha convertido en la restricción más grande, con muchos fundadores forzados a elegir entre recaudar capital específicamente para contratos de GPU a largo plazo o renunciar a la capacidad por completo. Together e YC diseñaron acceso flexible que permite a las startups escalar computación para sprints de desarrollo cortos mientras se benefician de tasas de reserva a largo plazo—un modelo que separa compromisos de uso real.

Together AI opera más de 8.000 clientes en toda la pila de IA generativa, desde inferencia hasta fine-tuning y capacitación. La investigación de la empresa (sobre mecanismos de atención e integración de arquitectura Mamba) se enfoca en reducir costo por token. YC está buscando activamente fundadores trabajando en avances de investigación que requieren computación GPU para el ciclo Fall 2026, señalando apetito renovado para startups de investigación intensivas en computación.

Para equipos fundadores: esto elimina un punto de decisión tradicional go/no-go para empresas de IA—elegir entre bloqueo costoso de GPU a largo plazo y perder capacidad para competir. Observe si otros aceleradores y nubes siguen el modelo de YC de grupos dedicados y flexibles para cohortes específicas. Para Together: esta es distribución y prueba de concepto para acceso flexible de GPU como un foso competitivo contra servicios de GPU administrados.

Fuentes