{"id":91426,"date":"2025-09-09T14:35:59","date_gmt":"2025-09-09T14:35:59","guid":{"rendered":"https:\/\/enfoquenoticioso.com\/?p=91426"},"modified":"2025-09-09T14:35:59","modified_gmt":"2025-09-09T14:35:59","slug":"china-ya-no-se-conforma-con-alejarse-de-nvidia-su-siguiente-paso-es-el-corazon-de-la-ia-con-un-sistema-que-rompe-moldes","status":"publish","type":"post","link":"https:\/\/enfoquenoticioso.com\/?p=91426","title":{"rendered":"China ya no se conforma con alejarse de NVIDIA. Su siguiente paso es el coraz\u00f3n de la IA con un sistema que rompe moldes"},"content":{"rendered":"<div>\n<p>En 2017, el paper \u201c<a rel=\"noopener, noreferrer\" href=\"https:\/\/arxiv.org\/abs\/1706.03762\" target=\"_blank\">Attention Is All You Need<\/a>\u201d de Google cambi\u00f3 la base t\u00e9cnica de la generaci\u00f3n de lenguaje: los <a rel=\"noopener, noreferrer\" href=\"https:\/\/aws.amazon.com\/what-is\/transformers-in-artificial-intelligence\/\" target=\"_blank\">Transformers<\/a> permitieron procesar secuencias largas en paralelo y escalar modelos hasta tama\u00f1os que antes eran inviables. Esa ruta de escalado ha impulsado a arquitecturas como <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/inteligencia-artificial\/gpt-2-que-sabemos-que-no-generador-textos-ia-que-openai-dice-haber-censurado-ser-demasiado-peligroso\" data-vars-post-title=\"GPT-2: qu\u00e9 sabemos y qu\u00e9 no del generador de textos con IA que OpenAI dice haber censurado por ser demasiado peligroso\" data-vars-post-url=\"https:\/\/www.xataka.com\/inteligencia-artificial\/gpt-2-que-sabemos-que-no-generador-textos-ia-que-openai-dice-haber-censurado-ser-demasiado-peligroso\" target=\"_blank\" rel=\"noopener\">GPT<\/a> y <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/servicios\/como-funciona-bert-inteligencia-artificial-que-google-quiere-conseguir-que-su-motor-busqueda-nos-entienda-mejor\" data-vars-post-title=\"C\u00f3mo funciona BERT, la inteligencia artificial con la que Google quiere conseguir que su motor de b\u00fasqueda nos entienda mejor\" data-vars-post-url=\"https:\/\/www.xataka.com\/servicios\/como-funciona-bert-inteligencia-artificial-que-google-quiere-conseguir-que-su-motor-busqueda-nos-entienda-mejor\" target=\"_blank\" rel=\"noopener\">BERT<\/a> y ha convertido la autoatenci\u00f3n en <strong>la pieza central de la IA generativa<\/strong> contempor\u00e1nea.\u00a0<\/p>\n<p>Pero este novedoso enfoque lleg\u00f3 acompa\u00f1ado de costes crecientes en memoria y energ\u00eda cuando el contexto se alarga, una limitaci\u00f3n que ha motivado investigaciones para desarrollar alternativas. SpikingBrain-1.0 apunta a romper moldes.<\/p>\n<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_81 counter-hierarchy ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">Tabla de Contenido<\/p>\n<span class=\"ez-toc-title-toggle\"><a href=\"#\" class=\"ez-toc-pull-right ez-toc-btn ez-toc-btn-xs ez-toc-btn-default ez-toc-toggle\" aria-label=\"Alternar tabla de contenidos\"><span class=\"ez-toc-js-icon-con\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Toggle<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #999;color:#999\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewBox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #999;color:#999\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewBox=\"0 0 24 24\" version=\"1.2\" baseProfile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/span><\/a><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/enfoquenoticioso.com\/?p=91426\/#Del_%E2%80%9CAttention_Is_All_You_Need%E2%80%9D_al_cerebro_la_nueva_apuesta_para_romper_limites_en_IA\" >Del \u201cAttention Is All You Need\u201d al cerebro: la nueva apuesta para romper l\u00edmites en IA<\/a><\/li><\/ul><\/nav><\/div>\n<h2><span class=\"ez-toc-section\" id=\"Del_%E2%80%9CAttention_Is_All_You_Need%E2%80%9D_al_cerebro_la_nueva_apuesta_para_romper_limites_en_IA\"><\/span>Del \u201cAttention Is All You Need\u201d al cerebro: la nueva apuesta para romper l\u00edmites en IA<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Un equipo del Instituto de Automatizaci\u00f3n de la Academia China de Ciencias\u00a0<a rel=\"noopener, noreferrer\" href=\"https:\/\/arxiv.org\/pdf\/2509.05276\" target=\"_blank\">acaba de presentar SpikingBrain-1.0<\/a>. Estamos hablando de una familia de modelos espigados orientada a reducir datos y c\u00f3mputo necesarios para tareas con contextos muy largos. Los expertos proponen dos enfoques: SpikingBrain-7B, de arquitectura lineal enfocada a eficiencia, y SpikingBrain-76B, que combina atenci\u00f3n lineal con mecanismos Mixture of Experts (MoE) de mayor capacidad.<\/p>\n<p><!-- BREAK 1 --> <\/p>\n<p>Los autores detallan que gran parte del desarrollo y las pruebas se llevaron a cabo en cl\u00fasteres de GPU MetaX C550, con bibliotecas y operadores dise\u00f1ados espec\u00edficamente para esa plataforma. Esto convierte el proyecto no solo en un avance prometedor a nivel de software, sino tambi\u00e9n en una demostraci\u00f3n de <strong>capacidades de hardware propio<\/strong>. Un aspecto especialmente relevante si se tiene en cuenta el esfuerzo de China por reducir su dependencia de NVIDIA, <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/robotica-e-ia\/deepseek-acaba-lanzar-algo-que-va-a-amargar-dia-a-nvidia-a-empresas-chips-eeuu-se-llama-deepseek-v3-1\" data-vars-post-title=\"DeepSeek acaba de lanzar algo que va a amargar el d\u00eda a NVIDIA y a las empresas de chips de EEUU: se llama DeepSeek-V3.1\" data-vars-post-url=\"https:\/\/www.xataka.com\/robotica-e-ia\/deepseek-acaba-lanzar-algo-que-va-a-amargar-dia-a-nvidia-a-empresas-chips-eeuu-se-llama-deepseek-v3-1\" target=\"_blank\" rel=\"noopener\">una estrategia que ya vimos reflejada con DeepSeek 3.1<\/a>.<\/p>\n<p><!-- BREAK 2 --><\/p>\n<div class=\"article-asset-image article-asset-normal article-asset-center\">\n<div class=\"asset-content\">\n                   <img class=\"centro_sinmarco\" height=\"2530\" width=\"2378\" loading=\"lazy\" decoding=\"async\" sizes=\"auto, 100vw\" fetchpriority=\"high\" srcset=\"https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/450_1000.jpeg 450w, https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/650_1200.jpeg 681w,https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/1024_2000.jpeg 1024w, https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/1366_2000.jpeg 1366w\" src=\"https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/450_1000.jpeg\" alt=\"China Bandera\"\/><br \/>\n   <img decoding=\"async\" alt=\"China Bandera\" class=\"centro_sinmarco\" src=\"https:\/\/i.blogs.es\/c6a9fb\/china-bandera\/450_1000.jpeg\"\/><\/p><\/div>\n<\/div>\n<p>SpikingBrain-1.0 est\u00e1 inspirado directamente en c\u00f3mo funciona nuestro cerebro. En vez de tener neuronas que siempre est\u00e1n \u201cencendidas\u201d calculando n\u00fameros, usa neuronas espigadas: unidades que van acumulando se\u00f1ales hasta que superan un umbral y disparan un pico (spike). Entre pico y pico no hacen nada, lo que ahorra operaciones y, en teor\u00eda, energ\u00eda. La clave es que no solo importa cu\u00e1ntos picos hay, sino cu\u00e1ndo ocurren: el momento exacto y el orden de esos picos llevan informaci\u00f3n, como pasa en el cerebro.<\/p>\n<p>Para que este dise\u00f1o funcione con el ecosistema actual, el equipo desarroll\u00f3 m\u00e9todos que convierten los bloques de autoatenci\u00f3n tradicionales en versiones lineales, m\u00e1s f\u00e1ciles de integrar en su sistema espigado, y cre\u00f3 una especie de \u201ctiempo virtual\u201d que <strong>simula los procesos temporales <\/strong>sin frenar el rendimiento en GPU. Adem\u00e1s, la versi\u00f3n SpikingBrain-76B incluye Mixture of Experts (MoE), un sistema que \u201cdespierta\u201d solo a ciertos submodelos cuando hacen falta, que tambi\u00e9n hemos visto en <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/basics\/gpt-4o-que-que-se-diferencia-gpt-4\" data-vars-post-title=\"GPT-4o: qu\u00e9 es y en qu\u00e9 se diferencia con GPT-4\" data-vars-post-url=\"https:\/\/www.xataka.com\/basics\/gpt-4o-que-que-se-diferencia-gpt-4\" target=\"_blank\" rel=\"noopener\">GPT-4o<\/a> y <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/robotica-e-ia\/que-hace-gpt-5-funcion-que-estes-dispuesto-a-pagar-esquema-para-entender-nuevo-openai-chatgpt\" data-vars-post-title=\"Qu\u00e9 hace GPT-5 en funci\u00f3n de lo que est\u00e9s dispuesto a pagar: un esquema para entender lo nuevo de OpenAI en ChatGPT\" data-vars-post-url=\"https:\/\/www.xataka.com\/robotica-e-ia\/que-hace-gpt-5-funcion-que-estes-dispuesto-a-pagar-esquema-para-entender-nuevo-openai-chatgpt\" target=\"_blank\" rel=\"noopener\">GPT-5<\/a>.\u00a0<\/p>\n<p><!-- BREAK 3 -->  <\/p>\n<div class=\"article-asset-image article-asset-normal article-asset-center\">\n<div class=\"asset-content\">\n                   <img class=\"centro_sinmarco\" height=\"1532\" width=\"1598\" loading=\"lazy\" decoding=\"async\" sizes=\"auto, 100vw\" fetchpriority=\"high\" srcset=\"https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/450_1000.png 450w, https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/650_1200.png 681w,https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/1024_2000.png 1024w, https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/1366_2000.png 1366w\" src=\"https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/450_1000.png\" alt=\"Arquitectura Modelo Chino 1\"\/><br \/>\n   <img decoding=\"async\" alt=\"Arquitectura Modelo Chino 1\" class=\"centro_sinmarco\" src=\"https:\/\/i.blogs.es\/e06c1d\/arquitectura-modelo-chino-1\/450_1000.png\"\/><\/p><\/div>\n<\/div>\n<p>Los autores sugieren aplicaciones donde la longitud de contexto es determinante: an\u00e1lisis de grandes expedientes jur\u00eddicos, historias cl\u00ednicas completas, secuenciaci\u00f3n de ADN y conjuntos masivos de datos experimentales en f\u00edsica de altas energ\u00edas, entre otros. Ese encaje aparece razonado en el documento: si la arquitectura mantiene eficiencia en contextos de millones de tokens, reducir\u00eda costes y abrir\u00eda posibilidades en dominios hoy limitados por el acceso a infraestructuras de c\u00f3mputo muy caras. Pero queda pendiente la validaci\u00f3n en entornos reales fuera del laboratorio.\u00a0<\/p>\n<p><!-- BREAK 4 --><\/p>\n<div class=\"article-asset article-asset-normal article-asset-center\">\n<div class=\"desvio-container\">\n<div class=\"desvio\">\n<div class=\"desvio-figure js-desvio-figure\">\n    <a href=\"https:\/\/www.xataka.com\/robotica-e-ia\/alianza-asml-mistral-desvela-plan-b-europeo-no-podemos-fabricar-chips-al-controlaremos-como-se-fabrican\" class=\"pivot-outboundlink\" data-vars-post-title=\"La alianza ASML-Mistral desvela el plan B europeo: si no podemos fabricar chips, al menos controlaremos c\u00f3mo se fabrican\" target=\"_blank\" rel=\"noopener\"><br \/>\n     <img loading=\"lazy\" decoding=\"async\" alt=\"La alianza ASML-Mistral desvela el plan B europeo: si no podemos fabricar chips, al menos controlaremos c\u00f3mo se fabrican\" width=\"375\" height=\"142\" src=\"https:\/\/i.blogs.es\/7b69d5\/1366_2000\/375_142.jpeg\"\/><br \/>\n    <\/a>\n   <\/div>\n<\/p><\/div>\n<\/p><\/div>\n<\/div>\n<p>El equipo <a rel=\"noopener, noreferrer\" href=\"https:\/\/github.com\/BICLab\/SpikingBrain-7B\" target=\"_blank\">ha liberado en GitHub el c\u00f3digo de la versi\u00f3n de 7.000 millones de par\u00e1metros<\/a> junto a un informe t\u00e9cnico detallado. <a rel=\"noopener, noreferrer\" href=\"https:\/\/controller-fold-injuries-thick.trycloudflare.com\/\" target=\"_blank\">Tambi\u00e9n ofrece una interfaz web similar a ChatGPT para interactuar con el modelo<\/a>, que seg\u00fan los autores est\u00e1 desplegado \u00edntegramente en hardware nacional. El acceso, sin embargo, <strong>est\u00e1 limitado al chino<\/strong>, lo que complica su uso fuera de ese ecosistema. La propuesta es ambiciosa, pero su verdadero alcance depender\u00e1 de que la comunidad logre reproducir los resultados y realizar comparativas en entornos homog\u00e9neos que eval\u00faen precisi\u00f3n, latencias y consumo energ\u00e9tico en condiciones reales.<\/p>\n<p>Im\u00e1genes | Xataka con Gemini 2.5 | <a rel=\"noopener, noreferrer\" href=\"https:\/\/unsplash.com\/es\/fotos\/una-bandera-china-ondea-alto-en-el-cielo-SI8x3-z-Dck\" target=\"_blank\">aboodi vesakaran<\/a>\u00a0<\/p>\n<p>En Xataka | <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/robotica-e-ia\/openai-cree-haber-descubierto-porque-ias-alucinan-no-saben-decir-no-se\" data-vars-post-title=\"OpenAI cree haber descubierto porqu\u00e9 las IAs alucinan: no saben decir \u201cno lo s\u00e9\u201d \" data-vars-post-url=\"https:\/\/www.xataka.com\/robotica-e-ia\/openai-cree-haber-descubierto-porque-ias-alucinan-no-saben-decir-no-se\" target=\"_blank\" rel=\"noopener\">OpenAI cree haber descubierto porqu\u00e9 las IAs alucinan: no saben decir \u201cno lo s\u00e9\u201d<\/a><\/p>\n<p><!-- BREAK 5 --><\/p><\/div>\n<p><a href=\"https:\/\/www.xataka.com\/robotica-e-ia\/china-no-se-conforma-alejarse-nvidia-su-siguiente-paso-corazon-ia-sistema-que-rompe-moldes\" class=\" target=\" title=\"China ya no se conforma con alejarse de NVIDIA. Su siguiente paso es el coraz\u00f3n de la IA con un sistema que rompe moldes\" target=\"_blank\" rel=\"noopener\">Ver fuente<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>En 2017, el paper \u201cAttention Is All You Need\u201d de Google cambi\u00f3 la base t\u00e9cnica de la generaci\u00f3n de lenguaje: los Transformers permitieron procesar secuencias largas en paralelo y escalar modelos hasta tama\u00f1os que antes eran inviables. Esa ruta de escalado ha impulsado a arquitecturas como GPT y BERT y ha convertido la autoatenci\u00f3n en [&hellip;]<\/p>\n","protected":false},"author":2,"featured_media":91427,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[9],"tags":[],"class_list":["post-91426","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia"],"_links":{"self":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts\/91426","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=91426"}],"version-history":[{"count":0,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts\/91426\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/media\/91427"}],"wp:attachment":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=91426"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=91426"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=91426"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}