{"id":92678,"date":"2025-09-15T08:06:08","date_gmt":"2025-09-15T08:06:08","guid":{"rendered":"https:\/\/enfoquenoticioso.com\/?p=92678"},"modified":"2025-09-15T08:06:08","modified_gmt":"2025-09-15T08:06:08","slug":"alibaba-acaba-de-demostrar-que-openai-se-gasta-78-millones-en-hacer-lo-mismo-que-ellos-por-500-000-dolares","status":"publish","type":"post","link":"https:\/\/enfoquenoticioso.com\/?p=92678","title":{"rendered":"Alibaba acaba de demostrar que OpenAI se gasta 78 millones en hacer lo mismo que ellos por 500.000 d\u00f3lares"},"content":{"rendered":"<div>\n<p>Hay una nueva t\u00e9cnica estrella para entrenar modelos de IA de forma s\u00faper eficiente. Es al menos lo que parece haber demostrado Alibaba, que el viernes <a rel=\"noopener, noreferrer\" href=\"https:\/\/x.com\/AlibabaGroup\/status\/1966350879755481544\">present\u00f3<\/a> su familia de modelos Qwen3-Next y lo hizo presumiendo de una eficiencia espectacular que <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/robotica-e-ia\/conocemos-secreto-extrema-eficiencia-deepseek-ha-esquivado-estandar-cuda-nvidia\" data-vars-post-title=\"Ya conocemos el secreto de la extrema eficiencia de DeepSeek: ha esquivado el est\u00e1ndar CUDA de NVIDIA\" data-vars-post-url=\"https:\/\/www.xataka.com\/robotica-e-ia\/conocemos-secreto-extrema-eficiencia-deepseek-ha-esquivado-estandar-cuda-nvidia\" target=\"_blank\" rel=\"noopener\">incluso<\/a> deja atr\u00e1s a la que logr\u00f3 <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/basics\/deepseek-que-como-funciona-que-opciones-tiene-esta-inteligencia-artificial\" data-vars-post-title=\"DeepSeek: qu\u00e9 es, c\u00f3mo funciona y qu\u00e9 opciones tiene esta inteligencia artificial\" data-vars-post-url=\"https:\/\/www.xataka.com\/basics\/deepseek-que-como-funciona-que-opciones-tiene-esta-inteligencia-artificial\" target=\"_blank\" rel=\"noopener\">DeepSeek R1<\/a>.\u00a0<\/p>\n<p><strong>Qu\u00e9 ha pasado<\/strong>. Alibaba Cloud, la divisi\u00f3n de infraestructura en la nube del grupo Alibaba, present\u00f3 el viernes una nueva generaci\u00f3n de LLMs que <a rel=\"noopener, noreferrer\" href=\"https:\/\/x.com\/Alibaba_Qwen\/status\/1966197643904000262\">calific\u00f3<\/a> como \u00abel futuro de los LLMs eficientes\u00bb. Seg\u00fan sus responsables, estos nuevos modelos son 13 veces m\u00e1s peque\u00f1os que el modelo m\u00e1s grande que ha lanzado esa empresa, y que se present\u00f3 justo una semana antes. Puedes probar Qwen3-Next <a rel=\"noopener, noreferrer\" href=\"https:\/\/chat.qwen.ai\/\" target=\"_blank\">en la web de Alibaba<\/a> (recuerda elegirlo del men\u00fa desplegable, en la parte superior izquierda).\u00a0<\/p>\n<p><!-- BREAK 1 --> <\/p>\n<div class=\"article-asset article-asset-normal article-asset-center\">\n<div class=\"desvio-container\">\n<div class=\"desvio\">\n<div class=\"desvio-figure js-desvio-figure\">\n    <a href=\"https:\/\/www.xataka.com\/robotica-e-ia\/deepseek-hace-modelos-avanzados-openai-mucho-recursos-clave-reinforcement-learning\" class=\"pivot-outboundlink\" data-vars-post-title=\"DeepSeek hace lo mismo que los modelos m\u00e1s avanzados de OpenAI con mucho menos recursos. La clave: &quot;reinforcement learning&quot; \" target=\"_blank\" rel=\"noopener\"><br \/>\n     <img loading=\"lazy\" decoding=\"async\" alt=\"DeepSeek hace lo mismo que los modelos m\u00e1s avanzados de OpenAI con mucho menos recursos. La clave: &quot;reinforcement learning&quot; \" width=\"375\" height=\"142\" src=\"https:\/\/i.blogs.es\/6f946b\/deepseek-1\/375_142.jpeg\"\/><br \/>\n    <\/a>\n   <\/div>\n<\/p><\/div>\n<\/p><\/div>\n<\/div>\n<p><strong>Qwen3-Next<\/strong>. As\u00ed se llaman los modelos de esta familia, entre los que destaca especialmente <a rel=\"noopener, noreferrer\" href=\"https:\/\/huggingface.co\/Qwen\/Qwen3-Next-80B-A3B-Thinking\" target=\"_blank\">Qwen3-Next-80B-A3B<\/a>, que seg\u00fan los desarrolladores es hasta 10 veces m\u00e1s r\u00e1pido que el modelo Qwen3-32B que se lanz\u00f3 en el mes de abril. Lo realmente destacable es que adem\u00e1s logra ser mucho m\u00e1s r\u00e1pido con una reducci\u00f3n del 90% en los costes de entrenamiento.<\/p>\n<p><strong>500.000 d\u00f3lares no es nada<\/strong>. <a rel=\"noopener, noreferrer\" href=\"https:\/\/hai.stanford.edu\/assets\/files\/hai_ai-index-report-2024-smaller2.pdf\" target=\"_blank\">Seg\u00fan el AI Index Report<\/a> de la Universidad de Stanford, para entrenar GPT-4 OpenAI invirti\u00f3 78 millones de d\u00f3lares en c\u00f3mputo. Google se gast\u00f3 a\u00fan m\u00e1s en Gemini Ultra, y seg\u00fan ese estudio la cifra ascendi\u00f3 a 191 millones de d\u00f3lares. Se estima que Qwen3-Next solo ha costado 500.000 d\u00f3lares en esa fase de entrenamiento.<\/p>\n<p><!-- BREAK 2 --><\/p>\n<div class=\"article-asset-image article-asset-normal article-asset-center\">\n<div class=\"asset-content\">\n                   <img class=\"centro_sinmarco\" height=\"684\" width=\"1000\" loading=\"lazy\" decoding=\"async\" sizes=\"auto, 100vw\" fetchpriority=\"high\" srcset=\"https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/450_1000.jpeg 450w, https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/650_1200.jpeg 681w,https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/1024_2000.jpeg 1024w, https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/1366_2000.jpeg 1366w\" src=\"https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/450_1000.jpeg\" alt=\"Captura De Pantalla 2025 09 15 A Las 9 07 38\"\/><br \/>\n   <img decoding=\"async\" alt=\"Captura De Pantalla 2025 09 15 A Las 9 07 38\" class=\"centro_sinmarco\" src=\"https:\/\/i.blogs.es\/a5e214\/captura-de-pantalla-2025-09-15-a-las-9.07.38\/450_1000.jpeg\"\/><\/p><\/div>\n<\/div>\n<p><strong>Mejor que sus competidores<\/strong>. Seg\u00fan los <a rel=\"noopener, noreferrer\" href=\"https:\/\/artificialanalysis.ai\/models\/qwen3-next-80b-a3b-reasoning\" target=\"_blank\">benchmarks realizados<\/a> por la firma Artificial Analysis, Qwen3-Next-80B-A3B ha logrado superar tanto a la \u00faltima versi\u00f3n de DeepSeek R1 como a Kimi-K2. El nuevo modelo de razonamiento de Alibaba\u00a0no es el mejor en t\u00e9rminos globales \u2014GPT-5, Grok 4, Gemini 2.5 Pro \u00a0Claude 4.1 Opus lo superan\u2014 pero aun as\u00ed logra un rendimiento sobresaliente teniendo en cuenta su coste de entrenamiento. \u00bfC\u00f3mo lo ha hecho?<\/p>\n<p><!-- BREAK 3 -->  <\/p>\n<p><strong>Mixture of Experts<\/strong>. Estos modelos <a rel=\"noopener, noreferrer\" href=\"https:\/\/www.scmp.com\/tech\/big-tech\/article\/3325436\/how-alibaba-builds-its-most-efficient-ai-model-date?module=top_story&amp;pgtype=section\" target=\"_blank\">hacen uso<\/a> de la arquitectura Mixture of Experts (MoE). Con ella se \u00abdivide\u00bb el modelo en una especie de subredes neuronales que son los \u00abexpertos\u00bb especializados en subconjuntos de datos. Alibaba en este caso aument\u00f3 el n\u00famero de \u00abexpertos\u00bb: mientras que DeepSeek-V3 y Kimi-K2 hacen uso de 256 y 384 expertos, Qwen3-Next-80B-A3B hace uso de 512 expertos, pero solo activa 10 al mismo tiempo.<\/p>\n<p><!-- BREAK 4 --><\/p>\n<p><strong>Atenci\u00f3n h\u00edbrida<\/strong>. la clave de esa eficiencia <a rel=\"noopener, noreferrer\" href=\"https:\/\/qwen.ai\/blog?id=4074cca80393150c248e508aa62983f9cb7d27cd&amp;from=research.latest-advancements-list\" target=\"_blank\">est\u00e1 en la llamada atenci\u00f3n h\u00edbrida<\/a>. Los modelos actuales suelen ver reducida su eficiencia si la longitud de las entradas es muy larga y tienen que \u00abprestar m\u00e1s atenci\u00f3n\u00bb y eso implica m\u00e1s c\u00f3mputo. En Qwen3-Next-80B-A3B se hace uso de una t\u00e9cnica llamada \u00abGated DeltaNet\u00bb que <a rel=\"noopener, noreferrer\" href=\"https:\/\/arxiv.org\/pdf\/2412.06464\" target=\"_blank\">desarrollaron y compartieron<\/a> el MIT y NVIDIA en marzo.<\/p>\n<p><strong>Gated DeltaNet<\/strong>. Esta t\u00e9cnica mejora la forma en la que presta atenci\u00f3n los modelos al realizar ciertos ajustes a los datos de entrada. La t\u00e9cnica determina qu\u00e9 informaci\u00f3n retener y cu\u00e1l se puede descartar. Eso permite crear un mecanismo de atenci\u00f3n preciso y s\u00faper eficiente en coste. De hecho, Qwen3-Next-80B-A3B es comparable al modelo m\u00e1s potente de Alibaba, Qwern3-235B-A22B-Thinking-2507.\u00a0<\/p>\n<p><!-- BREAK 5 --><\/p>\n<div class=\"article-asset article-asset-normal article-asset-center\">\n<div class=\"desvio-container\">\n<div class=\"desvio\">\n<div class=\"desvio-figure js-desvio-figure\">\n    <a href=\"https:\/\/www.xataka.com\/robotica-e-ia\/extrano-caso-ia-menguante-como-modelos-diminutos-le-estan-sacando-colores-a-mastodontes-ia\" class=\"pivot-outboundlink\" data-vars-post-title=\"Las tecnol\u00f3gicas se est\u00e1n derrochando una fortuna en grandes modelos IA. Los m\u00e1s peque\u00f1os les est\u00e1n ganando la partida\" target=\"_blank\" rel=\"noopener\"><br \/>\n     <img loading=\"lazy\" decoding=\"async\" alt=\"Las tecnol\u00f3gicas se est\u00e1n derrochando una fortuna en grandes modelos IA. Los m\u00e1s peque\u00f1os les est\u00e1n ganando la partida\" width=\"375\" height=\"142\" src=\"https:\/\/i.blogs.es\/3ca6fb\/gemini\/375_142.jpeg\"\/><br \/>\n    <\/a>\n   <\/div>\n<\/p><\/div>\n<\/p><\/div>\n<\/div>\n<p><strong>Modelos eficientes y peque\u00f1os<\/strong>. Los crecientes costes de entrenar nuevos modelos de IA empiezan a ser preocupantes, y eso ha hecho que cada vez m\u00e1s vamos esfuerzos para crear modelos de lenguaje \u00abpeque\u00f1os\u00bb que sean m\u00e1s baratos de entrenar, est\u00e9n m\u00e1s especializados y sean especialmente eficientes. El mes pasado Tencent present\u00f3 modelos por debajo de los 7.000 millones de par\u00e1metros, y otra startup llamada Z.ai public\u00f3 su modelo GLM-4.5 Air con tan solo 12.000 millones de par\u00e1metros activos. Mientras, los grandes modelos como GPT-5 o Claude usan muchos m\u00e1s par\u00e1metros, lo que hace que el c\u00f3mputo necesario para usarlos sea mucho mayor.\u00a0<\/p>\n<p>En Xataka | <a class=\"text-outboundlink\" href=\"https:\/\/www.xataka.com\/robotica-e-ia\/pregunta-cual-grandes-tecnologicas-esta-ganando-carrera-ia-respuesta-ninguna\" data-vars-post-title=\"Si la pregunta es cu\u00e1l de las grandes tecnol\u00f3gicas est\u00e1 ganando la carrera de la IA, la respuesta es: ninguna\" data-vars-post-url=\"https:\/\/www.xataka.com\/robotica-e-ia\/pregunta-cual-grandes-tecnologicas-esta-ganando-carrera-ia-respuesta-ninguna\" target=\"_blank\" rel=\"noopener\">Si la pregunta es cu\u00e1l de las grandes tecnol\u00f3gicas est\u00e1 ganando la carrera de la IA, la respuesta es: ninguna<\/a><\/p>\n<p><!-- BREAK 6 --> <\/p><\/div>\n<p><a href=\"https:\/\/www.xataka.com\/robotica-e-ia\/alibaba-acaba-demostrar-que-openai-se-gasta-78-millones-hacer-ellos-500-000-dolares\" class=\" target=\" title=\"Alibaba acaba de demostrar que OpenAI se gasta 78 millones en hacer lo mismo que ellos por 500.000 d\u00f3lares\" target=\"_blank\" rel=\"noopener\">Ver fuente<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Hay una nueva t\u00e9cnica estrella para entrenar modelos de IA de forma s\u00faper eficiente. Es al menos lo que parece haber demostrado Alibaba, que el viernes present\u00f3 su familia de modelos Qwen3-Next y lo hizo presumiendo de una eficiencia espectacular que incluso deja atr\u00e1s a la que logr\u00f3 DeepSeek R1.\u00a0 Qu\u00e9 ha pasado. Alibaba Cloud, [&hellip;]<\/p>\n","protected":false},"author":2,"featured_media":92679,"comment_status":"open","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[9],"tags":[],"class_list":["post-92678","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia"],"_links":{"self":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts\/92678","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcomments&post=92678"}],"version-history":[{"count":0,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/posts\/92678\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=\/wp\/v2\/media\/92679"}],"wp:attachment":[{"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fmedia&parent=92678"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Fcategories&post=92678"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/enfoquenoticioso.com\/index.php?rest_route=%2Fwp%2Fv2%2Ftags&post=92678"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}