Introducción
Informes confiables publicados por el diario Financial Times el viernes pasado, citando a fuentes informadas y expertos técnicos de la industria, indicaron que la empresa tecnológica china ByteDance está entrenando actualmente y en secreto un modelo de inteligencia artificial masivo y altamente avanzado que contiene hasta 10 billones de parámetros de programación. Esta enorme escala de entrenamiento representa un paso audaz y sin precedentes que podría acercar muy pronto a este nuevo modelo, en términos de sus capacidades generativas y eficiencia analítica, al sistema más avanzado y complejo Mythos desarrollado por la empresa estadounidense Anthropic, líder en este campo. Este ambicioso proyecto tecnológico se encuentra actualmente en la fase intensiva previa al entrenamiento, una etapa compleja y crítica que se espera dure entre tres y seis meses continuos de procesamiento informático intensivo a través de una red gigante de servidores. Si la empresa china logra completar este proyecto, el tamaño de su modelo será más de tres veces el tamaño del modelo Kimi K3 desarrollado por la startup china rival Moonshot AI, que contiene solo 2,8 billones de parámetros. Una vez completado a esta escala masiva y sin precedentes a nivel local, este modelo será clasificado sin duda como uno de los sistemas de inteligencia artificial más grandes y complejos desarrollados en la historia de la humanidad hasta el día de hoy.
- El tamaño masivo y el contexto competitivo de los modelos lingüísticos
- La dependencia del desarrollo independiente y las directrices de la gestión
- La carrera armamentística técnica entre las grandes potencias mundiales
- Preguntas frecuentes
El tamaño masivo y el contexto competitivo de los modelos lingüísticos
Aunque la empresa estadounidense Anthropic no suele revelar públicamente el recuento de parámetros de sus modelos avanzados para proteger sus secretos comerciales sensibles, las estimaciones de los expertos de la industria y los analistas indican que su sistema líder a nivel mundial Mythos 5 contiene alrededor de 8 billones de parámetros, mientras que su otro sistema Fable 5 contiene aproximadamente 5 billones de parámetros. En consecuencia, las grandes y anunciadas ambiciones de ByteDance la situarán en una posición muy avanzada, y quizás a la vanguardia del desarrollo tecnológico actual de la inteligencia artificial a escala global. Los parámetros representan en el software valores numéricos precisos y conexiones neuronales que el modelo aprende y ajusta continuamente durante el proceso de entrenamiento intensivo de la red neuronal, lo que le permite reconocer patrones lingüísticos muy complejos y generar respuestas precisas, lógicas y detalladas que simulan la comprensión humana. Sin embargo, los investigadores especializados afirman siempre y con firmeza que el tamaño total o la escala numérica de los parámetros por sí solos no determinan de manera absoluta la capacidad final del modelo, ya que otros factores técnicos cruciales desempeñan un papel fundamental, como la alta calidad y la pureza superior de los datos de entrenamiento, la arquitectura estructural de las redes neuronales y las técnicas de optimización algorítmica continua. Antes de la aparición del modelo Kimi K3, los modelos más grandes en China incluían modelos locales como LongCat 2.0 de Meituan y V4 Pro de DeepSeek, cada uno de los cuales posee solo alrededor de 1,6 billones de parámetros, lo que destaca claramente la magnitud del salto que ByteDance intenta lograr ahora.
La dependencia del desarrollo independiente y las directrices de la gestión
Este importante informe de noticias publicado por el diario británico coincide con directrices internas muy estrictas y decisivas emitidas por el fundador de ByteDance, Zhang Yiming, quien pidió a todos los empleados y equipos de investigación de la empresa que detengan de forma inmediata y absoluta cualquier intento de mejorar y desarrollar sus modelos mediante la extracción o clonación de los resultados de los sistemas occidentales de la competencia en el mercado. En su lugar, el fundador ordenó priorizar la construcción de capacidades de investigación y desarrollo totalmente independientes y originales a largo plazo, alejándose por completo de las ganancias tecnológicas a corto plazo basadas en los esfuerzos de otros, lo que refleja un deseo real de lograr una soberanía tecnológica tangible. Estas estrictas órdenes administrativas se producen tras acusaciones directas y contundentes dirigidas por Anthropic a varias destacadas empresas chinas de inteligencia artificial por utilizar ampliamente los resultados de su modelo lingüístico Claude para entrenar en secreto a sus modelos competidores. En el marco de sus propios e intensivos esfuerzos, ByteDance estableció un equipo de investigación especial y avanzado a principios de 2023, que se expandió rápidamente para emplear actualmente a unos 2000 expertos, investigadores e ingenieros distribuidos en las oficinas de la empresa en toda China y en el extranjero. Las capacidades de este equipo se han visto reforzadas recientemente de manera significativa con la incorporación del destacado experto tecnológico Wu Yonghui, quien trabajó anteriormente durante largos períodos en las empresas estadounidenses Google y DeepMind, para asumir la dirección de este equipo de investigación en febrero de 2025 con el fin de liderar y guiar estos esfuerzos independientes con experiencia global hacia horizontes más amplios.
La carrera armamentística técnica entre las grandes potencias mundiales
Este desarrollo acelerado y significativo pone de relieve de manera clara la intensificación de la feroz y abierta competencia tecnológica entre las empresas tecnológicas chinas y estadounidenses para lograr el control total de la vanguardia del sector avanzado de inteligencia artificial mundial. En las últimas semanas, algunos modelos chinos recientes desarrollados por empresas emergentes como Moonshot y el grupo Alibaba han recibido valoraciones muy positivas en pruebas comparativas independientes, quedando rezagados por un margen muy pequeño frente al modelo Fable 5 desarrollado por Anthropic en áreas técnicas específicas relacionadas con la lógica y el razonamiento complejo. A diferencia de muchas otras empresas emergentes chinas que prefieren y apoyan tecnologías de inteligencia artificial de código abierto para compartir conocimientos y atraer a la comunidad mundial de desarrolladores, la mayoría de los modelos principales y avanzados de ByteDance siguen siendo de código cerrado y se limitan al uso comercial interno. Su avanzado bot de chat, conocido como Doubao, es considerado actualmente el modelo de inteligencia artificial más popular y utilizado en toda China, albergando una base de usuarios masiva que supera los 324 millones de usuarios activos que interactúan con él mensualmente. Asimismo, su modelo de generación y creación de videos llamado Seedance se encuentra entre los más innovadores, avanzados y desarrollados a nivel mundial en términos de precisión y realismo. Hasta el momento de redactar este informe detallado, ByteDance no ha respondido a las solicitudes de comentarios y aclaraciones presentadas por el Financial Times para comentar sobre el tamaño de su nuevo proyecto secreto y su fecha de lanzamiento.
Preguntas frecuentes
Pregunta: ¿Cuál es el tamaño del nuevo modelo lingüístico que ByteDance está desarrollando actualmente?
Respuesta: La empresa está trabajando arduamente para entrenar un modelo de inteligencia artificial gigantesco y altamente avanzado que contiene 10 billones de parámetros de programación, lo que lo convierte en uno de los modelos más grandes en desarrollo en el mundo y supera a sus competidores locales por múltiplos en términos de capacidad de almacenamiento.
Pregunta: ¿Cómo se compara este gigantesco modelo chino con los modelos de destacadas empresas estadounidenses en este campo?
Respuesta: Si el proyecto se completa con gran éxito, el tamaño del nuevo modelo estará muy cerca o incluso superará numéricamente a los sistemas más grandes de la empresa estadounidense líder Anthropic, cuyos parámetros para su sistema más potente, Mythos 5, se estiman en unos 8 billones.
Pregunta: ¿Cuáles son las nuevas directrices administrativas impuestas por el fundador de la empresa a los equipos de investigación en activo?
Respuesta: El fundador de la empresa emitió órdenes estrictas para detener el uso de los resultados de los modelos extranjeros de la competencia para mejorar sus sistemas, confiando en su lugar de manera total y exclusiva en el desarrollo de capacidades e investigaciones independientes a largo plazo para evitar acusaciones de clonación técnica.
Pregunta: ¿Garantiza el tamaño masivo del modelo y el aumento en el número de parámetros su superioridad real en el rendimiento general de la inteligencia artificial?
Respuesta: No, los expertos especializados confirman que el aumento en el número de parámetros por sí solo nunca es suficiente, sino que siempre debe combinarse con datos de entrenamiento de alta calidad y altamente filtrados, una estructura de software innovadora para las redes neuronales y operaciones de optimización algorítmica continua para garantizar resultados precisos y eficaces.