Saltar al contenido
ChristopherOx Alpha
Índice
  1. Briefing
  2. Etapa Prueba · 3/3

Prueba

Laboratorios interactivos

Cuchillo, +75, MoE, 2ⁿ, peaje de video, mezclador, termostato y el bucle entero.

  1. Vas a entender
  2. Predice, mueve, observa.
  3. Un laboratorio a la vez.
  4. Las tablas siguen ahí si el gráfico no carga.

Laboratorio: el bucle entero

Seis estaciones. Cada una es un clic. Al final tienes tres sellos: constante +75, mismo cajero, factura = activos.

Texto entra

Escribes «Hola mundo». Aún son letras. El modelo no las ve.

Laboratorio: corta el texto

Esto no es el vocabulario real de GLM. Es un simulador: dos cuchillos, dos cuentas. En la prueba real, Ox y GLM-5.3 coinciden; Kimi/MiMo/Qwen no.

Antes de tocar

Si el cuchillo fuera el mismo y hubiera un membrete, ¿Δ qué hace?

Elige una. Luego mueve el control y compara.

Por qué

Fija. Un wrapper suma un extra constante. Si Δ baila, el cuchillo no es el mismo.
Simulador de dos cuchillos sobre el mismo texto. La prueba real es la constante +75, no este vocabulario.. Simulador de dos cuchillos sobre el mismo texto. La prueba real es la constante +75, no este vocabulario.

Estilo compacto (familia CJK/GLM, ilustrativo) · 11 piezas

Hola,¿cómoestáshoy?

Estilo occidental más partido (ilustrativo) · 14 piezas

Hola,¿cómoestáshoy?

Si Ox Alpha usa el cuchillo GLM, su cuenta es 86 = 11 piezas + 75 del membrete. El cuchillo occidental da 14.

Tabla reconstruida · test +75

Patrón publicado (dax / r/singularity / MaxForAI / Davis): cada texto mide exactamente 75 tokens más en Ox que en GLM-5.3.

PromptGLMOxΔMiMoKimi
EN
Hello, how are you today?
88375109
DE
Guten Morgen, wie geht es di
1186751314
CN
你好,今天过得怎么样?
98475118
code
def fib(n): return n if n<2
2499752628
emoji
🚀🔥💡✨🎯
1085751415
EN
The quick brown fox jumps ov
1287751413

Números ilustrativos del patrón público, no una corrida propia. La constante es el hallazgo.

Laboratorio: resta el membrete

Escribe los tokens que te devolvieron dos APIs para el MISMO texto. Si Δ = 75 siempre, el cuchillo es el mismo.

Antes de tocar

Si GLM da 12 y Ox da 87, Δ es...

Elige una. Luego mueve el control y compara.

Por qué

75. 87 − 12 = 75. Esa es la carta membrete.
Δ = tok_ox − tok_glm
Δ = 87 − 12 = 75

H0  same tokenizer + wrapper   →  Δ = 75  for every P
H1  different tokenizer        →  Var(Δ) ≫ 0

Encaja con la hipótesis: 75 tokens de membrete. Si esto se repite en inglés, chino, código y emoji, el diccionario es GLM.

Laboratorio: despierta especialistas

El edificio siempre tiene 744 «músicos». Solo cobran los que tocan. Un modelo denso de 2T cobra a todos, todo el rato.

Antes de tocar

Si enciendes menos expertos, la factura...

Elige una. Luego mueve el control y compara.

Por qué

Baja. coste ≈ k · P_activos · tokens. El edificio no se cobra entero en cada palabra.
744 músicos en el edificio. Solo cobran los que tocan. GLM-5.3 real usa ~40B de 744B.. 744 músicos en el edificio. Solo cobran los que tocan. GLM-5.3 real usa ~40B de 744B.
Edificio (total)
744B
Despiertos (factura)
40B
Más barato que denso 2T
×50.0

Solo el 5.4% del edificio trabaja en cada palabra. GLM-5.3 real usa ~40B de 744B.

Laboratorio: 2ⁿ no es marketing

Las GPUs aman potencias de dos. 1.048.576 no es «un millón redondo». Es exactamente 2²⁰.

Antes de tocar

Si n sube 1, el cubo...

Elige una. Luego mueve el control y compara.

Por qué

Se duplica. Por eso el salto de 2¹⁹ a 2²⁰ parece un escritorio, no un redondeo de marketing.
Cada paso multiplica por dos. 2²⁰ = 1.048.576, el escritorio de Ox Alpha y GLM-5.2/5.3.. Cada paso multiplica por dos. 2²⁰ = 1.048.576, el escritorio de Ox Alpha y GLM-5.2/5.3.

220 = 1.048.576

≈ 10.5 libros de 100k tokens. Esta es la mesa de trabajo de Ox Alpha y de GLM-5.2/5.3.

  • 2^10 · 1.024 · un SMS largo
  • 2^14 · 16.384 · un ensayo
  • 2^17 · 131.072 · salida máx. de Ox
  • 2^20 · 1.048.576 · contexto Ox / GLM-5.2

Peaje de video

Cuatro clips publicados (Davis / Railway / BohuTANG). Ox y GLM-5V-Turbo cobran lo mismo. MiMo y Qwen no. El 5 fps = 30 fps es la trampa: el cajero cobra tiempo, no fotogramas.

Antes de tocar

Si 5 fps cobra igual que 30 fps, el cajero cuenta...

Elige una. Luego mueve el control y compara.

Por qué

Tiempo. El peaje idéntico Ox = 5V-Turbo es la huella; la invariancia fps es común.
Números publicados, no una corrida propia. Ox y GLM-5V-Turbo cobran lo mismo en cuatro clips.. Números publicados, no una corrida propia. Ox y GLM-5V-Turbo cobran lo mismo en cuatro clips.
Ox Alpha
296
GLM-5V-Turbo
296
MiMo v2.5
910
Qwen
408

Sello: MISMO CAJERO. 296 = 296 tokens.

Números publicados, no una corrida propia. GLM-4.6V cobra distinto: «GLM-ish» no basta.

Laboratorio: el termostato

Temperatura 0 = siempre el token más probable (loro disciplinado). 1 = jazz. Para fingerprintar clones se usa 0. Simulador pedagógico, no la API real.

Antes de tocar

Para comparar clones carácter a carácter, ¿qué T usas?

Elige una. Luego mueve el control y compara.

Por qué

Casi 0. Cerca de argmax. A T alta, pizza compite y el DNI se deshace.

Zona chat/código. Útil para escribir, inútil como DNI.

Mezclador de confianza

Rúbrica, no Bayes. Arrastra cuánto te fías de cada prueba. El techo está cerrado: sin corrida live ni comunicado del lab no hay DNI. Manifold es el mercado, no esta barra.

Antes de tocar

Si subes solo el playbook stealth, ¿quién debería subir más?

Elige una. Luego mueve el control y compara.

Por qué

Xiaomi sube más en esta rúbrica. El playbook empuja; el tokenizer no. Baja el playbook y GLM sigue cerca del techo.
Mezclador de confianza. Cuatro barras de la rúbrica. El techo 90% está cerrado: sin corrida live ni comunicado del lab.

Z.ai / GLM-5.x

82%

Rúbrica tuya · techo 90%

Xiaomi MiMo-V3

24%

El playbook empuja; el cuchillo no

Fine-tune / Composer

22%

Tokenizer sí, cocina z.ai menos

Inkling · Mira

6%

Audio ≠ video. Descartada.