Complexity-Deep: Token-Routed MLP with Mu-Guided Dynamics for Efficient Transformer Architectures

Peyriguere, Boris

doi:10.5281/zenodo.18293026

Published January 18, 2026 | Version v1

Preprint Open

Complexity-Deep: Token-Routed MLP with Mu-Guided Dynamics for Efficient Transformer Architectures

Peyriguere, Boris¹

1. Independent Researcher

We present Complexity-Deep, a transformer architecture introducing two key innovations: (1) Token-Routed MLP, a deterministic expert routing mechanism based on token identity that achieves perfect load balancing without auxiliary losses, and (2) Mu-Guided Dynamics, a simplified PID-inspired system that accumulates context across layers and influences both attention and expert routing. Our Token-Routed MLP uses modulo-based routing (expert_id = token_id mod N) ensuring uniform expert utilization regardless of token frequency distribution. We further introduce CGGR (Contiguous Group GEMM Routing), a Triton-based kernel optimization achieving 5-6x speedup over batched matrix multiplication. The architecture incorporates modern techniques including Grouped Query Attention (GQA), RoPE positional embeddings, QK Normalization, and Flash Attention via SDPA. Our 1.5B parameter model demonstrates the viability of deterministic routing as an alternative to learned routing in Mixture-of-Experts architectures.

Files

complexity_paper.pdf

Files (356.1 kB)

Name	Size	Download all
complexity_paper.pdf md5:5511096819fd124742daf18b1536a70c	356.1 kB	Preview Download

Additional details

Is supplemented by: Software: https://github.com/Complexity-ML/complexity-deep (URL)

	All versions	This version
Views	241	241
Downloads	183	183
Data volume	107.5 MB	107.5 MB

Complexity-Deep: Token-Routed MLP with Mu-Guided Dynamics for Efficient Transformer Architectures

Authors/Creators

Description

Files

complexity_paper.pdf

Files (356.1 kB)

Additional details

Related works