Semantic Field Execution: Decoupling Transformers from Runtime Inferencezenodo.org·1 pts·anima-core·1
Post-transformer inference: 224× compression of Llama-70B with improved accuracyzenodo.org·72 pts·anima-core·56