A proposed architecture keeps an AI model's attention and knowledge in separate modules — and says that runs 1.33× faster — type0 | type0