{ "model_name": "prefill_qnn", "version": "1.0.0", "target_hardware": "SM8350", "quantization": "INT8", "optimization_level": 3, "input_shapes": { "input_ids": [ 1, "sequence_length" ], "attention_mask": [ 1, "sequence_length" ] }, "output_shapes": { "logits": [ 1, "sequence_length", 1000 ] }, "qnn_specific": { "backend": "qnn", "precision": "int8", "use_dsp": true, "use_gpu": false, "use_cpu": true }, "notes": "Mock QNN model created for demonstration - requires actual QNN SDK for real compilation" }