SIGN IN SIGN UP

Fix fp32->fp16 cast for scalars (fixes llama2 fp16 for MPS) (#1752)

Summary:
Summary of changes:
- Fix FP32 -> FP16 scalar conversion
- Disable MPS partitioner by default in mps_example script

```bash
# AOT:
python3 -m examples.apple.mps.scripts.mps_example --model_name="llama2" --bundled

# Runtime:
./cmake-out/examples/apple/mps/mps_executor_runner --model_path llama2_mps_bundled_fp16.pte --bundled_program
```
cc cccclai

Pull Request resolved: https://github.com/pytorch/executorch/pull/1752

Reviewed By: cccclai

Differential Revision: D53236633

Pulled By: shoumikhin

fbshipit-source-id: ab04587bfd1493b81fa03a3145c0df6911749fec
D
Denis Vieriu committed
c99e5a5a45d524f130d7df2b5f0f078d101ecb53
Parent: 7b5419a
Committed by Facebook GitHub Bot <facebook-github-bot@users.noreply.github.com> on 1/30/2024, 10:17:53 PM