6 Commits
Author SHA1 Message Date
ac6bdfccec Add Llama 3.1 (#98)
* Update Mistral 7B config

* Add Mistral NeMo

* Update for Llama 3.1

* Align LlamaConfiguration with Python implementation

* Fix model configuration names

* Refine DynamicNTKScalingRoPE

* compute base only once

---------

Co-authored-by: Awni Hannun <awni@apple.com>
2024-07-26 13:05:42 -07:00
Anthony DePasqualeandGitHub c4fda0e036 Add Mistral NeMo (#97)
* Update Mistral 7B config

* Add Mistral NeMo
2024-07-25 08:01:26 -07:00
Anthony DePasqualeandGitHub a2e8d7e469 Add SmolLM (#95) 2024-07-23 15:42:52 -07:00
Anthony DePasqualeandGitHub 2a2931ba8d Fix extra EOS tokens (#91)
* Fix extra EOS tokens

* Fix pre-commit error
2024-07-03 16:22:29 -07:00
Anthony DePasqualeandGitHub 0c08f3a7e4 Add Gemma 2 (#88) 2024-07-01 09:35:43 -07:00
Anthony DePasqualeandGitHub 65f4968e5f Fix download progress (#78) 2024-05-28 14:05:37 -07:00