Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
harrrshall
/
BarunLM-35M
like
47
Text Generation
PyTorch
Safetensors
5 datasets
English
base-model
causal-lm
small-language-model
arxiv:
2305.13245
arxiv:
2104.09864
arxiv:
2002.05202
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
1
Copy to bucket
new
main
BarunLM-35M
141 MB
Ctrl+K
Ctrl+K
1 contributor
History:
3 commits
harrrshall
Remove stray __pycache__ artifacts
ef3e483
verified
5 days ago
barunlm
Remove stray __pycache__ artifacts
5 days ago
.gitattributes
Safe
50 Bytes
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
CITATION.cff
Safe
349 Bytes
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
LICENSE
11.3 kB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
NOTICE
Safe
1.23 kB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
README.md
Safe
8.46 kB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
SHA256SUMS
Safe
249 Bytes
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
barun_config.json
Safe
448 Bytes
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
benchmark_results.json
Safe
3.09 kB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
generate.py
Safe
3.56 kB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
model.safetensors
Safe
140 MB
xet
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
requirements.txt
Safe
50 Bytes
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago
tokenizer.json
Safe
1.14 MB
BarunLM-35M: 35M-parameter base language model trained on 5.7B tokens
5 days ago