assignarc commited on
Commit
1336377
·
verified ·
1 Parent(s): 5aa457d

TLF-7B-LLM-01: Upload fine-tuned LoRA adapters (2026-03-29)

Browse files
0214600_adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e1057b241d2eede9f3ef30dc43e56fe4d5126e587ce8640a673a5f2fd66f7c2f
3
+ size 109600779
0214700_adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:eeab3c90affc7d938c5164d82e9fa6271886e1b7711faec7e72bcfb3db037542
3
+ size 109600779
0214800_adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ff8c3ee97e4ef0a92db281d8a88a43a554426e29c064af0b34b55bfc11e1a2a7
3
+ size 109600779
0214900_adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:ef3e386f80a697ac9357fb72db20b49e38edc1a1a8369b70857e4331c46ef806
3
+ size 109600779
0215000_adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:77f72bd8d0b83a42420d2810e8a0c0d9a276259cff5ea5eca7c4d95b8122903d
3
+ size 109600779
README.md CHANGED
@@ -1,3 +1,75 @@
1
- ---
2
- license: mit
3
- ---
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: apache-2.0
3
+ base_model: sarvamai/sarvam-1
4
+ library_name: peft
5
+ tags:
6
+ - indic-nlp
7
+ - dictionary
8
+ - sanskrit
9
+ - marathi
10
+ - hindi
11
+ - sft
12
+ - lora
13
+ ---
14
+
15
+ # TLF-7B-LLM-01
16
+
17
+ ## Model Description
18
+ This model is a fine-tuned version of [sarvamai/sarvam-1](https://huggingface.co/sarvamai/sarvam-1) specialized for **Bilingual Indic Lexicography**.
19
+ It has been trained to provide structured morphological breakdowns, definitions, and regional translations for Sanskrit and other Indian regional languages.
20
+
21
+ The training data was ingested through the **TLF Mega-Pipeline**, integrating structured dictionary databases (MSSQL) with unstructured regional texts to improve grammar and stylistic intelligence.
22
+
23
+ ## Intended Use
24
+ - **Dictionary Lookups**: Providing high-accuracy definitions and etymologies.
25
+ - **Morphological Analysis**: Breaking down complex Sanskrit/Indic root words.
26
+ - **Regional Translation**: Translating word concepts across Marathi, Hindi, and English.
27
+
28
+ ## Training Hyperparameters
29
+ The following hyperparameters were used during training:
30
+ - **Engine**: MLX
31
+ - **Learning Rate**: 2e-05
32
+ - **Batch Size**: 1
33
+ - **Gradient Accumulation**: 64
34
+ - **Optimizer**: adamw_torch
35
+ - **LR Scheduler**: cosine
36
+ - **LoRA R**: 32
37
+ - **LoRA Alpha**: 16
38
+ - **Max Sequence Length**: 1024
39
+
40
+ ## Prompt Template
41
+ To achieve the intended structured output, use the following prompt format:
42
+
43
+ ```text
44
+ <s>[INST] <<SYS>>\n{system_prompt}\n<</SYS>>\n\n{query} [/INST]
45
+ ```
46
+
47
+ ## Inference Example
48
+ ### Using MLX (Apple Silicon)
49
+ ```python
50
+ import mlx_lm
51
+ model, tokenizer = mlx_lm.load("YourAccount/TLF-7B-LLM-01")
52
+
53
+ prompt = "Provide a comprehensive morphological breakdown for: 'Abacus'"
54
+ # Use Sarvam/Llama template logic here
55
+ response = mlx_lm.generate(model, tokenizer, prompt=prompt)
56
+ print(response)
57
+ ```
58
+
59
+ ### Using Transformers
60
+ ```python
61
+ from transformers import AutoModelForCausalLM, AutoTokenizer
62
+ from peft import PeftModel
63
+
64
+ base_model = AutoModelForCausalLM.from_pretrained("sarvamai/sarvam-1")
65
+ model = PeftModel.from_pretrained(base_model, "YourAccount/TLF-7B-LLM-01")
66
+ tokenizer = AutoTokenizer.from_pretrained("sarvamai/sarvam-1")
67
+
68
+ inputs = tokenizer(prompt, return_tensors="pt")
69
+ outputs = model.generate(**inputs, max_new_tokens=256)
70
+ print(tokenizer.decode(outputs[0]))
71
+ ```
72
+
73
+ ## Citation & Credits
74
+ - **TLF Framework**: Architected for Unified Indic LLM Fine-tuning.
75
+ - **Data Source**: Custom Dictionary & Regional Text Corpus.
adapter_config.json ADDED
@@ -0,0 +1,41 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "adapter_path": "/Users/vishalkhapre/Documents/Code/TLF-7B-LLM-01/code/dict/../../raw/models/TLF-7B-MLX-01_sarvamai_sarvam-1",
3
+ "batch_size": 1,
4
+ "config": "/Users/vishalkhapre/Documents/Code/TLF-7B-LLM-01/code/dict/../../raw/models/TLF-7B-MLX-01_sarvamai_sarvam-1/mlx_config.yaml",
5
+ "data": "/Users/vishalkhapre/Documents/Code/TLF-7B-LLM-01/code/dict/../../raw/models/TLF-7B-MLX-01_sarvamai_sarvam-1/data",
6
+ "fine_tune_type": "lora",
7
+ "grad_accumulation_steps": 64,
8
+ "grad_checkpoint": true,
9
+ "iters": 215030,
10
+ "learning_rate": 2e-05,
11
+ "lora_parameters": {
12
+ "dropout": 0.1,
13
+ "rank": 32,
14
+ "scale": 16
15
+ },
16
+ "lr_schedule": null,
17
+ "mask_prompt": false,
18
+ "max_grad_norm": 0.05,
19
+ "max_seq_length": 1024,
20
+ "model": "sarvamai/sarvam-1",
21
+ "num_layers": 16,
22
+ "optimizer": "adam",
23
+ "optimizer_config": {
24
+ "adam": {},
25
+ "adamw": {},
26
+ "muon": {},
27
+ "sgd": {},
28
+ "adafactor": {}
29
+ },
30
+ "project_name": null,
31
+ "report_to": null,
32
+ "resume_adapter_file": null,
33
+ "save_every": 100,
34
+ "seed": 0,
35
+ "steps_per_eval": 200,
36
+ "steps_per_report": 10,
37
+ "test": false,
38
+ "test_batches": 500,
39
+ "train": true,
40
+ "val_batches": 25
41
+ }
adapters.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:77f72bd8d0b83a42420d2810e8a0c0d9a276259cff5ea5eca7c4d95b8122903d
3
+ size 109600779
mlx_config.yaml ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ adapter_path: /Users/vishalkhapre/Documents/Code/TLF-7B-LLM-01/code/dict/../../raw/models/TLF-7B-MLX-01_sarvamai_sarvam-1
2
+ batch_size: 1
3
+ data: /Users/vishalkhapre/Documents/Code/TLF-7B-LLM-01/code/dict/../../raw/models/TLF-7B-MLX-01_sarvamai_sarvam-1/data
4
+ grad_accumulation_steps: 64
5
+ grad_checkpoint: true
6
+ iters: 215030
7
+ learning_rate: 2.0e-05
8
+ lora_parameters:
9
+ dropout: 0.1
10
+ rank: 32
11
+ scale: 16
12
+ max_grad_norm: 0.05
13
+ max_seq_length: 1024
14
+ model: sarvamai/sarvam-1
15
+ save_every: 100
16
+ train: true