Llama-3.1-8B-Instruct-Chinese-Elite

ๆ‘˜่ฆ
ๅŸบไบŽ Llama-3.1-8B-Instruct ็š„ไธญ่‹ฑๅŒ่ฏญๆŒ‡ไปคๅพฎ่ฐƒๆจกๅž‹ใ€‚ๆฒฟ็”จ Llama-3.2-3B-Elite ็š„่ฎญ็ปƒๆ–นๆณ•๏ผˆ Qwen-3-235b-a22b-Instruct-2507 ๆ•™ๅธˆๆจกๅž‹่’ธ้ฆ + SFT๏ผ‰๏ผŒไฝ†ๆœ‰ๆ„ๅ‡ๅฐ‘่กจๆƒ…็ฌฆๅท๏ผŒๅŒๆ—ถไฟ็•™ๅนถๅผบๅŒ–่พ“ๅ‡บๆ ผๅผ็š„ไธ“ไธšๅบฆ๏ผˆๅฆ‚ๅฐๆ ‡้ข˜ๅŠ ็ฒ—ใ€่ฆ็‚นๅˆ—่กจใ€ๆธ…ๆ™ฐๆฎต่ฝ๏ผ‰๏ผŒไปฅ่Žทๅพ—ๆ›ดๅนฒๅ‡€ใ€็จณๅฎšใ€ๆ˜“่ฏป็š„ๅ›ž็ญ”ใ€‚

Base Training Languages GPU Quantization License

็›ฎๅฝ•


ๆจกๅž‹ไบฎ็‚น

  • ไธ“ไธšไธ”ๅนฒๅ‡€๏ผš้ป˜่ฎคๅ‡ๅฐ‘่กจๆƒ…็ฌฆๅท๏ผ›่พ“ๅ‡บไปฅๅŠ ็ฒ—ๅฐๆ ‡้ข˜ + ่ฆ็‚นๅˆ—่กจไธบไธป๏ผŒไพฟไบŽๅคๅˆถไธŽไบŒๆฌก็ผ–่พ‘ใ€‚
  • ็ป“ๆž„็จณๅฎš๏ผšๅฏนๅˆ†่Š‚ๆŠฅๅ‘Šใ€ๆญฅ้ชคๆธ…ๅ•ใ€ๅฏน็…ง่กจใ€่ฆ็‚นๆ‘˜่ฆ็ญ‰่ฟ›่กŒไบ†้ฃŽๆ ผไธŽๆ ผๅผๅฏน้ฝใ€‚
  • ๅŒ่ฏญ/ๆททๆŽ’ไผ˜ๅŒ–๏ผšไธญๆ–‡ใ€่‹ฑๆ–‡ไธŽไธญ่‹ฑๆททๆŽ’ๅœบๆ™ฏๅ…ทๅค‡่‰ฏๅฅฝ็š„ๆœฏ่ฏญไธ€่‡ดๆ€งไธŽๅฑ‚ๆฌกๆธ…ๆ™ฐๅบฆใ€‚
  • ๆŒ‡ไปค้ตไปŽๆ›ดๅผบ๏ผšๅฏนโ€œไธ่ฆ่กจๆƒ…็ฌฆๅท / ๅช่พ“ๅ‡บ่ฆ็‚น่กจ / ไฟ็•™ Markdown ๆ ‡้ข˜ๅฑ‚็บงโ€็ญ‰็บฆๆŸ้ตไปŽๅบฆๆ›ด้ซ˜ใ€‚

ๅŸบๅบง๏ผšmeta-llama/Llama-3.1-8B-Instruct๏ผ›่ฎญ็ปƒ่Œƒๅผ๏ผšๆ•™ๅธˆ่’ธ้ฆ + SFTใ€‚


ๆจกๅž‹ๆฆ‚่งˆ

  • ๅ‚ๆ•ฐ่ง„ๆจก๏ผš8B
  • ไปปๅŠก๏ผšๆŒ‡ไปค่ทŸ้š / ๅฏน่ฏ็”Ÿๆˆ / ้—ฎ็ญ” / ๆ‘˜่ฆ / ็ป“ๆž„ๅŒ–่พ“ๅ‡บ
  • ่ฏญ่จ€๏ผšไธญๆ–‡ & ่‹ฑๆ–‡๏ผˆ่‰ฏๅฅฝๆ”ฏๆŒไธญ่‹ฑๆททๆŽ’๏ผ‰
  • ็›ฎๆ ‡๏ผšๅœจ่ฝป้‡็ฎ—ๅŠ›ไธ‹๏ผŒไบงๅ‡บ็ฎ€ๆดไธ“ไธšใ€ๆ ผๅผๅ‹ๅฅฝ็š„ๅ†…ๅฎน๏ผˆๅ‡ๅฐ‘่กจๆƒ…็ฌฆๅท๏ผŒไฟ็•™ๅŠ ็ฒ—ๅฐๆ ‡้ข˜ใ€่ฆ็‚นๅˆ—่กจ็ญ‰ๆ ผๅผไผ˜ๅŒ–๏ผ‰

่ฎญ็ปƒไธŽๆ•ฐๆฎ

  • ๆ•ฐๆฎ่ง„ๆจก๏ผš็บฆ 80,000 ๆก้ซ˜่ดจ้‡ๆŒ‡ไปค-ๅ›žๅคๆ ทๆœฌ๏ผˆไธญ่‹ฑๆททๅˆ๏ผŒ่ฆ†็›–้—ฎ็ญ”/ๆ‘˜่ฆ/่ฏดๆ˜Žๆ–‡/็ป“ๆž„ๅŒ–่พ“ๅ‡บ/ๆญฅ้ชคๅŒ–่ฏดๆ˜Ž็ญ‰๏ผ‰ใ€‚
  • ่ฎญ็ปƒๆ–นๆณ•๏ผšๆ•™ๅธˆ่’ธ้ฆ + SFT๏ผ›ๆ˜พๅผๆŽงๅˆถๆ ผๅผ/้ฃŽๆ ผ๏ผˆๅฐ‘่กจๆƒ…ใ€ๅผบ่ฐƒๆ ‡้ข˜/ๅˆ—่กจ/ๅŠ ็ฒ—๏ผ‰ใ€‚
  • ่ฎก็ฎ—่ต„ๆบ๏ผšA100 ๅ•ๅก๏ผ›LoRA/QLoRA ๅฏๅœจ่พƒ็Ÿญๆ—ถ้—ดๅ†…ๅฎŒๆˆ่‹ฅๅนฒ epochใ€‚
  • ้ฃŽๆ ผไธŽ็บฆๆŸ๏ผšๅ‡ๅฐ‘่กจๆƒ…็ฌฆๅท๏ผ›ๅผบๅŒ–ๅฐๆ ‡้ข˜ๅŠ ็ฒ—ใ€่ฆ็‚นๅˆ—่กจใ€ๅ…ณ้”ฎๆœฏ่ฏญๅŠ ็ฒ—ไธŽๆฎต่ฝๅฑ‚็บงใ€‚

ๅฆ‚ๅ‘ๅธƒ่’ธ้ฆๆ•ฐๆฎๅญ้›†๏ผŒ่ฏทๅœจๆญคๅค„่กฅๅ……้“พๆŽฅไธŽ็ปŸ่ฎก๏ผˆๆ ทๆœฌๆ•ฐ/่ฏญ็งๅ ๆฏ”/่ฟ‡ๆปคๆ ‡ๅ‡†๏ผ‰ใ€‚


ๅฟซ้€Ÿๅผ€ๅง‹

Transformers๏ผˆๆŽจ่๏ผ‰
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch

model_id = "Jackrong/Llama-3.1-8B-Instruct-Elite"
tok = AutoTokenizer.from_pretrained(model_id, use_fast=True)
model = AutoModelForCausalLM.from_pretrained(
    model_id,
    torch_dtype=torch.bfloat16,
    device_map="auto"
)

messages = [
    {"role": "system", "content": "Write clean, professional answers with bolded subheadings and structured lists; avoid emojis."},
    {"role": "user", "content": "่ฏท็”จ่ฆ็‚น่ฏดๆ˜Žๅฆ‚ไฝ•ไผ˜ๅŒ–ๅ‘จ่ฎกๅˆ’๏ผŒไฝฟๅ…ถๆ›ดๅฏๆ‰ง่กŒใ€‚"}
]

prompt = tok.apply_chat_template(messages, tokenize=False, add_generation_prompt=True)
inputs = tok(prompt, return_tensors="pt").to(model.device)
outputs = model.generate(
    **inputs,
    max_new_tokens=512,
    temperature=0.7,
    top_p=0.9,
)
print(tok.decode(outputs[0], skip_special_tokens=True))
vLLM
from vllm import LLM, SamplingParams

llm = LLM(model="Jackrong/Llama-3.1-8B-Instruct-Chinese-Elite", dtype="bfloat16")
params = SamplingParams(temperature=0.7, top_p=0.9, max_tokens=512)

prompt = "ๅˆ—ๅ‡บ 5 ๆกๅฏๆ‰ง่กŒ็š„ๅ‘จ่ฎกๅˆ’ไผ˜ๅŒ–ๅปบ่ฎฎ๏ผˆ็”จๅŠ ็ฒ—ๅฐๆ ‡้ข˜+่ฆ็‚นๅˆ—่กจ๏ผ‰ใ€‚"
outputs = llm.generate([prompt], params)
print(outputs[0].outputs[0].text)
llama.cpp๏ผˆGGUF๏ผšQ4_K_M๏ผ‰
./main -m Llama-3.1-8B-Instruct-Chinese-Elite.Q4_K_M.gguf \
  -p "ไปฅ่ฆ็‚น่ฏดๆ˜Ž๏ผšๅฆ‚ไฝ•ๅฐ†ๆŠ€ๆœฏๆ–‡็ซ ๆ”นๅ†™ๅพ—ๆ›ดไธ“ไธšไธ”ๅนฒๅ‡€๏ผŸ"

ๆ็คบ่ฏไธŽ่พ“ๅ‡บ่ง„่Œƒ

  • ไฝฟ็”จ็ฎ€ๆดๆ ‡้ข˜ไธŽๅŠ ็ฒ—ๅฐๆ ‡้ข˜็ป„็ป‡็ป“ๆž„๏ผ›ๅ…ณ้”ฎๆœฏ่ฏญไธŽ็ป“่ฎบ้€‚ๅŠ ็ฒ—ใ€‚
  • ไปฅ่ฆ็‚นๅˆ—่กจๅ‘ˆ็Žฐๆญฅ้ชคไธŽ่ฆ็‚น๏ผ›้ป˜่ฎค้ฟๅ…่กจๆƒ…็ฌฆๅทใ€‚
  • ้‡‡ๆ ทๅปบ่ฎฎ๏ผštemperature=0.6โ€“0.8ใ€top_p=0.9โ€“0.95ใ€‚

้€‚็”จไธŽ้™ๅˆถ

้€‚็”จ๏ผšไธญ/่‹ฑๆ–‡ๆˆ–ไธญ่‹ฑๆททๆŽ’็š„้—ฎ็ญ”ใ€ๆ‘˜่ฆใ€่ฏดๆ˜Žๆ–‡ใ€ๆŠ€ๆœฏ/ไธšๅŠกๅ†™ไฝœ๏ผ›็ป“ๆž„ๅŒ–่พ“ๅ‡บ๏ผˆ่ฎกๅˆ’ใ€ๆญฅ้ชคใ€่กจๆ ผใ€FAQใ€ไผš่ฎฎ็บช่ฆ๏ผ‰ใ€‚
้™ๅˆถ๏ผšๅผบไบ‹ๅฎžๆ€งใ€้œ€ๆœ€ๆ–ฐไฟกๆฏ็š„ไปปๅŠกๅปบ่ฎฎ้…ๅˆๆฃ€็ดข๏ผ›ๅŒป็–—/ๆณ•ๅพ‹/ๆŠ•่ต„็ญ‰้ซ˜้ฃŽ้™ฉ่พ“ๅ‡บ้œ€ไบบๅทฅๆ กๅฏน๏ผ›ไธๅพ—็”จไบŽ่ฟๆณ•ๆˆ–ไผคๅฎณๆ€ง็”จ้€”ใ€‚


่ฎธๅฏ

  • ๆจกๅž‹ๆƒ้‡๏ผš้ตๅพช Llama 3.1 Community License๏ผˆไธŽๅŸบๅบงไธ€่‡ด๏ผ‰ใ€‚
  • ไปฃ็ /่„šๆœฌ๏ผšๅฏไฝฟ็”จ Apache-2.0 ็ญ‰๏ผ›ไธๆ”นๅ˜ๆƒ้‡่ฎธๅฏใ€‚

่‡ด่ฐข

  • Meta ๆไพ› Llama-3.1 ไธŽ็”Ÿๆ€ๅทฅๅ…ท้“พ
  • ๅผ€ๆบ็คพๅŒบๅœจ่’ธ้ฆใ€SFTใ€่ฏ„ๆต‹ใ€้ƒจ็ฝฒๆ–น้ข็š„่ดก็Œฎ
  • ่ฎญ็ปƒๆ–นๆณ•ไธŽๅฎž่ทตๆฒฟ็”จ่‡ช Llama-3.2-3B-Elite

ๅผ•็”จ

@misc{JackrongL31_8B_Elite,
  title  = {Jackrong/Llama-3.1-8B-Instruct-Chinese-Elite},
  author = {Jackrong},
  year   = {2025},
  url    = {https://huggingface.co/Jackrong/Llama-3.1-8B-Instruct-Elite}
}

็‰ˆๆœฌ่ฎฐๅฝ•

  • v1.0๏ผš้ฆ–ๆฌกๅ‘ๅธƒใ€‚ๆ•ฐๆฎ่ง„ๆจก็บฆ 80k๏ผ›A100 ๅ•ๅก่ฎญ็ปƒ๏ผ›ๆไพ› GGUF Q4_K_M๏ผ›ๅ‡ๅฐ‘่กจๆƒ…็ฌฆๅท๏ผ›ๅผบๅŒ–ๅฐๆ ‡้ข˜ๅŠ ็ฒ—ไธŽ่ฆ็‚นๅˆ—่กจ๏ผ›่ฎญ็ปƒ้…ๆ–นไธŽ 3.2-3B-Elite ไธ€่‡ดใ€‚
Downloads last month
2
GGUF
Model size
8B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for Jackrong/Llama-3.1-8B-Instruct-Chinese-Elite

Quantized
(897)
this model