hsuwill000 commited on
Commit
5aa3c9f
·
verified ·
1 Parent(s): 1dfe825

Update start.sh

Browse files
Files changed (1) hide show
  1. start.sh +12 -24
start.sh CHANGED
@@ -1,16 +1,10 @@
1
  #!/bin/bash
2
  set -e
3
 
4
- # ==========================
5
- # 工作目錄
6
- # ==========================
7
  export WORK="/home/user/app"
8
- mkdir -p $WORK
9
  cd "$WORK"
10
 
11
- # ==========================
12
- # Python 環境
13
- # ==========================
14
  python3 -m venv venv
15
  source venv/bin/activate
16
 
@@ -18,27 +12,21 @@ echo "[PYTHON] Installing dependencies..."
18
  pip install --upgrade pip
19
  pip install gradio openai "setuptools>=70.0.0" wheel flask
20
 
21
- # ==========================
22
- # llama-server 與模型
23
- # ==========================
24
  wget -q -O model.gguf https://huggingface.co/LiquidAI/LFM2-8B-A1B-GGUF/resolve/main/LFM2-8B-A1B-Q4_K_M.gguf
25
  unzip -o llama_cpp_avx512.zip > /dev/null 2>&1
 
 
26
  nohup ./llama-server -m "$WORK/model.gguf" --port 8000 --host 0.0.0.0 --threads 2 --ctx-size 4096 --mlock --jinja --temp 1.1 --top-p 0.95 \
27
  > llama_server.log 2>&1 &
28
 
29
- # ==========================
30
- # 顯示 TPS 資訊
31
- # ==========================
32
- echo "[LLAMA] 正在監看 TPS..."
33
- (
34
- tail -n0 -F "$WORK/llama_server.log" | \
35
- grep --line-buffered -E "t/s\)|tokens/s" | \
36
- while read -r line; do
37
- echo "[TPS] $(echo "$line" | grep -oE '[0-9]+\.[0-9]+ t/s')"
38
- done
39
- ) &
40
-
41
- cd $WORK
42
- python3 app.py
43
 
 
 
 
 
 
 
44
 
 
 
 
1
  #!/bin/bash
2
  set -e
3
 
 
 
 
4
  export WORK="/home/user/app"
5
+ mkdir -p "$WORK"
6
  cd "$WORK"
7
 
 
 
 
8
  python3 -m venv venv
9
  source venv/bin/activate
10
 
 
12
  pip install --upgrade pip
13
  pip install gradio openai "setuptools>=70.0.0" wheel flask
14
 
 
 
 
15
  wget -q -O model.gguf https://huggingface.co/LiquidAI/LFM2-8B-A1B-GGUF/resolve/main/LFM2-8B-A1B-Q4_K_M.gguf
16
  unzip -o llama_cpp_avx512.zip > /dev/null 2>&1
17
+
18
+ echo "[LLAMA] 啟動伺服器..."
19
  nohup ./llama-server -m "$WORK/model.gguf" --port 8000 --host 0.0.0.0 --threads 2 --ctx-size 4096 --mlock --jinja --temp 1.1 --top-p 0.95 \
20
  > llama_server.log 2>&1 &
21
 
22
+ sleep 3
 
 
 
 
 
 
 
 
 
 
 
 
 
23
 
24
+ echo "[LLAMA] 顯示最新日誌(含 TPS)..."
25
+ tail -n20 -F "$WORK/llama_server.log" | while read -r line; do
26
+ if [[ "$line" =~ ([0-9]+\.[0-9]+)\ t/s ]]; then
27
+ echo "[TPS] ${BASH_REMATCH[1]} t/s"
28
+ fi
29
+ done &
30
 
31
+ cd "$WORK"
32
+ python3 app.py