Spaces:
Runtime error
Runtime error
Update start.sh
Browse files
start.sh
CHANGED
|
@@ -1,16 +1,10 @@
|
|
| 1 |
#!/bin/bash
|
| 2 |
set -e
|
| 3 |
|
| 4 |
-
# ==========================
|
| 5 |
-
# 工作目錄
|
| 6 |
-
# ==========================
|
| 7 |
export WORK="/home/user/app"
|
| 8 |
-
mkdir -p $WORK
|
| 9 |
cd "$WORK"
|
| 10 |
|
| 11 |
-
# ==========================
|
| 12 |
-
# Python 環境
|
| 13 |
-
# ==========================
|
| 14 |
python3 -m venv venv
|
| 15 |
source venv/bin/activate
|
| 16 |
|
|
@@ -18,27 +12,21 @@ echo "[PYTHON] Installing dependencies..."
|
|
| 18 |
pip install --upgrade pip
|
| 19 |
pip install gradio openai "setuptools>=70.0.0" wheel flask
|
| 20 |
|
| 21 |
-
# ==========================
|
| 22 |
-
# llama-server 與模型
|
| 23 |
-
# ==========================
|
| 24 |
wget -q -O model.gguf https://huggingface.co/LiquidAI/LFM2-8B-A1B-GGUF/resolve/main/LFM2-8B-A1B-Q4_K_M.gguf
|
| 25 |
unzip -o llama_cpp_avx512.zip > /dev/null 2>&1
|
|
|
|
|
|
|
| 26 |
nohup ./llama-server -m "$WORK/model.gguf" --port 8000 --host 0.0.0.0 --threads 2 --ctx-size 4096 --mlock --jinja --temp 1.1 --top-p 0.95 \
|
| 27 |
> llama_server.log 2>&1 &
|
| 28 |
|
| 29 |
-
|
| 30 |
-
# 顯示 TPS 資訊
|
| 31 |
-
# ==========================
|
| 32 |
-
echo "[LLAMA] 正在監看 TPS..."
|
| 33 |
-
(
|
| 34 |
-
tail -n0 -F "$WORK/llama_server.log" | \
|
| 35 |
-
grep --line-buffered -E "t/s\)|tokens/s" | \
|
| 36 |
-
while read -r line; do
|
| 37 |
-
echo "[TPS] $(echo "$line" | grep -oE '[0-9]+\.[0-9]+ t/s')"
|
| 38 |
-
done
|
| 39 |
-
) &
|
| 40 |
-
|
| 41 |
-
cd $WORK
|
| 42 |
-
python3 app.py
|
| 43 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 44 |
|
|
|
|
|
|
|
|
|
| 1 |
#!/bin/bash
|
| 2 |
set -e
|
| 3 |
|
|
|
|
|
|
|
|
|
|
| 4 |
export WORK="/home/user/app"
|
| 5 |
+
mkdir -p "$WORK"
|
| 6 |
cd "$WORK"
|
| 7 |
|
|
|
|
|
|
|
|
|
|
| 8 |
python3 -m venv venv
|
| 9 |
source venv/bin/activate
|
| 10 |
|
|
|
|
| 12 |
pip install --upgrade pip
|
| 13 |
pip install gradio openai "setuptools>=70.0.0" wheel flask
|
| 14 |
|
|
|
|
|
|
|
|
|
|
| 15 |
wget -q -O model.gguf https://huggingface.co/LiquidAI/LFM2-8B-A1B-GGUF/resolve/main/LFM2-8B-A1B-Q4_K_M.gguf
|
| 16 |
unzip -o llama_cpp_avx512.zip > /dev/null 2>&1
|
| 17 |
+
|
| 18 |
+
echo "[LLAMA] 啟動伺服器..."
|
| 19 |
nohup ./llama-server -m "$WORK/model.gguf" --port 8000 --host 0.0.0.0 --threads 2 --ctx-size 4096 --mlock --jinja --temp 1.1 --top-p 0.95 \
|
| 20 |
> llama_server.log 2>&1 &
|
| 21 |
|
| 22 |
+
sleep 3
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 23 |
|
| 24 |
+
echo "[LLAMA] 顯示最新日誌(含 TPS)..."
|
| 25 |
+
tail -n20 -F "$WORK/llama_server.log" | while read -r line; do
|
| 26 |
+
if [[ "$line" =~ ([0-9]+\.[0-9]+)\ t/s ]]; then
|
| 27 |
+
echo "[TPS] ${BASH_REMATCH[1]} t/s"
|
| 28 |
+
fi
|
| 29 |
+
done &
|
| 30 |
|
| 31 |
+
cd "$WORK"
|
| 32 |
+
python3 app.py
|