版本 1.5
GenAI Studio 版本 1.5 系列已經發行:
- 初始版 v1.5.0 已於 2026/09/09 發行。
- 尚未發行修訂版。
✨ 功能新增
LoRA 微調支援多張 GPU 的調度
此版本的 LoRA 微調功能開始支援多張 GPU 的自動調度。當模型無法以一張 GPU 進行 LoRA 微調時, 在具備多張 GPU 卡的硬體環境下,GenAI Studio 會自動調度多張 GPU 來進行模型微調, 讓使用者能夠更有效地利用多張 GPU 資源進行模型微調。
新增內建推論引擎
此版本內建的推論引擎在原先預設的 Ollama 之外,新增了 Phison aiDAPTIVLink 供使用者選擇。 該引擎以 vLLM 為核心進行擴充,除了天生就擁有 vLLM 令人讚賞的效能外,還具備了將 KV cache 資料 offload 至 AI SSD 的功能。
注意
- GenAI Studio 安裝之後預設的推論引擎仍為 Ollama。
- 要使用 Phison aiDAPTIVLink 當系統的推論引擎,GenAI Studio 的運行主機上必須已安裝 AI SSD,否則在對應的設定頁面中不會提供該選項。
🚀 功能強化
模型支援更新
此版本針對 LoRA 微調功能新增了大型語言模型的支援,包含了Qwen3.6-27B、 Qwen3.6-35B-A3B、以及 Qwen/Qwen3-Coder-30B-A3B-Instruct。 完整的模型支援清單請參閱 模型支援清單 的說明。
⚙️ 核心功能升級
- Phison 推論引擎: 導入 aiADPTIVLink3.0 NXUN303.AA 做為提供 KV cache offload 功能的內建推論引擎之一,供使用者於安裝後進行切換。
📦 第三方套件
GenAI Studio 使用以下第三方套件:
- dcgm-exporter (4.5.2-4.8.1-ubuntu22.04)
此套件將 GPU 的監控指標傳送給 Prometheus 進行搜集。 - Flowise (2.2.7-patch.2)
GenAI Studio 透過此套件提供自動化 RAGOps 的功能和工作流程。 - Grafana (12.3)
此套件將 Prometheus 搜集的監控數據展示成系統的資源監控儀表板。 - llama.cpp (full-cuda-b8882)
此套件提供 GenAI Studio 將模型轉換為 GGUF 檔案格式的能力。 - node-exporter (1.10.2)
此套件將所需的主機監控指標傳送給 Prometheus 進行搜集。 - Ollama (0.32.6)
此套件為 GenAI Studio 安裝後預設使用的模型推理伺服器。 - OpenVINO (2.1.0)
此套件提供將模型轉換為 OpenVINO 檔案格式的能力。 - Phison aiDAPTIVLink (NXUN205.A1/NXUN303.AA)
GenAI Studio 利用此套件提供使用者執行全參數模型微調功能 (NXUN205.A1), 以及推論時所需的 KV cache offload 功能 (NXUN303.AA)。 - PostgreSQL (16.13)
此套件提供關聯式資料庫的功能。 - Prometheus (3.10.0)
此套件會收集監控所需的所有指標數據以作為 Grafana 的資料來源。 - Qdrant (1.17)
此套件提供向量資料庫的儲存能力。 - Unsloth (2026.8.22)
GenAI Studio 利用此套件提供使用者對模型執行 LoRA 微調的能力。 - vsFTP (3.0.5)
此套件提供 GenAI Studio 將轉換過的模型檔案可讓外部系統進行下載的功能。