跳至主要内容
版本:1.5.0

版本 1.5

GenAI Studio 版本 1.5 系列已經發行:

  • 初始版 v1.5.0 已於 2026/09/09 發行。
  • 尚未發行修訂版。

✨ 功能新增​

LoRA 微調支援多張 GPU 的調度​

此版本的 LoRA 微調功能開始支援多張 GPU 的自動調度。當模型無法以一張 GPU 進行 LoRA 微調時, 在具備多張 GPU 卡的硬體環境下,GenAI Studio 會自動調度多張 GPU 來進行模型微調, 讓使用者能夠更有效地利用多張 GPU 資源進行模型微調。

新增內建推論引擎​

此版本內建的推論引擎在原先預設的 Ollama 之外,新增了 Phison aiDAPTIVLink 供使用者選擇。 該引擎以 vLLM 為核心進行擴充,除了天生就擁有 vLLM 令人讚賞的效能外,還具備了將 KV cache 資料 offload 至 AI SSD 的功能。

注意
  1. GenAI Studio 安裝之後預設的推論引擎仍為 Ollama。
  2. 要使用 Phison aiDAPTIVLink 當系統的推論引擎,GenAI Studio 的運行主機上必須已安裝 AI SSD,否則在對應的設定頁面中不會提供該選項。

🚀 功能強化​

模型支援更新​

此版本針對 LoRA 微調功能新增了大型語言模型的支援,包含了Qwen3.6-27B、 Qwen3.6-35B-A3B、以及 Qwen/Qwen3-Coder-30B-A3B-Instruct。 完整的模型支援清單請參閱 模型支援清單 的說明。

⚙️ 核心功能升級​

  • Phison 推論引擎: 導入 aiADPTIVLink3.0 NXUN303.AA 做為提供 KV cache offload 功能的內建推論引擎之一,供使用者於安裝後進行切換。

📦 第三方套件​

GenAI Studio 使用以下第三方套件:

  • dcgm-exporter (4.5.2-4.8.1-ubuntu22.04)
    此套件將 GPU 的監控指標傳送給 Prometheus 進行搜集。
  • Flowise (2.2.7-patch.2)
    GenAI Studio 透過此套件提供自動化 RAGOps 的功能和工作流程。
  • Grafana (12.3)
    此套件將 Prometheus 搜集的監控數據展示成系統的資源監控儀表板。
  • llama.cpp (full-cuda-b8882)
    此套件提供 GenAI Studio 將模型轉換為 GGUF 檔案格式的能力。
  • node-exporter (1.10.2)
    此套件將所需的主機監控指標傳送給 Prometheus 進行搜集。
  • Ollama (0.32.6)
    此套件為 GenAI Studio 安裝後預設使用的模型推理伺服器。
  • OpenVINO (2.1.0)
    此套件提供將模型轉換為 OpenVINO 檔案格式的能力。
  • Phison aiDAPTIVLink (NXUN205.A1/NXUN303.AA)
    GenAI Studio 利用此套件提供使用者執行全參數模型微調功能 (NXUN205.A1), 以及推論時所需的 KV cache offload 功能 (NXUN303.AA)。
  • PostgreSQL (16.13)
    此套件提供關聯式資料庫的功能。
  • Prometheus (3.10.0)
    此套件會收集監控所需的所有指標數據以作為 Grafana 的資料來源。
  • Qdrant (1.17)
    此套件提供向量資料庫的儲存能力。
  • Unsloth (2026.8.22)
    GenAI Studio 利用此套件提供使用者對模型執行 LoRA 微調的能力。
  • vsFTP (3.0.5)
    此套件提供 GenAI Studio 將轉換過的模型檔案可讓外部系統進行下載的功能。