안녕하세요.
RNGD 환경에서 furiosa-llm 기반 custom model smoke test를 진행 중입니다.
표준 LLM(…).generate() 경로는 정상 동작하지만, fxb build를 이용한 custom build 경로에서 host native와 Docker container 양쪽 모두 동일한 에러가 발생하여 문의드립니다.
[환경]
- OS: Ubuntu 22.04.5 LTS
- Device: RNGD (furiosa-smi info 정상)
- Furiosa SDK / Furiosa-LLM: 2026.3.0
- Host native:
- Python venv 환경
- furiosa-llm==2026.3.0
- fxb 실행 가능
- Docker:
- furiosa-llm==2026.3.0
- build-essential, python3-dev 설치
- fxb 실행 가능
[정상 동작하는 항목]
표준 smoke 경로는 정상 동작합니다.
from furiosa_llm import LLM, SamplingParams
with LLM("furiosa-ai/Qwen2.5-0.5B-Instruct") as llm:
...
[문제가 발생하는 항목]
upstream/local model snapshot을 대상으로 FXB를 직접 build하는 경로에서 실패합니다.
예:
fxb build Qwen/Qwen3-8B-FP8 qwen3_8b_fp8 --tensor-parallel-size 1
local path 기준으로도 동일하게 실패합니다.
fxb build ~/unified-npu-sdk/furiosa-llm-only/models/Qwen3-8B-FP8 \
~/unified-npu-sdk/furiosa-llm-only/artifacts/qwen3_8b_fp8.fxb \
--tensor-parallel-size 1
[공통 에러]
host native와 Docker container 모두 아래와 같이 동일한 지점에서 실패합니다.
error: tcc subprocess failed (exit=Some(1)) for first_tokenwise/tw1:
...
[13/13] Compiling from resourcelir to edf
Compilation failed: No such file or directory (os error 2)
Location:
.../npu-compiler/src/compile/rlir_to_edf/c_compiler.rs:53:22
[추가 확인 사항]
- Docker 내부에서 아래 도구들은 모두 존재합니다.
- cc
- gcc
- g++
- make
- ld
- fxb --help 정상 동작
- Host native build summary에서는 아래 버전도 확인했습니다.
- furiosa-llm 2026.3.0
- furiosa-compiler 2026.3.0
- furiosa-kernels 2026.3.0
- tcc /home/etri/venv/furiosa-llm/bin/furiosa-tcc
[문의 사항]
- fxb build Qwen/Qwen3-8B-FP8 --tensor-parallel-size 1가 현재 2026.3.0 기준으로 공식 지원되는 시나리오인지 궁금합니다.
- 문서상의 설치 절차 외에 fxb build에 추가로 필요한 system package, binary, 또는 environment setting이 있는지 궁금합니다.
- 위 tcc subprocess failed / os error 2가 현재 릴리스의 known issue인지 확인 부탁드립니다.
- custom local model 사용 시, 현재 권장 workaround가 있다면 안내 부탁드립니다.
예:- fxb download / fxb check로 compatible prebuilt FXB 확보
- local model path + explicit fxb=… 방식으로 runtime 수행