상세 보기
대규모 언어모델의 건축환경분야 성능평가를 위한 벤치마크 구축과 관련한 탐색적 연구
An Exploratory Study of Benchmark Construction for Performance Evaluation of Large Language Models in the Building Environmental Domain
Citations
SCOPUS
0초록
본 연구는 대규모 언어모델(LLM)의 건축환경 분야 성능을 체계적으로 평가하기 위한 벤치마크 구축 방법을 제안하고, 이를 온디바이스 LLM에 실험적으로 적용한 탐색적 연구이다. 이에 따라, 전문가 합의 수준을 기준으로 벤치마크 문항을 ‘핵심 성능지표’와 ‘확장 성능지표’로 구분하는 이원화된 벤치마크 프레임워크를 제안하였다. 본 연구의 결과는 전문가 합의를 기반으로 구성된 이원화된 벤치마크가 LLM의 건축환경 도메인 지식 구조와 성능 특성을 진단하는 데 유용한 도구가 될 수 있음을 보여준다
키워드
Large language model; Built Environment; Benchmark; Domain Performance Evaluation; Expert Consensus; 대형언어모델; 건축환경; 벤치마크; 도메인 성능평가; 전문가 합의
- 제목
- 대규모 언어모델의 건축환경분야 성능평가를 위한 벤치마크 구축과 관련한 탐색적 연구
- 제목 (타언어)
- An Exploratory Study of Benchmark Construction for Performance Evaluation of Large Language Models in the Building Environmental Domain
- 저자
- 정창헌
- 발행일
- 2026-05
- 유형
- Y
- 저널명
- 대한건축학회논문집
- 권
- 42
- 호
- 5
- 페이지
- 291 ~ 299