레드햇, '레드햇 AI 3.5' 출시…AI 안전·비용 한곳서 관리

모델 배포 전 위험 검증부터 GPU 사용량·추론 성능 관측까지 지원

컴퓨팅입력 :2026/09/10 15:06

레드햇이 기업 인공지능(AI) 서비스를 안전하게 운영하고 성능과 비용을 실시간으로 관리할 수 있는 플랫폼을 내놨다. 

레드햇은 하이브리드 클라우드 환경에서 기업용 AI 워크로드 안전성과 관측성을 강화한 '레드햇 AI 3.5'를 출시했다고 10일 밝혔다. 

레드햇 AI 3.5는 '에벌허브'를 통해 AI 모델을 서비스에 적용하기 전에 안전성을 검증한다. 위험도에 따른 안전성 평가를 수행하고 규제 준수 여부를 확인할 수 있는 인증서도 생성한다.

레드햇이 기업 인공지능(AI) 서비스를 안전하게 운영하고 성능과 비용을 실시간으로 관리할 수 있는 플랫폼을 내놨다. (사진=레드햇)

새로운 관측성 대시보드는 AI 모델의 추론 상태와 그래픽처리장치(GPU) 사용률·성능 지표를 실시간으로 보여준다. 일반 사용자도 '쇼백' 대시보드에서 개인별 토큰 사용량을 확인할 수 있어 부서나 이용자별 AI 비용을 투명하게 관리할 수 있다.

레드햇은 AI 인프라 공유를 위한 멀티테넌시 기능도 강화했다. 공유 GPU 환경에서 업무 우선순위에 따라 연산 자원을 배분하며 조직별로 전용 클러스터 제어 환경을 제공해 데이터와 워크로드를 분리하는 식이다.

이 플랫폼은 보안 수준이 높은 기업을 위해 가상머신 단위 격리 기능도 지원한다. 인프라 제공업체는 여러 조직의 AI 환경을 하나의 관리 지점에서 운영하고 업데이트할 수 있다. 이를 통해 각 조직에 독립된 실행 환경 조성이 가능하다. 

레드햇은 레드햇 AI 3.5에 기업용 AI 에이전트 개발 기능도 확대했다. '오토RAG'는 기업 내부 데이터 저장소를 AI 에이전트와 연결한다. 다국어 문서 처리와 대화형 테스트 및 문맥 기반 검색도 지원한다. 사용자는 시각화된 파이프라인에서 검색증강생성(RAG) 구성을 점검한 뒤 배포할 수 있다.

관련기사

이 플랫폼은 코드 검토와 문서 처리·정보 조사 등 기업에서 자주 사용하는 업무를 위한 에이전트 템플릿도 제공한다. 배포 후에는 '추론 시점 확장' 기능이 질문의 복잡도에 맞춰 연산 자원을 조절해 GPU 비용을 줄인다.

조 페르난데스 레드햇 AI 사업부 부사장 겸 총괄 매니저는 "우리는 레드햇 AI 3.5를 통해 IT 리더들이 하이브리드 클라우드 전반에서 AI를 안전하고 통제되며 책임성 있는 엔터프라이즈 AI 아키텍처로 운영하는 데 필요한 운영 제어력과 검증 가능한 신뢰성 및 에이전틱 기반을 제공할 것"이라고 말했다.