English | 로그인 ㅣ ID/비번 찾기 ㅣ 회원가입/이메일 재인증
Home

엔비디아, 실시간 대화형 AI 지원하는 텐서RT 최신 버전 공개

2019/12/19 10:00:08

엔비디아(CEO 젠슨 황)가 실시간 대화형 AI를 지원하는 추론 소프트웨어의 최신 버전인 엔비디아 텐서RT 7(NVIDIA TensorRT 7)을 발표했다. 이는 전세계 개발자들이 대화형 AI 애플리케이션을 제공하는데 사용되어, 그간 인간과 AI간 상호작용에 걸림돌이 됐던 추론 레이턴시(지연시간)를 크게 개선할 것으로 기대된다.

 

엔비디아 텐서RT 7은 엔비디아의 7세대 추론 소프트웨어 개발 키트로, 보다 스마트한 인간과 AI간 상호작용을 가능케 해, 음성 에이전트(voice agent), 챗봇, 추천 엔진 등의 애플리케이션을 실시간으로 구현할 수 있게 됐다.

미국 시장조사기관 주니퍼 리서치(Juniper Research)에 따르면, 전세계 디바이스에서 약 32억5천만 개의 디지털 음성 비서가 사용되고 있는 것으로 추정된다. 2023년까지 그 숫자가 세계 총 인구 수를 뛰어 넘는 80억 개까지 증가할 것으로 예상된다.

 

텐서RT 7은 AI 음성 애플리케이션을 구현하는데 필요한 트랜스포머(transformer) 기반 RNN(Recurrent Neural Network, 순환신경망)을 자동으로 최적화하고 가속화하도록 설계된 최신 딥 러닝 컴파일러를 제공한다. 이를 통해, 대화형 AI의 구성요소가 CPU에서 실행될 때 보다 10배 이상 빨라진다. 동시에, 지연시간은 실시간 상호작용에 필요한 수준인 300 밀리 초 임계값 미만으로 단축된다.

텐서RT 7은 RNN이라는 순환 루프 구조(recurrent loop structures)를 사용하는 시계열(time-series) 시퀀스 데이터 시나리오(sequence-data scenarios)를 예측하는 용도로 활용되는 AI 모델 세계가 더 빠르게 확장될 수 있도록 지원한다. RNN은 대화형 AI 음성 네트워크 외에도 차량이나 위성의 도착 시간 계획, 전자 의료 기록에 기입될 상황 예측, 금융자산 예측, 사기행위 감지 등의 목적에도 사용될 수 있다.

RNN 구성과 기능이 결합되는 상황이 폭발적으로 증가하면서, 실시간 성능 기준을 충족하는 생산 코드(production code)를 빠르게 배포해야 하는 상황이 발생하게 됐다. 이로 인해 업무를 진행하는데 수개월이 지연되고 개발자들은 코드 최적화 작업을 수동으로 해야 했다. 그 결과, 대화형 AI 실행능력을 갖춘 소수 업체들만 대화형 AI를 구현할 수 있었다.

 

텐서RT의 최신 딥 러닝 컴파일러를 통해, 전세계 개발자들은 맞춤형 자동 음성인식 네트워크와 텍스트-투-스피치(text-to-speech)용 웨이브RNN(WaveRNN)과 타코트론 2(Tacotron 2) 등의 네트워크를 자동 최적화할 수 있는 능력을 갖추게 됐고, 이를 통해 최고 수준의 성능을 최저 지연시간에 제공할 수 있게 됐다.

이 최신 컴파일러는 BERT와 같은 자연어 처리용 트랜스포머를 최적화하는 기능도 제공한다.

 

텐서RT 7은 하이퍼스케일 데이터 센터, 내장형 또는 자동차용 GPU 플랫폼을 통해 훈련된 추론 신경망을 빠르게 최적화, 검증, 배포할 수 있다.

텐서RT를 비롯한 여러 엔비디아 쿠다-X AI 라이브러리(NVIDIA CUDA-X AI libraries), 엔비디아 GPU 등이 포함된 엔비디아 추론 플랫폼은 이미지 분류, 사기 탐지, 분할, 오브젝트 탐지, 추천 엔진 등 저지연, 고처리량 추론 기능을 대화형 AI 이외의 애플리케이션에서도 구현한다.

엔비디아 추론 플랫폼은 알리바바(Alibaba), 아메리칸 익스프레스(American Express), 바이두(Baidu), 페이팔(PayPal), 핀터레스트(Pinterest), 스냅(Snap), 텐센트(Tencent), 트위터(Twitter) 등 세계적인 선도 엔터프라이즈 및 소비자 기술 기업들 사이에서 널리 사용되고 있다.

Tweet

#엔비디아


케이벤치 많이 본 기사
  [뉴스] 갤럭시S25 엣지 배터리 테스트 결과 발표… '무난한 수준'
  [기획] 티포스가 통하면 시장이 움직인다 '팀그룹' 한국 메모리 시장서 존재감 각인
  [뉴스] 초슬림 '갤럭시S25 엣지' 유럽서 흥행 성공할까?
  [뉴스] 삼성 최신 갤럭시 러기드폰 '갤럭시 XCover7 Pro' 15일 미국서 출시
  [뉴스] 갤럭시S25 엣지, 삼성 SDI '3900mAh' 배터리 전량 탑재
  [기획] 게이밍 환경을 위한 메인스트림 라라랜드 PC 구성, 어느정도 돌아갈까? R5 9600X+RX 9070
  [뉴스] 갤럭시S26 두뇌 '스냅드래곤 8 엘리트 2세대' 9월 23일 공개 확정
  [뉴스] 차기 '갤럭시Z 폴드7' 실물 사진 중국서 유출
  [뉴스] 삼성전자, 차기 '갤럭시S25 FE' 셀카 힘주나? 12MP 카메라 탑재
  [기획] 다양한 환경에서 편의성 증대를 위한 넘버 패드, COX CKP01 PRO
  [뉴스] 유럽서 주행 테스트 중인 제네시스 'GV90' 프로토타입 포착
  [뉴스] 갤럭시S26 울트라, 인물 모드에 가상 조리개 지원 추가하나
Copyrightⓒ 넥스젠리서치(주) 케이벤치 미디어국. www.kbench.com 인쇄 목록 위로
케이벤치 기자 / pr@kbench.com

연관기사 보기
  엔비디아 또 당했나? RTX 5060 가격에 라데온 RX 9060 XT 8GB 투입
  엔비디아, 블랙웰·쿠다-X로 반도체 설계 제조 가속화
  엔비디아, AI 팩토리 디지털 트윈용 옴니버스 블루프린트 지원 확대
  엔비디아, 옴니버스 디지털 트윈으로 대만 제조업체 산업용 AI 가속화
  엔비디아, 세계 최대 규모 양자 연구용 슈퍼컴퓨터 ‘ABCI-Q’ 지원
  엔비디아, 물리 AI 위한 클라우드-로봇 컴퓨팅 플랫폼으로 휴머노이드 로봇 산업 혁신
  엔비디아, AI 플랫폼 ‘DGX 클라우드 렙톤’ 출시
  엔비디아, AI 데이터 플랫폼으로 스토리지 선도기업 AI 인프라 구축 지원
  엔비디아, 개인용 AI 슈퍼컴퓨터 ‘DGX 스파크, ‘DGX 스테이션’ 공개
  엔비디아, RTX PRO 서버로 AI 팩토리 구축 가속화
  엔비디아, 세미커스텀 AI 인프라 구축 지원하는 ‘NV링크 퓨전’ 출시
  지포스 RTX 5060 성능 프리뷰 등장, 깡성능 20% 개선 예상
케이벤치 이벤트/공지사항
 
[일반공지]2025/04/03 사내 워크샵으로 인한 휴뮤 안내
[일반공지]케이벤치 컨텐츠 제작자/기자 채용 공고
[공지사항][이벤트 당첨 발표] 신년 3차 착한일 이벤트 당첨자 발표
[공지사항][이벤트 당첨 발표] 신년 2차 덕담 이벤트 당첨자 발표
[공지사항][이벤트 당첨 발표] 신년 1차 장비자랑 이벤트 당첨자 발표
[이벤트][이벤트] 케이벤치 베스트 어워드 및 2022년 신년 이벤트

케이벤치 많이 본 기사 TOP 10
뉴스
기사
스팀 계정 8900만명 개인정보 유출? 스팀 입장문 발표
'갤럭시Z 폴드7' 초슬림 디자인 위해 S펜 디지타이저 빼고 티타늄 백플레이트 탑재 가능성
갤럭시S26 두뇌 '스냅드래곤 8 엘리트 2세대' 9월 23일 공개 확정
삼성전자, 차기 '갤럭시S25 FE' 셀카 힘주나? 12MP 카메라 탑재
초슬림 '갤럭시S25 엣지' 유럽서 흥행 성공할까?
갤럭시S25 엣지, 삼성 SDI '3900mAh' 배터리 전량 탑재
삼성전자, 갤럭시S26 탑재 2나노 '엑시노스 2600' 하반기 양산 계획
삼성전자, 갤럭시 기기용 '이미지 to 비디오' AI 기능 개발 중
삼성 최신 갤럭시 러기드폰 '갤럭시 XCover7 Pro' 15일 미국서 출시
갤럭시S25 엣지 배터리 테스트 결과 발표… '무난한 수준'
뉴스
기사
티포스가 통하면 시장이 움직인다 '팀그룹' 한국 메모리 시장서 존재감 각인
게이밍 환경을 위한 메인스트림 라라랜드 PC 구성, 어느정도 돌아갈까? R5 9600X+RX 9070
어항케이스와 우드패널의 완벽한 조합, 마이크로닉스 WIZMAX 우드리안 MAX
한 눈에 들어오는 고주사율 홈 게이밍 모니터, 제이씨현 UDEA EDGE ED2420GT 유케어 IPS 홈게임 180
대만산은 싸구려 취급하던 한국산 그래픽카드 전성시대,우리나라 그래픽카드시장 변화 이야기 [PC흥망사 12-1]
다양한 환경에서 편의성 증대를 위한 넘버 패드, COX CKP01 PRO
벌크, 비정품 CPU의 유혹, 합리적 소비도 정품을 선택해야 하는 이유
디자인도 성능도 만족, ESSENCORE KLEVV DDR5-6400 CL32 URBANE V RGB
최상위 CPU도 든든하게 받쳐 주는 가성비 X870E 메인보드, MSI MAG X870E 토마호크 WIFI
PC업계가 게이밍 마케팅 꿀을 그만 빨고 새로운 메시지를 내놓아야 하는 이유