찾다
기술 주변기기일체 포함NVIDIA RTX 그래픽 카드는 AI 추론 속도를 5배 향상시킵니다! RTX PC는 대형 모델을 로컬에서 쉽게 처리합니다.

Microsoft Iginte 글로벌 기술 컨퍼런스에서 Microsoft는 개발자가 하드웨어 성능을 최대한 활용하고 AI 응용 분야를 확장할 수 있도록 돕기 위해 일련의 새로운 AI 관련 최적화 모델 및 개발 도구 리소스를 출시했습니다.

특히 현재 AI 분야에서 절대적인 우위를 점하고 있는 엔비디아에 대해 마이크로소프트가 이번에 큰 선물 꾸러미를 보내왔습니다. OpenAI Chat API를 위한 TensorRT-LLM 패키징 인터페이스인지, RTX 드라이버의 성능 향상인지 Llama 2용 DirectML과 기타 널리 사용되는 LLM(대형 언어 모델)은 NVIDIA 하드웨어에서 더 나은 가속 및 애플리케이션을 달성할 수 있습니다.

NVIDIA RTX显卡AI推理提速5倍!RTX PC轻松在本地搞定大模型

그 중 TensorRT-LLM은 LLM 추론을 가속화하는 데 사용되는 라이브러리로, AI 추론 성능을 크게 향상시킬 수 있으며 점점 더 많은 언어 모델을 지원하기 위해 지속적으로 업데이트되고 있으며 오픈 소스이기도 합니다.

NVIDIA는 10월에 Windows 플랫폼용 TensorRT-LLM을 출시했습니다. RTX 30/40 시리즈 GPU 그래픽 카드가 장착된 데스크톱 및 노트북의 경우 그래픽 메모리가 8GB 이상이면 까다로운 AI 작업 부하를 더 쉽게 완료할 수 있습니다

이제 Windows용 Tensor RT-LLM은 새로운 패키징 인터페이스를 통해 OpenAI의 인기 있는 채팅 API와 호환될 수 있으므로 클라우드에 연결할 필요 없이 다양한 관련 애플리케이션을 로컬에서 직접 실행할 수 있어 PC에 보관하는 데 도움이 됩니다. 개인 정보 유출을 방지하기 위한 개인 및 독점 데이터입니다.

TensorRT-LLM에 최적화된 대규모 언어 모델이라면 Llama 2, Mistral, NV LLM 등을 포함하여 이 패키지 인터페이스와 함께 사용할 수 있습니다.

개발자의 경우 지루한 코드 재작성과 이식이 필요하지 않습니다. 코드 한두 줄만 수정하면 AI 애플리케이션이 로컬에서 빠르게 실행될 수 있습니다.

NVIDIA RTX显卡AI推理提速5倍!RTX PC轻松在本地搞定大模型

↑↑↑TensorRT-LLM 기반 Microsoft Visual Studio 코드 플러그인 - Continue.dev 코딩 도우미

TensorRT-LLM v0.6.0은 이번 달 말에 업데이트되어 RTX GPU의 추론 성능이 최대 5배 향상되고 새로운 70억 매개변수 Mistral, The 8을 포함하여 더 많은 인기 있는 LLM을 지원합니다. 10억 매개변수 Nemotron-3을 사용하면 데스크탑과 노트북에서 언제라도 빠르고 정확하게 LLM을 로컬에서 실행할 수 있습니다.

실제 측정 데이터에 따르면, TenroRT-LLM과 결합된 RTX 4060 그래픽 카드는 추론 성능이 초당 319개 토큰에 도달할 수 있는데, 이는 다른 백엔드의 초당 61개 토큰보다 4.2배 빠른 속도입니다.

RTX 4090은 초당 토큰에서 초당 829개의 토큰으로 2.8배 증가한 속도를 낼 수 있습니다.

NVIDIA RTX显卡AI推理提速5倍!RTX PC轻松在本地搞定大模型

강력한 하드웨어 성능, 풍부한 개발 생태계, 광범위한 애플리케이션 시나리오를 갖춘 NVIDIA RTX는 로컬 AI에 없어서는 안될 강력한 보조자가 되고 있습니다. 동시에 최적화, 모델 및 리소스가 지속적으로 풍부해지면서 수억 대의 RTX PC에서 AI 기능의 인기도 가속화되고 있습니다

현재 400개 이상의 파트너가 RTX GPU 가속을 지원하는 AI 애플리케이션과 게임을 출시했습니다. 모델의 사용 편의성이 계속 향상됨에 따라 Windows PC 플랫폼에 점점 더 많은 AIGC 기능이 나타날 것이라고 믿습니다.

NVIDIA RTX显卡AI推理提速5倍!RTX PC轻松在本地搞定大模型

위 내용은 NVIDIA RTX 그래픽 카드는 AI 추론 속도를 5배 향상시킵니다! RTX PC는 대형 모델을 로컬에서 쉽게 처리합니다.의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명
이 기사는 搜狐에서 복제됩니다. 침해가 있는 경우 admin@php.cn으로 문의하시기 바랍니다. 삭제
10 생성 AI 코드의 생성 AI 코딩 확장 대 코드를 탐색해야합니다.10 생성 AI 코드의 생성 AI 코딩 확장 대 코드를 탐색해야합니다.Apr 13, 2025 am 01:14 AM

이봐, 코딩 닌자! 하루 동안 어떤 코딩 관련 작업을 계획 했습니까? 이 블로그에 더 자세히 살펴보기 전에, 나는 당신이 당신의 모든 코딩 관련 문제에 대해 생각하기를 원합니다. 완료? - ’

요리 혁신 요리 : 인공 지능이 식품 서비스를 변화시키는 방법요리 혁신 요리 : 인공 지능이 식품 서비스를 변화시키는 방법Apr 12, 2025 pm 12:09 PM

AI 식품 준비 여전히 초기 사용 중이지만 AI 시스템은 음식 준비에 점점 더 많이 사용되고 있습니다. AI 구동 로봇은 부엌에서 햄버거를 뒤집기, 피자 만들기 또는 SA 조립과 같은 음식 준비 작업을 자동화하는 데 사용됩니다

파이썬 네임 스페이스 및 가변 범위에 대한 포괄적 인 안내서파이썬 네임 스페이스 및 가변 범위에 대한 포괄적 인 안내서Apr 12, 2025 pm 12:00 PM

소개 파이썬 기능에서 변수의 네임 스페이스, 범위 및 동작을 이해하는 것은 효율적으로 작성하고 런타임 오류 또는 예외를 피하는 데 중요합니다. 이 기사에서는 다양한 ASP를 탐구 할 것입니다

비전 언어 모델 (VLMS)에 대한 포괄적 인 안내서비전 언어 모델 (VLMS)에 대한 포괄적 인 안내서Apr 12, 2025 am 11:58 AM

소개 생생한 그림과 조각으로 둘러싸인 아트 갤러리를 걷는 것을 상상해보십시오. 이제 각 작품에 질문을하고 의미있는 대답을 얻을 수 있다면 어떨까요? “어떤 이야기를하고 있습니까?

Mediatek은 Kompanio Ultra 및 Dimensity 9400으로 프리미엄 라인업을 향상시킵니다.Mediatek은 Kompanio Ultra 및 Dimensity 9400으로 프리미엄 라인업을 향상시킵니다.Apr 12, 2025 am 11:52 AM

제품 케이던스를 계속하면서 이번 달 Mediatek은 새로운 Kompanio Ultra and Dimensity 9400을 포함한 일련의 발표를했습니다. 이 제품은 스마트 폰 용 칩을 포함하여 Mediatek 비즈니스의 전통적인 부분을 채우고 있습니다.

이번 주 AI : Walmart는 패션 트렌드를 설정하기 전에 패션 트렌드를 설정합니다.이번 주 AI : Walmart는 패션 트렌드를 설정하기 전에 패션 트렌드를 설정합니다.Apr 12, 2025 am 11:51 AM

#1 Google은 Agent2agent를 시작했습니다 이야기 : 월요일 아침입니다. AI 기반 채용 담당자로서 당신은 더 똑똑하지 않고 더 똑똑하지 않습니다. 휴대 전화에서 회사의 대시 보드에 로그인합니다. 세 가지 중요한 역할이 공급되고, 검증되며, 예정된 FO가 있음을 알려줍니다.

생성 AI는 사이코브블을 만난다생성 AI는 사이코브블을 만난다Apr 12, 2025 am 11:50 AM

나는 당신이되어야한다고 생각합니다. 우리 모두는 Psychobabble이 다양한 심리적 용어를 혼합하고 종종 이해할 수 없거나 완전히 무의미한 모듬 채터로 구성되어 있다는 것을 알고 있습니다. 당신이 fo를 뿌리기 위해해야 ​​할 일

프로토 타입 : 과학자들은 종이를 플라스틱으로 바꿉니다프로토 타입 : 과학자들은 종이를 플라스틱으로 바꿉니다Apr 12, 2025 am 11:49 AM

이번 주 발표 된 새로운 연구에 따르면 2022 년에 제조 된 플라스틱의 9.5%만이 재활용 재료로 만들어졌습니다. 한편, 플라스틱은 계속해서 매립지와 생태계에 전 세계에 쌓이고 있습니다. 그러나 도움이 진행 중입니다. 엥인 팀

See all articles

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

인기 기사

R.E.P.O. 에너지 결정과 그들이하는 일 (노란색 크리스탈)
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 최고의 그래픽 설정
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 아무도들을 수없는 경우 오디오를 수정하는 방법
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
WWE 2K25 : Myrise에서 모든 것을 잠금 해제하는 방법
4 몇 주 전By尊渡假赌尊渡假赌尊渡假赌

뜨거운 도구

WebStorm Mac 버전

WebStorm Mac 버전

유용한 JavaScript 개발 도구

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

Dreamweaver Mac版

Dreamweaver Mac版

시각적 웹 개발 도구

mPDF

mPDF

mPDF는 UTF-8로 인코딩된 HTML에서 PDF 파일을 생성할 수 있는 PHP 라이브러리입니다. 원저자인 Ian Back은 자신의 웹 사이트에서 "즉시" PDF 파일을 출력하고 다양한 언어를 처리하기 위해 mPDF를 작성했습니다. HTML2FPDF와 같은 원본 스크립트보다 유니코드 글꼴을 사용할 때 속도가 느리고 더 큰 파일을 생성하지만 CSS 스타일 등을 지원하고 많은 개선 사항이 있습니다. RTL(아랍어, 히브리어), CJK(중국어, 일본어, 한국어)를 포함한 거의 모든 언어를 지원합니다. 중첩된 블록 수준 요소(예: P, DIV)를 지원합니다.

Atom Editor Mac 버전 다운로드

Atom Editor Mac 버전 다운로드

가장 인기 있는 오픈 소스 편집기