미세 조정 라마 2 : 큰 언어 모델 사용자 정의에 대한 단계별 안내서-일체 포함-php.cn

집

기술 주변기기

일체 포함

미세 조정 라마 2 : 큰 언어 모델 사용자 정의에 대한 단계별 안내서

William Shakespeare

Mar 09, 2025 am 11:09 AM

Meta의 Llama는 GPT-3.5와 같은 모델과 같은 대형 언어 모델 (LLM) 개발의 급증을 촉발시켰다. 오픈 소스 커뮤니티는 점점 더 강력한 모델을 빠르게 생산했지만 이러한 발전은 어려움이 없었습니다. 많은 오픈 소스 LLM은 제한 라이센스 (연구 사용 만)를 가지고 있었고, 미세 조정을위한 상당한 예산이 필요했으며, 배치하는 데 비용이 많이 들었다. 이 안내서는 자원 제약을 극복하기 위해 효율적인 기술을 활용하여 Google Colab에서 미세 조정 LLAMA-2를 보여줍니다. 우리는 메모리 사용을 최소화하고 훈련을 가속화하는 방법론을 탐구 할 것입니다.

Dall-e 3

를 사용하여 저자가 생성 한 이미지 미세 조정 llama-2 : 단계별 안내서 이 튜토리얼은 T4 GPU (Google Colab 또는 Kaggle에서 사용할 수 있음)에서 7 억 개의 매개 변수 LLAMA-2 모델을 미세 조정합니다. T4의 16GB VRAM은 특히 Qlora (4 비트 정밀도)를 사용하여 매개 변수 효율적인 미세 조정이 필요합니다. 우리는 Hugging Face 생태계 (Transformers, Accelerate, Peft, TRL, Bitsandbytes)를 사용합니다. 1. 설정 : 필요한 라이브러리를 설치하십시오 :

가져 오기 모듈 :

2. 모델 및 데이터 세트 선택 :

우리는

(공식 llama-2에 쉽게 액세스 할 수있는 A)를 기본 모델로 사용하고 소규모 훈련 데이터 세트로 를 사용할 것입니다.

포옹 얼굴 모델과 데이터 세트를 보여주는 이미지는 여기에 원본과 동일합니다. 3. 데이터 및 모델로드 : 데이터 세트를로드하십시오

Qlora를 사용하여 4 비트 양자화를 구성하십시오

4 비트 양자화로 LLAMA-2 모델을로드하십시오

토큰 화기를로드하십시오 : Qlora를 설명하는 이미지 이미지는 여기에 원본과 동일합니다 4. PEFT 구성 : 효율적인 미세 조정을 위해 PEFT 매개 변수를 정의합니다

5. 훈련 매개 변수 :

는 훈련 하이퍼 파라미터 (출력 디렉토리, 에포크, 배치 크기, 학습 속도 등)를 설정합니다. 세부 사항은 원본과 동일합니다.

<code>%%capture
%pip install accelerate peft bitsandbytes transformers trl</code>

6. sft로 미세 조정 :

감독 된 미세 조정을 위해 TRL 라이브러리의 를 사용하십시오.

<code>import os
import torch
from datasets import load_dataset
from transformers import (
    AutoModelForCausalLM,
    AutoTokenizer,
    BitsAndBytesConfig,
    TrainingArguments,
    pipeline,
    logging,
)
from peft import LoraConfig
from trl import SFTTrainer</code>

훈련 진행 및 모델 저장을 보여주는 스크린 샷은 여기에 원본과 동일합니다. 7. 평가 :

파이프 라인을 사용하여 미세 조정 모델을 테스트하십시오. 원본과 동일한 예제가 제공됩니다 transformers 8. Tensorboard 시각화 :

Tensorboard를 시작하여 교육 메트릭을 모니터링합니다

Tensorboard의 스크린 샷은 여기에 원본과 동일합니다 결론 :

이 안내서는 제한된 하드웨어에서 효율적인 LLAMA-2 미세 조정을 보여줍니다. Qlora 및 기타 기술을 사용하면 더 많은 청중이 고급 LLM에 액세스 할 수 있습니다. 추가 리소스와 학습 경로는 결국 원본과 유사하지만 마케팅 전화가없는 경우에 언급되어 있습니다.

위 내용은 미세 조정 라마 2 : 큰 언어 모델 사용자 정의에 대한 단계별 안내서의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명

본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

관련 기사

6 MCP의 보안 위험 : 주요 취약성 식별 - 분석 VidhyaMay 08, 2025 am 09:32 AM

MCP (Model Context Protocol) : AI 에이전트를위한 보안 지뢰밭 종종 "AI 에이전트 용 USB-C"라고 불리는 MCP (Model Context Protocol)는 LLMS (Large Tools)를 외부 도구 및 데이터와 연결하는 표준입니다. 이것은 허용합니다

에이전트 걸레를 사용하여 지능형 FAQ 챗봇을 만드는 방법May 07, 2025 am 11:28 AM

AI 에이전트는 이제 크고 작은 기업의 일부입니다. 병원의 양식 작성 및 법률 문서 확인에서 비디오 장면 분석 및 고객 지원 처리에 이르기까지 모든 종류의 작업에 대한 AI 에이전트가 있습니다. 동료

공황에서 권력으로 : AI 시대에 리더가 배워야하는 어떤 지도자May 07, 2025 am 11:26 AM

인생은 좋다. 예측 가능 - 당신의 분석적 마음이 그것을 선호하는 방식으로. 당신은 오늘 사무실에 들려 마지막 순간의 서류를 마무리했습니다. 그 후 바로 당신은 파트너와 아이들을 햇볕이 잘 드는 휴가를 보내고 있습니다.

AGI를 예측하는 증거 수렴이 AI 전문가들의 과학적 합의를 능가 할 것이라고 왜May 07, 2025 am 11:24 AM

그러나 과학적 합의에는 딸꾹질과 gotchas가 있으며, 아마도 더 신중한 접근 방식은 양심으로도 알려진 증거의 수렴을 사용하는 것일 것입니다. 그것에 대해 이야기합시다. 혁신적인 AI 혁신에 대한이 분석은 나의

Studio Ghibli Dilemma - 생성 시대의 저작권 AIMay 07, 2025 am 11:19 AM

Openai 나 Studio Ghibli는이 이야기에 대한 의견 요청에 응답하지 않았습니다. 그러나 그들의 침묵은 창조적 인 경제에서 더 넓고 복잡한 긴장을 반영합니다. 생성 AI 시대에 저작권은 어떻게 기능해야합니까? 같은 도구와 함께

Mulesoft는 아연 도금 에이전트 AI 연결을위한 믹스를 공식화합니다May 07, 2025 am 11:18 AM

콘크리트와 소프트웨어는 모두 필요한 경우 강력한 성능을 위해 아연 도금 될 수 있습니다. 둘 다 스트레스 테스트를 할 수 있으며, 둘 다 시간이 지남에 따라 균열과 균열로 고통받을 수 있으며, 둘 다 분해되어 두 기능의 생산 인 "새로운 빌드"로 재현 할 수 있습니다.

Openai는 Windsurf를 구매하기 위해 30 억 달러의 계약을 체결 한 것으로 알려졌다May 07, 2025 am 11:16 AM

그러나 많은보고는 매우 표면 수준에서 멈 춥니 다. Windsurf가 무엇인지 알아 내려고한다면 Google 검색 엔진 결과 상단에 표시되는 신디케이트 된 콘텐츠에서 원하는 것을 얻지 못할 수도 있습니다.

모든 미국 어린이를위한 필수 AI 교육? 250 명 이상의 CEO가 예라고 말합니다May 07, 2025 am 11:15 AM

주요 사실 공개 서한에 서명 한 리더에는 Adobe, Accenture, AMD, American Airlines, Blue Origin, Cognizant, Dell, Dropbox, IBM, LinkedIn, Lyft, Microsoft, Salesforce, Uber, Yahoo 및 Zoom과 같은 유명 회사의 CEO가 포함됩니다.

See all articles