찾다
기술 주변기기일체 포함배치 정규화와 레이어 정규화의 차이점

배치 정규화와 레이어 정규화의 차이점

정규화는 신경망에서 그라디언트가 폭발하거나 사라지는 문제를 해결하는 데 자주 사용됩니다. 모든 값이 동일한 척도 또는 분포에 있도록 특성 값을 [0,1] 범위로 매핑하여 작동합니다. 간단히 말해서 정규화는 신경망에 대한 입력을 정규화하고 훈련 속도를 높입니다.

두 가지 유형의 정규화

정규화 기술에는 주로 두 가지 유형이 있습니다. 우리는 일반적으로 입력을 처리하기 위해 비선형 활성화 함수를 사용합니다. 그리고 특정 계층의 각 뉴런에 대해 평균과 단위 표준편차가 0이 되도록 사전 활성화할 수 있습니다. 이는 입력 특성의 미니 배치에 대해 평균 빼기 및 표준 편차 나누기를 수행하여 달성할 수 있습니다.

    그러나 모든 사전 활성화를 모든 배치에 대해 0과 단위 표준 편차로 강제하는 것은 너무 엄격할 수 있으므로 특정 변동 분포를 도입하면 네트워크 학습에 더 도움이 될 수 있습니다.
  • 이 문제를 해결하기 위해 배치 정규화에는 배율 인자 감마(γ)와 오프셋 베타(β)라는 두 가지 매개변수가 도입되는데, 둘 다 학습 가능한 매개변수입니다.
  • 배치 정규화에서는 배치 통계 사용에 주의해야 합니다. 배치 크기가 작으면 표본 평균과 표준 편차가 실제 분포를 나타내기에 충분하지 않아 네트워크가 의미 있는 내용을 학습하지 못하게 됩니다. 따라서 보다 정확한 통계를 얻기 위해서는 배치 크기를 충분히 크게 하여 모델의 성능과 학습을 향상시켜야 합니다.

레이어 정규화(Layer Normalization)

레이어 정규화는 연구원 Jimmy Lei Ba, Jamie Ryan Kiros 및 Geoffrey E. Hinton이 제안한 방법입니다. 이 방법의 핵심 아이디어는 특정 계층의 모든 뉴런에 대해 주어진 입력의 모든 특징에 대해 동일한 분포를 갖는 것입니다. 배치 정규화와 달리 레이어 정규화는 각 샘플의 특징 차원에 대해 정규화 작업을 수행합니다. 입력 특징에 대한 각 뉴런의 평균과 분산을 계산하여 이 레이어의 출력을 정규화합니다. 이 방법은 모델이 소규모 데이터 배치에 적응하고 모델의 일반화 능력을 향상시키는 데 도움이 될 수 있습니다. 레이어 정규화의 장점은 모든 기능을 정규화하기 위해 배치에 의존하지 않고 각 입력을 특정 레이어로 정규화하여 배치에 대한 의존성을 제거한다는 것입니다. 이로 인해 계층 정규화는 널리 사용되는 Transformer 및 RNN(Recurrent Neural Networks)과 같은 시퀀스 모델에 매우 적합합니다.

배치 정규화와 레이어 정규화의 주요 차이점

1. 배치 정규화는 각 기능을 미니 배치로 독립적으로 정규화합니다. 레이어 정규화는 모든 기능에 걸쳐 배치의 각 입력을 독립적으로 정규화합니다.

2. 배치 정규화는 배치 크기에 따라 달라지므로 작은 배치에는 효과적이지 않습니다. 레이어 정규화는 배치 크기에 독립적이므로 더 작은 크기의 배치에도 적용할 수 있습니다.

3. 배치 정규화에는 훈련 및 추론 중에 다른 처리가 필요합니다. 레이어 정규화는 특정 레이어의 입력 길이에 따라 수행되므로 훈련 및 추론 시 동일한 작업 세트를 사용할 수 있습니다.

위 내용은 배치 정규화와 레이어 정규화의 차이점의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

성명
이 기사는 网易伏羲에서 복제됩니다. 침해가 있는 경우 admin@php.cn으로 문의하시기 바랍니다. 삭제
요리 혁신 요리 : 인공 지능이 식품 서비스를 변화시키는 방법요리 혁신 요리 : 인공 지능이 식품 서비스를 변화시키는 방법Apr 12, 2025 pm 12:09 PM

AI 식품 준비 여전히 초기 사용 중이지만 AI 시스템은 음식 준비에 점점 더 많이 사용되고 있습니다. AI 구동 로봇은 부엌에서 햄버거를 뒤집기, 피자 만들기 또는 SA 조립과 같은 음식 준비 작업을 자동화하는 데 사용됩니다

파이썬 네임 스페이스 및 가변 범위에 대한 포괄적 인 안내서파이썬 네임 스페이스 및 가변 범위에 대한 포괄적 인 안내서Apr 12, 2025 pm 12:00 PM

소개 파이썬 기능에서 변수의 네임 스페이스, 범위 및 동작을 이해하는 것은 효율적으로 작성하고 런타임 오류 또는 예외를 피하는 데 중요합니다. 이 기사에서는 다양한 ASP를 탐구 할 것입니다

비전 언어 모델 (VLMS)에 대한 포괄적 인 안내서비전 언어 모델 (VLMS)에 대한 포괄적 인 안내서Apr 12, 2025 am 11:58 AM

소개 생생한 그림과 조각으로 둘러싸인 아트 갤러리를 걷는 것을 상상해보십시오. 이제 각 작품에 질문을하고 의미있는 대답을 얻을 수 있다면 어떨까요? “어떤 이야기를하고 있습니까?

Mediatek은 Kompanio Ultra 및 Dimensity 9400으로 프리미엄 라인업을 향상시킵니다.Mediatek은 Kompanio Ultra 및 Dimensity 9400으로 프리미엄 라인업을 향상시킵니다.Apr 12, 2025 am 11:52 AM

제품 케이던스를 계속하면서 이번 달 Mediatek은 새로운 Kompanio Ultra and Dimensity 9400을 포함한 일련의 발표를했습니다. 이 제품은 스마트 폰 용 칩을 포함하여 Mediatek 비즈니스의 전통적인 부분을 채우고 있습니다.

이번 주 AI : Walmart는 패션 트렌드를 설정하기 전에 패션 트렌드를 설정합니다.이번 주 AI : Walmart는 패션 트렌드를 설정하기 전에 패션 트렌드를 설정합니다.Apr 12, 2025 am 11:51 AM

#1 Google은 Agent2agent를 시작했습니다 이야기 : 월요일 아침입니다. AI 기반 채용 담당자로서 당신은 더 똑똑하지 않고 더 똑똑하지 않습니다. 휴대 전화에서 회사의 대시 보드에 로그인합니다. 세 가지 중요한 역할이 공급되고, 검증되며, 예정된 FO가 있음을 알려줍니다.

생성 AI는 사이코브블을 만난다생성 AI는 사이코브블을 만난다Apr 12, 2025 am 11:50 AM

나는 당신이되어야한다고 생각합니다. 우리 모두는 Psychobabble이 다양한 심리적 용어를 혼합하고 종종 이해할 수 없거나 완전히 무의미한 모듬 채터로 구성되어 있다는 것을 알고 있습니다. 당신이 fo를 뿌리기 위해해야 ​​할 일

프로토 타입 : 과학자들은 종이를 플라스틱으로 바꿉니다프로토 타입 : 과학자들은 종이를 플라스틱으로 바꿉니다Apr 12, 2025 am 11:49 AM

이번 주 발표 된 새로운 연구에 따르면 2022 년에 제조 된 플라스틱의 9.5%만이 재활용 재료로 만들어졌습니다. 한편, 플라스틱은 계속해서 매립지와 생태계에 전 세계에 쌓이고 있습니다. 그러나 도움이 진행 중입니다. 엥인 팀

AI 분석가의 부상 : AI 혁명에서 이것이 가장 중요한 일이 될 수있는 이유AI 분석가의 부상 : AI 혁명에서 이것이 가장 중요한 일이 될 수있는 이유Apr 12, 2025 am 11:41 AM

최근 Enterprise Analytics 플랫폼 Alteryx의 CEO 인 Andy MacMillan과의 대화는 AI 혁명 에서이 비판적이면서도 저평가 된 역할을 강조했습니다. MacMillan에서 설명했듯이 원시 비즈니스 데이터와 AI-Ready Informat의 격차

See all articles

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

인기 기사

R.E.P.O. 에너지 결정과 그들이하는 일 (노란색 크리스탈)
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 최고의 그래픽 설정
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 아무도들을 수없는 경우 오디오를 수정하는 방법
3 몇 주 전By尊渡假赌尊渡假赌尊渡假赌
WWE 2K25 : Myrise에서 모든 것을 잠금 해제하는 방법
4 몇 주 전By尊渡假赌尊渡假赌尊渡假赌

뜨거운 도구

SublimeText3 Mac 버전

SublimeText3 Mac 버전

신 수준의 코드 편집 소프트웨어(SublimeText3)

DVWA

DVWA

DVWA(Damn Vulnerable Web App)는 매우 취약한 PHP/MySQL 웹 애플리케이션입니다. 주요 목표는 보안 전문가가 법적 환경에서 자신의 기술과 도구를 테스트하고, 웹 개발자가 웹 응용 프로그램 보안 프로세스를 더 잘 이해할 수 있도록 돕고, 교사/학생이 교실 환경 웹 응용 프로그램에서 가르치고 배울 수 있도록 돕는 것입니다. 보안. DVWA의 목표는 다양한 난이도의 간단하고 간단한 인터페이스를 통해 가장 일반적인 웹 취약점 중 일부를 연습하는 것입니다. 이 소프트웨어는

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

mPDF

mPDF

mPDF는 UTF-8로 인코딩된 HTML에서 PDF 파일을 생성할 수 있는 PHP 라이브러리입니다. 원저자인 Ian Back은 자신의 웹 사이트에서 "즉시" PDF 파일을 출력하고 다양한 언어를 처리하기 위해 mPDF를 작성했습니다. HTML2FPDF와 같은 원본 스크립트보다 유니코드 글꼴을 사용할 때 속도가 느리고 더 큰 파일을 생성하지만 CSS 스타일 등을 지원하고 많은 개선 사항이 있습니다. RTL(아랍어, 히브리어), CJK(중국어, 일본어, 한국어)를 포함한 거의 모든 언어를 지원합니다. 중첩된 블록 수준 요소(예: P, DIV)를 지원합니다.

에디트플러스 중국어 크랙 버전

에디트플러스 중국어 크랙 버전

작은 크기, 구문 강조, 코드 프롬프트 기능을 지원하지 않음