過去 10 年間で、ますます大規模な深層学習モデルをトレーニングすることが新たなトレンドになりました。以下の図に示すように、モデル パラメーターの数が継続的に増加することで、ニューラル ネットワークのパフォーマンスはますます向上し、新しい研究の方向性も生まれていますが、モデルに関する問題もますます増えています。
#第一に、このタイプのモデルはアクセスが制限されていることが多く、オープンソースではないか、オープンソースであっても依然として多くの作業が必要です。実行するコンピューティング リソースの数。第 2 に、これらのネットワーク モデルのパラメーターは普遍的ではないため、トレーニングと導出に大量のリソースが必要になります。第三に、パラメータのサイズはハードウェアによって制限されるため、モデルを無制限に拡張することはできません。これらの問題に対処するために、効率の向上に焦点を当てた新しい研究トレンドが現れています。
最近、ヘブライ大学、ワシントン大学、その他の機関の十数人の研究者が共同で、自然言語処理 (NLP) の分野における効率的な手法をまとめたレビューを執筆しました。
論文アドレス: https://arxiv.org/pdf/2209.00099.pdf
効率とは通常、入力システムを指します。リソースとシステム出力の関係: 効率的なシステムは、リソースを無駄にすることなく出力を生成できます。 NLP の分野では、効率をモデルのコストとそれが生み出す結果との関係として考えます。
式 (1) は、特定の結果 (R) を生成するための人工知能モデルのトレーニング コスト (Cost) と 3 つの (不完全な) 要素を表します。 :
(1) 単一サンプルでモデルを実行するコスト (E);
(2) トレーニング データ セットのサイズ (D);
(3) モデルの選択またはパラメーターの調整に必要なトレーニングの実行数 (H)。
計算コスト、時間コスト、環境コストのそれぞれをさまざまな方法でさらに定量化できるため、コスト(・) を複数の次元に沿って測定できます。たとえば、計算コストには、浮動小数点演算 (FLOP) の総数やモデル パラメーターの数が含まれる場合があります。単一のコスト指標を使用すると誤解を招く可能性があるため、この調査では効率的な NLP の複数の側面に関する研究を収集して整理し、どのユースケースにどの側面が有益であるかを議論します。
この調査は、NLP の効率を向上させるための幅広い方法を基礎的に紹介することを目的としています。そのため、この調査では、この調査を典型的な NLP モデル パイプライン (以下の図 2) に従って整理し、その方法を紹介します。各段階の既存の方法をより効率的にするため。
この作品は、主に次の 2 つのタイプの読者を対象とした、NLP 研究者向けの実用的な効率ガイドを提供します。リソースが限られた環境での作業を支援するための NLP のさまざまな分野: リソースのボトルネックに応じて、読者は NLP パイプラインがカバーする側面に直接ジャンプできます。たとえば、主な制限が推論時間である場合、この論文の第 6 章では、関連する効率の向上について説明しています。
(2) NLP 手法の現在の効率を改善することに関心のある研究者。この論文は、新しい研究の方向性の機会を特定するための入り口として機能します。
以下の図 3 は、この研究でまとめた効率的な NLP 手法の概要を示しています。
さらに、ハードウェアの選択はモデルの効率に大きな影響を与えますが、ほとんどの NLP 研究者はハードウェアに関する決定を直接管理していません。ハードウェアの最適化は、NLP パイプラインのすべてのステージで役立ちます。したがって、この研究ではアルゴリズムに焦点を当てますが、第 7 章ではハードウェアの最適化について簡単に説明します。最後に、効率を定量化する方法、評価プロセス中に考慮すべき要素、および最適なモデルを決定する方法についてさらに説明します。
興味のある読者は、論文の原文を読んで研究の詳細を学ぶことができます。
以上が限られたリソースでモデルの効率を向上させるにはどうすればよいでしょうか?効率的なNLP手法をまとめた記事の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

「AI-Ready労働力」という用語は頻繁に使用されますが、サプライチェーン業界ではどういう意味ですか? サプライチェーン管理協会(ASCM)のCEOであるAbe Eshkenaziによると、批評家ができる専門家を意味します

分散型AI革命は静かに勢いを増しています。 今週の金曜日、テキサス州オースティンでは、ビテンサーのエンドゲームサミットは極めて重要な瞬間を示し、理論から実用的な応用に分散したAI(DEAI)を移行します。 派手なコマーシャルとは異なり

エンタープライズAIはデータ統合の課題に直面しています エンタープライズAIの適用は、ビジネスデータを継続的に学習することで正確性と実用性を維持できるシステムを構築する大きな課題に直面しています。 NEMOマイクロサービスは、NVIDIAが「データフライホイール」と呼んでいるものを作成することにより、この問題を解決し、AIシステムがエンタープライズ情報とユーザーインタラクションへの継続的な露出を通じて関連性を維持できるようにします。 この新しく発売されたツールキットには、5つの重要なマイクロサービスが含まれています。 NEMOカスタマイザーは、より高いトレーニングスループットを備えた大規模な言語モデルの微調整を処理します。 NEMO評価者は、カスタムベンチマークのAIモデルの簡素化された評価を提供します。 Nemo Guardrailsは、コンプライアンスと適切性を維持するためにセキュリティ管理を実装しています

AI:芸術とデザインの未来 人工知能(AI)は、前例のない方法で芸術とデザインの分野を変えており、その影響はもはやアマチュアに限定されませんが、より深く影響を与えています。 AIによって生成されたアートワークとデザインスキームは、広告、ソーシャルメディアの画像生成、Webデザインなど、多くのトランザクションデザインアクティビティで従来の素材画像とデザイナーに迅速に置き換えられています。 ただし、プロのアーティストやデザイナーもAIの実用的な価値を見つけています。 AIを補助ツールとして使用して、新しい美的可能性を探求し、さまざまなスタイルをブレンドし、新しい視覚効果を作成します。 AIは、アーティストやデザイナーが繰り返しタスクを自動化し、さまざまなデザイン要素を提案し、創造的な入力を提供するのを支援します。 AIはスタイル転送をサポートします。これは、画像のスタイルを適用することです

最初はビデオ会議プラットフォームで知られていたZoomは、エージェントAIの革新的な使用で職場革命をリードしています。 ZoomのCTOであるXD Huangとの最近の会話は、同社の野心的なビジョンを明らかにしました。 エージェントAIの定義 huang d

AIは教育に革命をもたらしますか? この質問は、教育者と利害関係者の間で深刻な反省を促しています。 AIの教育への統合は、機会と課題の両方をもたらします。 Tech Edvocate NotesのMatthew Lynch、Universitとして

米国における科学的研究と技術の開発は、おそらく予算削減のために課題に直面する可能性があります。 Natureによると、海外の雇用を申請するアメリカの科学者の数は、2024年の同じ期間と比較して、2025年1月から3月まで32%増加しました。以前の世論調査では、調査した研究者の75%がヨーロッパとカナダでの仕事の検索を検討していることが示されました。 NIHとNSFの助成金は過去数か月で終了し、NIHの新しい助成金は今年約23億ドル減少し、3分の1近く減少しました。リークされた予算の提案は、トランプ政権が科学機関の予算を急激に削減していることを検討しており、最大50%の削減の可能性があることを示しています。 基礎研究の分野での混乱は、米国の主要な利点の1つである海外の才能を引き付けることにも影響を与えています。 35

Openaiは、強力なGPT-4.1シリーズを発表しました。実際のアプリケーション向けに設計された3つの高度な言語モデルのファミリー。 この大幅な飛躍は、より速い応答時間、理解の強化、およびTと比較した大幅に削減されたコストを提供します


ホットAIツール

Undresser.AI Undress
リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover
写真から衣服を削除するオンライン AI ツール。

Undress AI Tool
脱衣画像を無料で

Clothoff.io
AI衣類リムーバー

Video Face Swap
完全無料の AI 顔交換ツールを使用して、あらゆるビデオの顔を簡単に交換できます。

人気の記事

ホットツール

EditPlus 中国語クラック版
サイズが小さく、構文の強調表示、コード プロンプト機能はサポートされていません

MantisBT
Mantis は、製品の欠陥追跡を支援するために設計された、導入が簡単な Web ベースの欠陥追跡ツールです。 PHP、MySQL、Web サーバーが必要です。デモおよびホスティング サービスをチェックしてください。

SAP NetWeaver Server Adapter for Eclipse
Eclipse を SAP NetWeaver アプリケーション サーバーと統合します。

mPDF
mPDF は、UTF-8 でエンコードされた HTML から PDF ファイルを生成できる PHP ライブラリです。オリジナルの作者である Ian Back は、Web サイトから「オンザフライ」で PDF ファイルを出力し、さまざまな言語を処理するために mPDF を作成しました。 HTML2FPDF などのオリジナルのスクリプトよりも遅く、Unicode フォントを使用すると生成されるファイルが大きくなりますが、CSS スタイルなどをサポートし、多くの機能強化が施されています。 RTL (アラビア語とヘブライ語) や CJK (中国語、日本語、韓国語) を含むほぼすべての言語をサポートします。ネストされたブロックレベル要素 (P、DIV など) をサポートします。

MinGW - Minimalist GNU for Windows
このプロジェクトは osdn.net/projects/mingw に移行中です。引き続きそこでフォローしていただけます。 MinGW: GNU Compiler Collection (GCC) のネイティブ Windows ポートであり、ネイティブ Windows アプリケーションを構築するための自由に配布可能なインポート ライブラリとヘッダー ファイルであり、C99 機能をサポートする MSVC ランタイムの拡張機能が含まれています。すべての MinGW ソフトウェアは 64 ビット Windows プラットフォームで実行できます。

ホットトピック









