現在、大規模言語モデル (LLM) は、特に例と中間ステップが提供されている場合に、推論タスクで驚くべき機能を実証しています。ただし、プロンプト メソッドは通常、LLM の暗黙的知識に依存します。暗黙的知識が間違っているか、タスクと矛盾している場合、LLM は間違った答えを返す可能性があります
##現在、Google、Mila Institute、その他の研究機関の研究者は、LLM に推論ルールを学習させるという新しい方法を共同で検討し、Hypotheses-to-Theories (HtT) という新しいフレームワークと呼ばれる方法を提案しました。この新しい方法は、複数ステップの推論を改善するだけでなく、解釈可能性と伝達可能性という利点もあります
論文アドレス: https://arxiv.org/abs/2310.07064
数値推論と関係推論の問題に関する実験結果によると、HtT 法は既存のプロンプト手法を改良し、精度が 11 向上しました。 -27%。同時に、学習したルールを別のモデルや同じ問題の別の形式に転送することもできます
方法の紹介
一般的にHtT フレームワークは帰納的段階と演繹的段階の 2 つの段階で構成されており、従来の機械学習におけるトレーニングとテストに似ていると述べました。
導入フェーズでは、LLM はまずトレーニング サンプル用の一連のルールを生成して検証する必要があります。この研究では、CoT を使用してルールを宣言して答えを導き出し、ルールの頻度と精度を評価し、頻繁に出現して正解につながるルールを収集し、ルール ベースを形成します。
良いルールを使用してライブラリを使用している場合、次のステップは、問題を解決するためにこれらのルールを適用する方法を検討することです。この目的を達成するために、この研究では推論フェーズでプロンプトにルール ベースを追加し、LLM がルール ベースからルールを取得して推論を実行し、暗黙的な推論を明示的な推論に変換する必要があります。
ただし、研究によると、非常に強力な LLM (GPT-4 など) であっても、すべてのステップで正しいルールを取得するのは難しいことがわかっています。したがって、この研究では、LLM の文脈検索機能を強化する XML マークアップ技術を開発しました。
#実験結果
HtT を評価するために、研究では 2 つのマルチステップ推論問題をベンチマークしました。実験結果は、HtT が少数サンプル プロンプト法を改善することを示しています。著者らは、HtT をより包括的に理解するために、広範なアブレーション研究も実施しました。
彼らは、数的推論と関係論的推論の問題に関する新しい方法を評価します。数値推論では、GPT-4 の精度が 21.0% 向上したことが観察されました。関係推論では、GPT-4 は精度で 13.7% の向上を達成し、GPT-3.5 ではさらに恩恵を受け、パフォーマンスが 2 倍になりました。パフォーマンスの向上は主に、ルールの錯覚の減少によってもたらされます。
# 具体的には、以下の表 1 は、16 進数、11 進数、および 9 進数の算術結果を示しています。データセット。すべての基本システムの中で、両方の LLM で 0 ショット CoT のパフォーマンスが最も悪くなっています。
表 3 は、HtT が GPT-4 (テキスト バージョン) のパフォーマンスを大幅に向上させることを示しています。 GPT3.5 ではテキスト入力の処理時にルールの錯覚以外のエラーが発生することが多いため、この改善は重要ではありません。
#
以上がGPT-4 は、DeepMind トレーニングを通じて精度が 13.7% 向上し、帰納と演繹の能力が向上しました。の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

ドキュメントの取り扱いは、AIプロジェクトでファイルを開くだけでなく、カオスを明確に変えることです。 PDF、PowerPoint、Wordなどのドキュメントは、あらゆる形状とサイズでワークフローをフラッシュします。構造化された取得

Googleのエージェント開発キット(ADK)のパワーを活用して、実際の機能を備えたインテリジェントエージェントを作成します。このチュートリアルは、ADKを使用して会話エージェントを構築し、GeminiやGPTなどのさまざまな言語モデルをサポートすることをガイドします。 w

まとめ: Small Language Model(SLM)は、効率のために設計されています。それらは、リソース不足、リアルタイム、プライバシーに敏感な環境の大手言語モデル(LLM)よりも優れています。 特にドメインの特異性、制御可能性、解釈可能性が一般的な知識や創造性よりも重要である場合、フォーカスベースのタスクに最適です。 SLMはLLMSの代替品ではありませんが、精度、速度、費用対効果が重要な場合に理想的です。 テクノロジーは、より少ないリソースでより多くを達成するのに役立ちます。それは常にドライバーではなく、プロモーターでした。蒸気エンジンの時代からインターネットバブル時代まで、テクノロジーの力は、問題の解決に役立つ範囲にあります。人工知能(AI)および最近では生成AIも例外ではありません

コンピュータービジョンのためのGoogleGeminiの力を活用:包括的なガイド 大手AIチャットボットであるGoogle Geminiは、その機能を会話を超えて拡張して、強力なコンピュータービジョン機能を網羅しています。 このガイドの利用方法については、

2025年のAIランドスケープは、GoogleのGemini 2.0 FlashとOpenaiのO4-Miniの到着とともに感動的です。 数週間離れたこれらの最先端のモデルは、同等の高度な機能と印象的なベンチマークスコアを誇っています。この詳細な比較

Openaiの最新のマルチモーダルモデルであるGPT-Image-1は、ChatGPT内およびAPIを介して画像生成に革命をもたらします。 この記事では、その機能、使用法、アプリケーションについて説明します。 目次 GPT-Image-1の理解 GPT-Image-1の重要な機能

データの前処理は、機械学習を成功させるために最も重要ですが、実際のデータセットにはエラーが含まれることがよくあります。 CleanLabは、Pythonパッケージを使用して自信のある学習アルゴリズムを実装する効率的なソリューションを提供します。 検出を自動化します

「AI-Ready労働力」という用語は頻繁に使用されますが、サプライチェーン業界ではどういう意味ですか? サプライチェーン管理協会(ASCM)のCEOであるAbe Eshkenaziによると、批評家ができる専門家を意味します


ホットAIツール

Undresser.AI Undress
リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover
写真から衣服を削除するオンライン AI ツール。

Undress AI Tool
脱衣画像を無料で

Clothoff.io
AI衣類リムーバー

Video Face Swap
完全無料の AI 顔交換ツールを使用して、あらゆるビデオの顔を簡単に交換できます。

人気の記事

ホットツール

AtomエディタMac版ダウンロード
最も人気のあるオープンソースエディター

SAP NetWeaver Server Adapter for Eclipse
Eclipse を SAP NetWeaver アプリケーション サーバーと統合します。

Dreamweaver Mac版
ビジュアル Web 開発ツール

VSCode Windows 64 ビットのダウンロード
Microsoft によって発売された無料で強力な IDE エディター

WebStorm Mac版
便利なJavaScript開発ツール

ホットトピック









