Deepseek R1対Openai O1対ソネット3.5：Battle of Best LLMS-AI-php.cn

ホームページ

テクノロジー周辺機器

Deepseek R1対Openai O1対ソネット3.5：Battle of Best LLMS

尊渡假赌尊渡假赌尊渡假赌

Mar 09, 2025 pm 01:04 PM

Deepseek R1：GPT-4とClaude

に匹敵する予算に優しいLLM

中国のAIイノベーターDeepseekは、新年以来波を起こしており、Deepseek V3モデル（GPT-4競合他社）とそれに付随するモバイルアプリを立ち上げました。彼らの最新の製品であるDeepseek R1は、大幅に引き下げられた業界のリーダーに挑戦する大規模な言語モデル（LLM）です。このブログ投稿では、Deepseek R1とOpenaiのO1およびClaude Sonnet 3.5と比較して、パフォーマンスの主張をテストに掲載しています。

deepseek r1：概要

Deepseek R1は、高度な推論機能を優先するオープンソースLLMです。そのユニークなトレーニング方法論は、補強学習（RL）を活用し、従来の監視施設微調整（SFT）への依存を最小限に抑えます。このロジック、問題解決、および解釈可能性に焦点を当てているため、STEMタスク、コーディング、複雑なチェーン（COT）推論に適しています。 OpenaiのO1およびClaudeのSonnet 3.5と直接競合します。重要なことに、DeepSeek R1のAPIは大幅に低いコストを誇っています。Sonnet3.5よりも97％安く、O1よりも93％安く（キャッシュヒット入力の場合）

DeepSeek R1 vs OpenAI o1 vs Sonnet 3.5: Battle of Best LLMs

deepseek r1 へのアクセス

Deepseek R1は、DeepSeekチャットインターフェイス（

https://www.php.cn/link/9f3ad7a14cd3d1cf5d73e8ec7205e7f1）またはそのAPIを介してアクセス可能です。（https://www.php.cn/link/23264092bdaf8349c3cec606151be6bd）。チャットインターフェイスでは、アカウントの作成またはログインが必要で、「DeepHink」を選択します。 APIアクセスには、開発者ポータルからAPIキーを取得し、開発環境を構成する必要があります。 APIベースのURLは、https://www.php.cn/link/aaf9290b7570c56dd784f192425658d4です

deepseek R1対openai O1 vs. Claude Sonnet 3.5：詳細な比較

Feature	DeepSeek R1	OpenAI o1 Series	Claude Sonnet 3.5
Training Approach	Reinforcement learning (RL), minimal SFT	Supervised fine-tuning (SFT) RLHF	Supervised fine-tuning RLHF
Special Methods	Cold-start data, rejection sampling, pure RL	Combines SFT and RL for general versatility	Focused on alignment and safety
Core Focus	Reasoning-intensive tasks (math, coding, CoT)	General-purpose LLM	Ethical and safe AI, balanced reasoning
Input Token Cost (per million)	.14 (cache hit), .55 (cache miss)	.50–	.45–.60
Output Token Cost (per million)	.19		–
Affordability	Extremely cost-effective	High cost	Moderately priced
Accessibility	Fully open-source (free for hosting/customization)	Proprietary, pay-per-use API	Proprietary, pay-per-use API

パフォーマンスベンチマーク：タスクベースの評価

タスク1：論理的な推論：
床の脚の数を計算する単語の問題。モデルはいずれも完全に正解を提供しませんでした
タスク2：科学的推論：レーザーとミラーを含む物理ベースの問題。 Deepseek R1は、有益な視覚化で最高の応答を提供しました。
タスク3：コーディングスキル：背景色を変更して紙吹雪を追加するボタンを備えたHTMLページを作成します。 DeepSeek R1は、最も機能的で統合されたソリューションを提供しました
タスク4：問題解決スキル：
数独パズルを解決するためのプログラムを作成します。 Sonnet 3.5は、最もエレガントでよく構造化されたコードを提供しました

最終結果と結論

Deepseek R1は、特に科学的推論とコーディングのタスクにおいて、強力な推論能力を示しましたが、それは完璧ではありませんでした。時折の構文エラーと応答時間が遅いことが観察されました。 Openai O1は詳細な説明を提供し、Sonnet 3.5は速度と簡潔さを提供しました。これらのモデル間の選択は、個々のニーズと優先順位に依存します。 Deepseek R1の大幅なコストの利点は、予算の制約を持つユーザーにとって説得力のあるオプションになります。

（FAQを含む元の記事の最後のセクションも元の応答に含まれています。

以上がDeepseek R1対Openai O1対ソネット3.5：Battle of Best LLMSの詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

声明

この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

メタの新しいAIアシスタント：生産性ブースターまたはタイムシンク？May 01, 2025 am 11:18 AM

Metaは、NVIDIA、IBM、Dellなどのパートナーと協力して、Llama Stackのエンタープライズレベルの展開統合を拡大しました。セキュリティの観点から、MetaはLlama Guard 4、Llamafirewall、Cyberseceval 4などの新しいツールを立ち上げ、AIセキュリティを強化するためにLlama Defendersプログラムを開始しました。さらに、METAは、公共サービス、ヘルスケア、教育の改善に取り組んでいる新興企業を含む、Llama Impact Grantsの150万ドルを10のグローバル機関に分配しています。 Llama 4を搭載した新しいメタAIアプリケーションは、メタAIとして考案されました

Gen Zersの80％はAI：研究と結婚しますMay 01, 2025 am 11:17 AM

人間との相互作用の先駆者であるJoi Aiは、これらの進化する関係を説明するために「AI-lationships」という用語を導入しました。 Joi Aiの関係療法士であるJaime Bronsteinは、これらが人間cを置き換えることを意図していないことを明確にしています

AIはインターネットのボット問題を悪化させています。この20億ドルのスタートアップは最前線にありますMay 01, 2025 am 11:16 AM

オンライン詐欺とボット攻撃は、企業にとって大きな課題をもたらします。小売業者は、ボットの買いだめ製品、銀行の戦闘口座の買収、ソーシャルメディアプラットフォームと戦い、なりすまし者と闘っています。 AIの台頭は、この問題を悪化させます

ロボットへの販売：あなたのビジネスを作ったり壊したりするマーケティング革命May 01, 2025 am 11:15 AM

AIエージェントは、マーケティングに革命をもたらす態勢が整っており、以前の技術的変化の影響を上回る可能性があります。これらのエージェントは、生成AIの大幅な進歩を表し、ChatGPTのような情報を処理するだけでなく、Actioも取る

コンピュータービジョンテクノロジーがどのようにNBAプレーオフを司会しているかMay 01, 2025 am 11:14 AM

重要なNBAゲーム4の決定に対するAIの影響 2つの重要なゲーム4 NBAマッチアップは、司会におけるAIのゲームを変える役割を紹介しました。最初に、デンバーのニコラ・ジョキッチの逃した3ポインターは、アーロン・ゴードンの最後の2秒の路地につながりました。ソニーのホー

AIがどのように再生医療の未来を加速しているかMay 01, 2025 am 11:13 AM

伝統的に、再生医療の専門知識を拡大すると、世界的に大規模な旅行、実践的なトレーニング、長年のメンターシップが必要でした。現在、AIはこの風景を変えており、地理的な制限を克服し、ENを通じて進歩を加速しています

Intel Foundry Direct Connect 2025からのキーテイクアウトMay 01, 2025 am 11:12 AM

Intelは、製造プロセスを主要な位置に戻すように取り組んでいますが、Fab Semiconductorの顧客を引き付けてFabでチップを作成しようとしています。この目的のために、Intelは、そのプロセスの競争力を証明するだけでなく、パートナーが馴染みのある成熟したワークフローでチップを製造できることを実証するために、業界へのより多くの信頼を築かなければなりません。今日私が聞いたことはすべて、インテルがこの目標に向かっていると信じています。新しいCEOのタンリバイの基調講演がその日をキックオフしました。タンリバイは簡単で簡潔です。彼は、IntelのFoundry Servicesにおけるいくつかの課題と、これらの課題に対処し、将来のIntelのFoundry Servicesの成功したルートを計画するために企業が行った対策を概説しています。 Tan Libaiは、IntelのOEMサービスが顧客をより多くするために実装されているプロセスについて話しました