



著者 | 中国科学院多分野研究チーム
編集者 | ScienceAI
20 世紀の人類の 3 つの主要な科学プロジェクトの 1 つとして知られています。世紀 ゲノムプロジェクトは、生命の謎の詳細な分析を開始しました。生命プロセスは多次元で非常に動的な性質を持っているため、従来の実験研究手法では遺伝コードの根底にある共通法則を体系的かつ正確に解読することが困難であり、表現モデリングと知識を達成するには強力なコンピューティング技術を使用することが急務となっています。遺伝子データの発見。
現在、大規模モデルを核とした人工知能技術は、コンピュータビジョンや自然言語理解などの分野で革命を引き起こし、データや知識の深い理解を実証し、応用が期待されています。生命科学研究、システムの基礎となる遺伝暗号の共通法則を正確に解読するために
最近、中国科学院の多分野の学際的研究チームで構成される「Xcompass Consortium」(Xcompassコンソーシアム)は、生命科学研究に力を与える人工知能における重要なブレークスルー 異種生命の基礎を示す世界初の大規模モデル、ジーンコンパスの構築に成功。このモデルは、ヒトやマウスの1億2,600万個以上の単細胞のトランスクリプトームデータを統合し、プロモーター配列や遺伝子の共発現関係など4種類の事前知識を統合し、基本モデルパラメーター数は1億3,000万個に達し、遺伝子制御を実現します。規制法のパノラマ学習と理解は、細胞の状態変化の予測とさまざまな生命プロセスの正確な分析を同時にサポートし、生命科学研究を強化する人工知能の大きな可能性を実証します。
この研究のタイトルは「GeneCompass:知識に基づいた異種基礎モデルによる普遍的な遺伝子制御機構の解読」で、bioRxivに掲載されました。
紙のリンク: https://www.biorxiv.org/content/10.1101/2023.09.26.559542v1
さらに, 同チームは、細胞運命変換の中核因子を正確に特定でき、転写因子の摂動をシミュレートする機能を備えた転移学習に基づく遺伝子制御ネットワーク生成モデル「CellPolaris」も同時にリリースした。
研究のタイトルは「CellPolaris:遺伝子制御ネットワークの一般化転移学習による細胞運命の解読」で、bioRxivに掲載されました。
#GeneCompass: 種を超えた生命の基盤に関する初の大規模モデル
1 億 2,000 万の細胞と 1 億 3,000 万のパラメーターを含む、種を超えた生命の基本の大規模モデル
現在、単一の種が世界中で取得されています。 -細胞トランスクリプトームデータは数千万にすぎず、複雑な生命プロセスの分析に使用される基本的な生命モデルの大規模モデルのトレーニングを完全にサポートすることは困難です。
チームは、さまざまな種からオープンソースの単一細胞トランスクリプトーム データを収集し、スクリーニング、クリーニング、正規化などの前処理プロセスを通じて、マウスの 1 億 2,600 万個以上の細胞を含む既知最大の高品質データベースを確立しました。トレーニング データ セット scCompass-126M は、Transformer 自己注意メカニズムに基づく深層学習アーキテクチャを採用しており、異なる細胞背景の異なる遺伝子間の長期的な動的相関を捉えることができ、モデル パラメーターのサイズは 1 億 3,000 万に達します。生命プロセスの高解像度特性評価を達成するために、GeneCompass は初めて遺伝子数と発現レベルを二重エンコードし、遺伝子間の相関関係を効果的かつ高感度に抽出できるようにしました。これにより、GeneCompass は、細胞の種類や摂動状態など、さまざまな特定の条件下での遺伝子間の相互作用をより正確に分析できるようになります。
事前トレーニング中に事前知識を埋め込むと、モデルのパフォーマンスを効果的に向上させることができます。
モデルは、プロモーター配列、既知の遺伝子制御ネットワーク、遺伝子ファミリー情報、および遺伝子の共発現を効果的に統合します。 4 種類の生物学的事前知識間の関係に人間による注釈情報のエンコーディングを追加することで、生物学的データ間の複雑な特徴相関関係の理解を向上させます。データ情報とさまざまな種の事前知識をトレーニングおよび統合することにより、GeneCompass は従来の生物学研究の効率と精度を向上させ、まだ突破できない複雑な生命科学の問題に新たな入り口をもたらすことが期待されています。
スケール効果により、生物学的進化の保守的な法則を捉えるためのモデル トレーニングが促進されます
チームは、大規模な異種データで事前トレーニングされたモデルのパフォーマンスが向上することを発見しました。これはスケーリングの法則と一致しています。大規模な複数種の事前トレーニング データにより、より優れた事前トレーニング表現が生成され、下流タスクのパフォーマンスがさらに向上します。この発見は、種間で保存された遺伝子制御パターンが存在し、これらのパターンは事前訓練されたモデルによって学習および理解できることを示しています。同時に、これは、種とデータの拡大に伴い、モデルのパフォーマンスが引き続き向上すると予想されることも意味します。
マルチタスクのパフォーマンスの利点は、基本的な大規模モデルの強力な一般化能力を示しています
知識が埋め込まれた最大の事前トレーニング済みの異種基本生活モデルとして現在までのところ、GeneCompass は下流タスクのための複数の異種間転移学習を実現し、細胞型アノテーション、定量的遺伝子摂動予測、薬剤感受性分析などにおいて既存の方法よりも優れたパフォーマンスを達成できます。これは、ラベルのない複数種のビッグデータに基づいた事前トレーニングと、モデルの微調整に異なるサブタスクデータを使用することの戦略的利点を十分に実証しており、遺伝子に関連するさまざまな生物学的問題を分析および予測するための普遍的なソリューションとなることが期待されています-細胞の特性。
細胞分極: 転移学習により遺伝子制御ネットワークを解読し、細胞運命の変化を予測
転移学習を使用して細胞を生成する特定の遺伝子制御ネットワーク
チームはまた、CellPolaris と呼ばれる、一般化転移学習に基づいた遺伝子制御ネットワーク構築 AI モデルのセットも開発しました。このモデルはまず、一致する細胞シナリオで数百セットのトランスクリプトームとクロマチンのアクセシビリティ データを分類して高品質の遺伝子制御ネットワークを構築し、次に一般化転移学習モデルを使用して、トランスクリプトーム データのみを使用して細胞シナリオでより多くの遺伝子を生成します。 。次に、生成された信頼性の高い遺伝子制御ネットワークを使用して、細胞運命遷移におけるコア転写因子を同定するツールと、確率的グラフィカルモデルに基づく転写因子摂動シミュレーションツールを開発しました。このモデルは、細胞運命変換の中核因子を効果的に同定し、転写因子摂動のシミュレーションを実現することができ、遺伝子制御機構の解析や疾患原因遺伝子の発見において重要な応用価値を持っています。
上記の 2 つの研究は、「コンパス アライアンス」チームによって完了しました。「コンパス アライアンス」チームは現在、主に中国科学院動物研究所、共同コンピュータ ネットワーク情報センター、オートメーション研究所、コンピューティング技術研究所、数理・システム科学研究所の研究機関およびその他の研究機関で構成され、この提携の目標は、デジタルインテリジェンスを推進するライフサイエンス研究の新たなパラダイムを確立し、人生の本質的な法則。 ################################################ #人工的な知能
以上が中国科学院の研究チームは2つの重要な論文を発表した。1つは種を超えた生命の基盤に関する初の大規模モデルの発表、もう1つは細胞運命予測のための新しいAIモデルの発表だ。の詳細内容です。詳細については、PHP 中国語 Web サイトの他の関連記事を参照してください。

Laravel入门教程:从零开始学习最流行的PHP框架引言:Laravel是当前最流行的PHP框架之一,它易于上手、功能强大且拥有活跃的开发社区。本文将带您从零开始学习Laravel框架,并提供一些实例代码,帮助您更好地理解和掌握这个强大的工具。第一步:安装Laravel在开始之前,您需要在计算机上安装Laravel框架。最简单的方法是通过Composer进

Vue.js是一款流行的JavaScript前端框架,目前已经推出了最新的版本——Vue3,新版Vue在性能、体积以及开发体验上均有所提升,受到越来越多的开发者欢迎。本文将介绍如何使用Vue3制作一个简单的图片裁剪器。首先,我们需要创建一个Vue项目并安装所需的插件。可以使用VueCLI来创建项目,也可以手动搭建。这里我们以使用VueCLI的方式为例:#

Go-zero是一款优秀的Go语言框架,它提供了一整套解决方案,包括RPC、缓存、定时任务等功能。事实上,使用go-zero建立一个高性能的服务非常简单,甚至可以在数小时内从入门到精通。本文旨在介绍使用go-zero框架构建高性能服务的过程,并帮助读者快速掌握该框架的核心概念。一、安装和配置在开始使用go-zero之前,我们需要安装它并配置一些必要的环境。1

快速入门:使用Go语言函数实现简单的数据可视化功能随着数据的快速增长和复杂性的提高,数据可视化成为了数据分析和数据表达的重要手段。在数据可视化中,我们需要使用合适的工具和技术来将数据转化为易读且易理解的图表或图形。Go语言作为一种高效且易于使用的编程语言,在数据科学领域也有着广泛的应用。本文将介绍如何使用Go语言函数来实现简单的数据可视化功能。我们将使用Go

Beego是一个基于Go语言的开发框架,它提供了一套完整的Web开发工具链,包括路由、模板引擎、ORM等。如果你想快速入门Beego开发框架,以下是一些简单易懂的步骤和建议。第一步:安装Beego和Bee工具安装Beego和Bee工具是开始学习Beego的第一步。你可以在Beego官网上找到详细的安装步骤,也可以使用以下命令来安装:gogetgithub

随着科技的不断发展,人脸识别技术也越来越得到了广泛的应用。而在Web开发领域中,PHP是一种被广泛采用的技术,因此PHP中的人脸识别技术也备受关注。本文将介绍PHP中的人脸识别入门指南,帮助初学者快速掌握这一领域。一、什么是人脸识别技术人脸识别技术是一种基于计算机视觉技术的生物特征识别技术,其主要应用领域包括安防、金融、电商等。人脸识别技术的核心就是对人脸进

Laravel是一个流行的PHP框架,它提供了许多工具和功能,以使开发Web应用程序变得更加轻松和快速。Laravel8已经发布,它带来了许多新的功能和改进。在本文中,我们将学习如何快速入门Laravel8。安装Laravel8要安装Laravel8,您需要满足以下要求:PHP>=7.3MySQL>=5.6或MariaDB>=10.

PHP摄像头调用教程:快速入门指南引言:在当今的数字时代,摄像头成为了人们生活中不可或缺的设备之一。在Web开发中,如何通过PHP调用摄像头,实现视频流的显示和处理,成为了很多开发者关注的问题。本文将为大家介绍如何快速入门使用PHP来调用摄像头。一、环境准备要使用PHP调用摄像头,我们需要准备以下环境:PHP:确保已经安装了PHP,并且安装了相应的扩展库,如


ホットAIツール

Undresser.AI Undress
リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover
写真から衣服を削除するオンライン AI ツール。

Undress AI Tool
脱衣画像を無料で

Clothoff.io
AI衣類リムーバー

AI Hentai Generator
AIヘンタイを無料で生成します。

人気の記事

ホットツール

SecLists
SecLists は、セキュリティ テスターの究極の相棒です。これは、セキュリティ評価中に頻繁に使用されるさまざまな種類のリストを 1 か所にまとめたものです。 SecLists は、セキュリティ テスターが必要とする可能性のあるすべてのリストを便利に提供することで、セキュリティ テストをより効率的かつ生産的にするのに役立ちます。リストの種類には、ユーザー名、パスワード、URL、ファジング ペイロード、機密データ パターン、Web シェルなどが含まれます。テスターはこのリポジトリを新しいテスト マシンにプルするだけで、必要なあらゆる種類のリストにアクセスできるようになります。

MinGW - Minimalist GNU for Windows
このプロジェクトは osdn.net/projects/mingw に移行中です。引き続きそこでフォローしていただけます。 MinGW: GNU Compiler Collection (GCC) のネイティブ Windows ポートであり、ネイティブ Windows アプリケーションを構築するための自由に配布可能なインポート ライブラリとヘッダー ファイルであり、C99 機能をサポートする MSVC ランタイムの拡張機能が含まれています。すべての MinGW ソフトウェアは 64 ビット Windows プラットフォームで実行できます。

SublimeText3 Mac版
神レベルのコード編集ソフト(SublimeText3)

SAP NetWeaver Server Adapter for Eclipse
Eclipse を SAP NetWeaver アプリケーション サーバーと統合します。

ゼンドスタジオ 13.0.1
強力な PHP 統合開発環境

ホットトピック









