データの重複部分を見つける-PHPチュートリアル-php.cn

ホームページ

バックエンド開発

PHPチュートリアル

データの重複部分を見つける

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Aug 31, 2016 am 08:54 AM

phpアルゴリズム

今、一まとまりのアドレス帳データ（10,000人以上のアドレス帳）があるので、2人それぞれのアドレス帳の重複部分（つまり、誰が誰のアドレス帳と重複しているか）を調べて比較する必要があります。この 2 つを合わせます
たとえば、ABCDE の 4 つのアドレス帳があり、AB AC AD AE BC BD BE CD CE DE の間のアドレス帳の重複エントリの数を調べます

携帯電話番号が重複している場合、これら2つのアドレス帳が重複しているとみなされます
これはデータテーブルであり、10,000以上の個人アドレス帳があります
データの重複部分を見つける

データの重複部分を見つける

リストフィールドに保存されているjsonがアドレス帳の内容です
人のアドレス帳は100件から1000件まであります
データの重複部分を見つける

私が現在やろうとしていることは、全員のアドレス帳を一度に取り出し、最初の人のアドレスを残りのアドレス（foreach配列、内部にネストされたforeach）と比較し、次に2番目の人のアドレス帳を比較することです。残りはみんなの比較など

データの重複部分を見つける

その後、スクリプトを実行します。スクリプトの実行には 20 時間以上かかりましたが、まだ半分しか完了していません

メモリと CPU の使用率も比較的高く、スクリプトの効率も低すぎます。

このデータのバッチの重複部分を見つけるためのより良い方法、またはスクリプトを最適化する方法があれば教えてください皆さんありがとう

返信内容:

今、一まとまりのアドレス帳データ（10,000人以上のアドレス帳）があるので、2人それぞれのアドレス帳の重複部分（つまり、誰が誰のアドレス帳と重複しているか）を調べて比較する必要があります。この 2 つを合わせますたとえば、ABCDE の 4 つのアドレス帳があり、AB AC AD AE BC BD BE CD CE DE の間のアドレス帳の重複エントリの数を調べます

携帯電話番号が重複している場合、これら2つのアドレス帳が重複しているとみなされます

これはデータテーブルであり、10,000以上の個人アドレス帳があります

データの重複部分を見つける

リストフィールドに保存されているjsonがアドレス帳の内容です

データの重複部分を見つける人のアドレス帳は100件から1000件まであります

私が現在やろうとしていることは、全員のアドレス帳を一度に取り出し、最初の人のアドレスを残りのアドレス（foreach配列、内部にforeachがネストされている）と比較し、次に2番目の人のアドレス帳を比較することです。残りはみんなの比較など
データの重複部分を見つける

データの重複部分を見つけるその後、スクリプトを実行します。スクリプトの実行には 20 時間以上かかりましたが、まだ半分しか完了していません
メモリと CPU の使用率も比較的高く、スクリプトの効率も低すぎます。このデータのバッチの重複部分を見つけるためのより良い方法、またはスクリプトを最適化する方法があれば教えてください
データの重複部分を見つける皆さんありがとう

リーリー

声明

この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

PHPの目的：動的なWebサイトの構築Apr 15, 2025 am 12:18 AM

PHPは動的なWebサイトを構築するために使用され、そのコア関数には次のものが含まれます。1。データベースに接続することにより、動的コンテンツを生成し、リアルタイムでWebページを生成します。 2。ユーザーのインタラクションを処理し、提出をフォームし、入力を確認し、操作に応答します。 3.セッションとユーザー認証を管理して、パーソナライズされたエクスペリエンスを提供します。 4.パフォーマンスを最適化し、ベストプラクティスに従って、ウェブサイトの効率とセキュリティを改善します。

PHP：データベースとサーバー側のロジックの処理Apr 15, 2025 am 12:15 AM

PHPはMySQLIおよびPDO拡張機能を使用して、データベース操作とサーバー側のロジック処理で対話し、セッション管理などの関数を介してサーバー側のロジックを処理します。 1）MySQLIまたはPDOを使用してデータベースに接続し、SQLクエリを実行します。 2）セッション管理およびその他の機能を通じて、HTTPリクエストとユーザーステータスを処理します。 3）トランザクションを使用して、データベース操作の原子性を確保します。 4）SQLインジェクションを防ぎ、例外処理とデバッグの閉鎖接続を使用します。 5）インデックスとキャッシュを通じてパフォーマンスを最適化し、読みやすいコードを書き、エラー処理を実行します。

PHPでのSQL注入をどのように防止しますか？（準備された声明、PDO）Apr 15, 2025 am 12:15 AM

PHPで前処理ステートメントとPDOを使用すると、SQL注入攻撃を効果的に防ぐことができます。 1）PDOを使用してデータベースに接続し、エラーモードを設定します。 2）準備方法を使用して前処理ステートメントを作成し、プレースホルダーを使用してデータを渡し、メソッドを実行します。 3）結果のクエリを処理し、コードのセキュリティとパフォーマンスを確保します。

PHPおよびPython：コードの例と比較Apr 15, 2025 am 12:07 AM

PHPとPythonには独自の利点と短所があり、選択はプロジェクトのニーズと個人的な好みに依存します。 1.PHPは、大規模なWebアプリケーションの迅速な開発とメンテナンスに適しています。 2。Pythonは、データサイエンスと機械学習の分野を支配しています。

アクション中のPHP：実際の例とアプリケーションApr 14, 2025 am 12:19 AM

PHPは、電子商取引、コンテンツ管理システム、API開発で広く使用されています。 1）eコマース：ショッピングカート機能と支払い処理に使用。 2）コンテンツ管理システム：動的コンテンツの生成とユーザー管理に使用されます。 3）API開発：RESTFUL API開発とAPIセキュリティに使用されます。パフォーマンスの最適化とベストプラクティスを通じて、PHPアプリケーションの効率と保守性が向上します。

PHP：インタラクティブなWebコンテンツを簡単に作成しますApr 14, 2025 am 12:15 AM

PHPにより、インタラクティブなWebコンテンツを簡単に作成できます。 1）HTMLを埋め込んでコンテンツを動的に生成し、ユーザー入力またはデータベースデータに基づいてリアルタイムで表示します。 2）プロセスフォームの提出と動的出力を生成して、XSSを防ぐためにHTMLSPECIALCHARSを使用していることを確認します。 3）MySQLを使用してユーザー登録システムを作成し、Password_HashおよびPreprocessingステートメントを使用してセキュリティを強化します。これらの手法を習得すると、Web開発の効率が向上します。

PHPとPython：2つの一般的なプログラミング言語を比較しますApr 14, 2025 am 12:13 AM

PHPとPythonにはそれぞれ独自の利点があり、プロジェクトの要件に従って選択します。 1.PHPは、特にWebサイトの迅速な開発とメンテナンスに適しています。 2。Pythonは、データサイエンス、機械学習、人工知能に適しており、簡潔な構文を備えており、初心者に適しています。

PHPは依然として動的であり、現代のプログラミングの分野で重要な位置を占めています。 1）PHPのシンプルさと強力なコミュニティサポートにより、Web開発で広く使用されています。 2）その柔軟性と安定性により、Webフォーム、データベース操作、ファイル処理の処理において顕著になります。 3）PHPは、初心者や経験豊富な開発者に適した、常に進化し、最適化しています。

See all articles