腾讯雲国際口座: OCR文字認識API統合チュートリアル: 文書と証明書の認識を迅速に実現する

クラウド 2026-07-24 阅读 3
cloud

現在のソフトウェア開発と企業デジタル化の変革では

OCR(光学式文字認識)

絶対に高周波で必要な機能です。ユーザーの実名認証時に身分証明書を識別したり、財務システムが自動的に請求書を入力したり、紙文書を迅速に電子化したりしても、OCRは大量の手動入力のコストを省くことができる。

市場にはOCRサービスが多いですが、

識別精度、国内証明書/手形の被覆度、インタフェース安定性

見れば、テンセント雲の文字認識 (OCR) サービスはずっと第一段階にあります。

今日のこの文章は、私は実際の開発者の視点で、手であなたを連れて完成させます

腾讯クラウドOCR APIの統合と開発

、汎用文書と各種証明書の自動認識を迅速に実現します!

一、なぜ騰訊雲OCRを選んだのですか

コードを正式に書く前に、なぜ多くの企業や開発者が選定時に腾讯雲OCRを優先的に考えるのかを話してみましょう

品種が非常に豊富である: 基礎的な汎用活字、手書き認識のほか、身分証明書、運転免許証、営業許可証、増値税伝票、銀行カードなど数十種類の特定シーンに深いモデルを最適化した精度が極めて高い。

箱から出してすぐに使える、応答が非常に速い: 自分で高度な学習モデルを訓練する必要はなく、RESTful APIや公式SDKを直接呼び出し、ミリ秒レベルで構造化JSON結果を返す。

安全とコンプライアンス保障: 身分証明書などの機密証明書情報に対して、腾讯雲は高い基準のデータ安全伝送とコンプライアンス保護メカニズムを提供した。

💡事前準備のヒント: 腾讯雲APIを呼び出す前に、実名認証を完了した腾讯雲アカウントを持ってOCRサービスを開設する必要があります。もしあなたが企業チーム、サービス業者である場合、あるいは計算力資源を一括購入する必要がある場合は、正規ルートを通じて腾讯雲口座番号の購入と開通を行うことを提案して、統一的な開票と管理が容易であるだけでなく多くの場合、よりお得な専属コースの特典と設計者のアクセスサポートを受けることができます。

二、統合前準備作業

Python/Javaコードを書く前に、腾讯クラウドコンソールでAPIを呼び出すために必要な「鍵」を手に入れる必要があります

1.鍵を取得する

腾讯クラウドコンソールにログインし、アクセス管理(CAM) -> APIキー管理にアクセスします。

「新しいキーを作成」をクリックすると、システムは自动的にペアのSecretIdとSecretKeyを生成します。

注意: この2つの鍵はAPIを呼び出す唯一の身分証明書で、フロントエンドコードに明示的にハードコードしたり、GitHub公開倉庫に提出したりしないでください

2.OCRサービスの開通と無料限度額

腾讯クラウドOCRコンソールにアクセスして、必要な識別サービス (例: 身分証明書の識別) をオンにします

IDCardOCR

または汎用活字認識

GeneralBasicOCR

) テンセント雲はいつも新しいユーザーに毎月一定の無料額を提供します。とても適しています。

共同開発テスト。

三、実戦演習: Python高速統合テンセント・クラウドOCR

次に、現在最も人気があり、最も完全なメンテナンスを使用します

腾讯クラウド公式SDK(TencentCloud SDK for Python)

実戦を行う。

ステップ1: 公式SDKのインストール

ターミナルまたはコマンドラインを開き、次のコマンドを実行してPython SDKをインストールします

Pip install tencentcloud-sdk-python

ステップ2: コアコードの実装 (身分証明書認識を例にとると)

身分証明書の識別は場面で最もよく見られる需要で、腾讯雲OCRは名前、性別、民族、生年月日、住所、身分証明書番号を自動的に識別し、身分証明書の表裏と切辺の警告を判断することもできる。

一つ作成

Ocr_demo.Py

ファイル。次のコードを書き込みます

Import base64

Import json

Fro m tencentcloud.comモンインポートクレデンシャル

Fro m tencentcloud.com mon.profile.Client _ profile import client profile

Fro m tencentcloud.com mon.profile.http_profile import HttpProfile

Fro m tencentcloud.com mon.exception

From tencentcloud.ocr.v20181119 import ocr_client, model

Defecreレッジゼ _ id _ card(image_path):try:

#1.鍵の初期化 (環境変数または構成ファイルからの読み取りを推奨します。ハードコードしないでください)

Secret_id = "YOUR_SECRET_ID"

Secret_key = "YOUR_SECRET_KEY"

Cred = クレデンシャル.クレデンシャル

#2.

HTTPオプションとクライアントプロパティの設定

T epprofile = t epprofile ()

httpProfile.endpoint = "ocr.tencentcloudapi.com" # OCR APIドメイン名

Clientプロフィール = clientプロフィール ()

Client profile.httpProfile = httpProfile

#3.OCRクライアントをインスタンス化する (地域を指定して、例えばap-広州など)

Client = ocr_client. OcrClient

#4.ローカル画像をBase64エンコードに変換する (画像のパブリックURLを直接転送することもできる) withopen(image_path、 "rb") as f:

Base 64 data = base 64-b 64encode(f.read()).decode("utf-8")

#5.リクエストオブジェクトの構築

Req = model.IDCardOCRRequest()

パンプス = {

「ImageBase64」: base64data,

「カルデイド」: 「フロント」 # フロントは人物面、BACKは国章面を表します

}

& N

Bsp; req.From_json _ string(json.dumps(params))

#6.APIリクエストを開始する

Resp = client.IDCardOCR(req)

#7.結果を解析して出力する

Result = json.loads(resp.To _ json _ string())

Print ("--- 認識結果 ---")

Print (f "名前: {result.get('name')}")

Print (f "性別: {result.get('Sex')}")

Print (f "身分証明書番号: {result.get('IdNum')}")

Print (f "住所: {result.get('Address')}")

Returresult

Except TencentCloudSDKException as ort:

Print (f "API呼び出し異常: {ort}")

# テスト実行if _ _ name _ _ = = "_ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _ _

レコグイゼ _ id_card("my_id_card.Jpg")

ステップ3: 汎用ドキュメント/表認識拡張

紙文書、PDF、表を識別する必要がある場合は、APIの方法を切り替えるだけです。例えば

汎用活字認識 (salebasicocr)

:

# リクエストオブジェクトと呼び出されたメソッドを置き換えるだけです

Req = 掛け値.GeneralBasic

OCRRequest()

Params = {"ImageBase64": base64data}

Req.From_json _ string(json.dumps(params))

Resp = client.GeneralBasicOCR(req)

# Respには、テキストブロックの位置座標と認識されたテキストコンテンツが含まれます

四、生産環境の着地回避ガイド

実際にOCR機能を本番環境に接続する際には、いくつかの重要な最適化ポイントがあり、システムの安定性と体験を大幅に向上させることができます

画像前処理と圧縮テンセントクラウドAPIは、インポートした画像のサイズに制限がある (Base64エンコード後は通常7MB/10MB以下)。提案: フロントエンドまたはサービス側はアップロード前に適切な等比例スケーリングとJPEG圧縮を行うことで、オーバーランを回避し、ネットワーク転送時間を大幅に短縮し、応答速度を向上させることができる。

URL方式の転送を優先的に推奨します。もしあなたの画像がすでにオブジェクトストレージ (腾讯雲COSなど) に格納されている場合は、Base64文字列ではなく画像URLをできるだけ転送しますこれにより、サーバのメモリ使用量とネットワーク帯域幅のストレスを大幅に軽減できます。

タイムアウトと再試行の仕組みネットワークの偶発的なジッタは避けられない。クライアントを呼び出すときは、合理的なタイムアウト時間 (例: 3 ~ 5秒) を設定し、コード内でTencentCloudSDKExceptionをキャプチャして指数退避再試行を実施することをお勧めします。

機密データの安全コンプライアンスは身分証明書、銀行カードなどのプライバシーデータを識別した後、ログに完全なカード番号と機密フィールドを明記しないでください。

まとめ

本文の実技を通して、腾讯雲OCR文字認識APIを統合するのは非常に簡単で、数十行のPythonコードだけで強力な文書と証明書認識能力を迅速に構築できる。

企業の自動化されたオフィスシステムを構築しても、消費者向けのApp/アプレットを開発しても、腾讯クラウドOCRは極めて高い精度と安定性を提供できる。もしあなたがプロジェクトで関連機能にアクセスする準備をしているなら、事前に枠組みと計算力の評価をして、正規のものを選ぶことをお勧めします

テンセントクラウドアカウントの購入

サービスチャネルと、初期の輸送コストを削減するだけでなく、後続業務の高可用性拡張を確保することができます!

cloud
← 返回新闻中心