30:00:00
期間限定
50% OFF

年額プランが50% OFF

今すぐ50% OFFで始める
Extractタブ

改行を維持するOCR. 検出されたバウンディングボックスを自然な読み順にまとめ、きれいにエクスポートできます。

ブラウザ上のExtractタブで改行を維持するOCRを実行し、検出されたテキストボックスを自然な読み取り順序へと整列させます。単一の画像からバウンディングボックスの座標をクラスタリングして行単位で正確に区切り、TXT、Markdown、HTML、DOCX形式で出力できます。元の画像のピクセルは変更されず、アカウントのクレジット消費なしでご利用いただけます。

検出された文字
INVOICE
置き換え後の文字
INVOICE

ご利用の流れ

改行を維持するOCRを実行する4つの手順

デスクトップアプリを導入することなく、ブラウザ内で1枚の画像やキャプチャを処理できます。

  1. 01

    画像をアップロード

    PNG、JPG、WebP形式の画像ファイルをExtractタブにドラッグ&ドロップします。アニメーションGIFをアップロードした場合は、最初の1フレーム目のみが処理対象となります。

  2. 02

    テキストボックスをクラスタリング

    OCRエンジンが完成画像にすでに含まれている文字の位置を検出し、それらのバウンディングボックスを垂直方向の並び順に基づいて、本来の読み取り順序を反映した行へとクラスタリングします。

  3. 03

    読み取り順序を確認

    画面上で検出された改行と行ごとの並び順を確認し、整列されたテキスト行をクリップボードへ直接コピーします。

  4. 04

    書式付きファイルを出力

    改行が保持されたテキストをTXT、Markdown、HTML、DOCX形式のファイルとして保存できます。クレジットを消費することなく、無料でご利用いただけます。

クラスタリングされたOCR行

改行を維持するOCRが実現すること

配送伝票や縦に並んだ書類をスキャンする際、改行を維持するオンラインOCRは、検出したバウンディングボックスを行ごとにクラスタリングし、すべての文章が1つの崩れた段落に統合されてしまうのを防ぎます。複雑な複数段組の印刷レイアウトを推測したり、ファイル内に絶対座標を生成したりするのではなく、Extractタブが空間的な位置関係を認識し、完成画像にすでに含まれている文字を自然な読み取り順序の行シーケンスとしてグループ化します。

Extractワークスペースは無料でクレジットを消費せず、ページレイアウトの再構築も行わないため、オンラインOCRを使って画像からテキスト抽出を行う際にも元のピクセルは変更されません。本機能は手軽なオフラインOCRの代替として活用でき、画像のローカライズプロジェクト向けに画像からOCRテキストを取得したり、整理されたテキスト行をJPGからWord文書へ直接書き出したりできます。

無料で抽出を試す
検出された文字
RECIPE
置き換え後の文字
RECIPE

実践的な活用シーン

改行維持が活躍する主な活用事例

縦に並んだテキストを含む画像を扱う際は、単語を横一列にまとめず、各行を独立して分離させておくことが重要です。

配送伝票・宛名ラベル

受取人の住所、追跡番号、取扱上の指示をそれぞれ独立した行として保持し、倉庫業務やデータ入力作業をスムーズに行えます。

明細付きレシート・請求書

品目名、数量、合計金額を行単位で抽出し、数値と項目名が横方向に混ざり合って崩れた文章になるのを防ぎます。

ターミナルログ・設定ファイル

スクリーンショットからコマンドライン、パラメータフラグ、ターミナル出力を取得し、命令ごとの垂直方向の改行を正確に保持します。

予測しやすいフォーマット

座標クラスタリングがレイアウト崩れを防ぐ理由

一般的な文字抽出ツールでは、縦に並んだ複数行が1本の連続したテキストに平坦化されてしまい、並んだ項目の意味や文脈が失われがちです。座標クラスタリングは、検出されたボックス間の垂直方向の間隔を解析することにより、住所や請求書の明細行、技術パラメータなどをそれぞれの独立した行として維持します。ピクセル単位のレイアウト再構築を必要とせず、実用的なテキスト配置を実現します。

  • 住所、SKU、請求項目の明細、コードスニペットの行の分離を維持します。
  • プレーンテキスト、Markdown、HTML、Word形式へスムーズにエクスポートできます。
  • 元画像のピクセルを変更することなく、ブラウザ内で完全に無料で動作します。

抽出サンプル

実務における読み取り順序の保持事例

座標ベースの行グループ化により、実際の文書画像から抽出されたテキストがどのように読みやすく保たれるかをご確認ください。

配送ラベルの住所ブロック — original image
配送ラベルの住所ブロック — edited with ReWords AI

hero

配送ラベルの住所ブロック

住所ラベルをスキャンすると、受取人と番地の座標が個別の垂直行に分離されます。改行クラスタリングにより、単語が平坦な塊に結合するのを防ぎます。

INVOICEINVOICE

workspace

商業送り状(インボイス)の明細

明細化された在庫カードを抽出する際、各説明文がそれぞれ独立した改行で維持されます。エクスポートデータは明確な行分離を保ち、データベースツールへの貼り付けもスムーズに行えます。

PACKING LISTPACKING LIST

商業送り状(インボイス)の明細 — original image
商業送り状(インボイス)の明細 — edited with ReWords AI
ターミナルのスクリーンショットログ — original image
ターミナルのスクリーンショットログ — edited with ReWords AI

what

ターミナルのスクリーンショットログ

サーバーターミナルのキャプチャでは、コマンドプロンプト行やステータスメッセージがそのまま保持されます。垂直行の分離により、Markdownとしてダウンロードした際も実行ログの可読性が維持されます。

RECIPERECIPE

why

梱包ラベルの仕様表記

印刷されたロット番号や倉庫コードを読み取る際、エントリごとに独立した行が保持されます。整った縦並びリストをコピーすることも、構造化されたテキストドキュメントとしてエクスポートすることも可能です。

RECEIPTRECEIPT

梱包ラベルの仕様表記 — original image
梱包ラベルの仕様表記 — edited with ReWords AI

処理モデル

テキストワークフローの選択

改行抽出と画像再構築の違いと使い分けをご確認ください。

抽出タブ

改行の抽出

テキスト座標を自然な改行へとクラスタリングし、画像のピクセルを変更することなく、クリーンなTXT、Markdown、HTML、DOCXドキュメントを無料でエクスポートします。

置換タブ

ピクセルレベルのインペインティング

古いテキストを消去し、元画像のピクセル上に新しいテキストを直接レンダリングする必要がある場合は、有料クレジットを使用する置換タブに切り替えてください。

デスクトップOCR

複雑で肥大化したソフトウェア

ブラウザでクリーンに解析できる連続した行テキストを取得するためだけに、重厚なデスクトップ向けパッケージではローカルインストールや一括ライセンスが求められます。

利用者の声

ワークフローでの体験談

プロフェッショナルがReWordsを使用して、視覚キャプチャから構造化された行を抽出している方法をご紹介します。

  • “テキストボックスを順序通りの行にクラスタリングしてくれるので、住所ラベルを手作業で再入力する手間が省けました。クリーンなMarkdownをダウンロードできるのも非常に便利です。”

    Svea Almqvist

    物流コーディネーター

  • “技術文書を作成するためにターミナルのスクリーンショットから改行を維持して抽出する必要がありましたが、プレーンテキストのエクスポートですべてのコマンドがきれいに整形されました。”

    Madelief Terpstra

    システム管理者

  • “パッケージの仕様を1枚の写真ずつ抽出することで、品目コードが混ざることなくすべてのSKUをそれぞれの行に保持できました。”

    Ondrej Sedlak

    在庫管理スペシャリスト

  • “印刷された参照シートから個別の改行を維持したままWordにエクスポートできたため、ドキュメントのアーカイブ作業をシンプルかつスムーズに行えました。”

    Katsuro Maeda

    オペレーションリード

  • “印刷された領収書の内容を1つの連続したブロックにまとめることなく読み取れるため、明細化された経費を経理スプレッドシートに直接コピーする際にとても役立ちました。”

    Bente Skovgaard

    経理担当者

  • “PNGをドロップするだけで、視覚的な行ごとにHTML段落をエクスポートできるため、印刷されたお知らせをWebポータルに転記する作業が効率化されました。”

    Eoghan Callanan

    Webコンテンツマネージャー

よくある質問

改行を維持するOCRに関するよくある質問

改行を維持するOCRは、段組を再構築せずにどのようにテキストの配置を保ちますか?
このツールはバウンディングボックスの位置関係を評価し、文字を自然な読み取り順序へとクラスタリングして垂直方向の区切りに改行を挿入します。複数段組の複雑な出版レイアウトや絶対座標の再現を行うものではなく、行の順序と改行の維持に特化しています。
改行を維持するOCRは絶対座標やピクセル座標を出力しますか?
いいえ、幾何学的な座標データではなく、人が読みやすいテキスト構造の出力に重点を置いています。元のボックス座標を直接埋め込むのではなく、空間的な位置関係をテキストの改行、Markdownの段落、Wordの復帰改行(キャリッジリターン)へと直接変換します。
改行を維持するOCRで、新聞のような複雑な段組レイアウトを再現できますか?
複数段組の画像は、座標クラスタリングに基づいて垂直方向の行シーケンスとして整理されます。並列の段組印刷レイアウトやCSSのマルチカラム構造として再構築されるわけではありません。
HTMLやMarkdownの出力時、改行はどのように処理されますか?
HTML出力では、複雑なウェブページのスタイルシートを構築するのではなく、検出された各テキスト行に1つの段落タグ(pタグ)を割り当てます。Markdown出力では、見出しの階層や表タグを推測するのではなく、各行の間に適切な改行を挿入します。
改行を含む表形式のデータをスプレッドシート形式で書き出せますか?
ExtractタブはTXT、Markdown、HTML、DOCX形式の文書出力に特化しています。検出された行のクラスタをスプレッドシートのブックやXLSXファイルとして解析・書き出しすることはできません。
アニメーションGIFを処理した場合、どのように改行が保持されますか?
アニメーションGIFがアップロードされた場合、認識エンジンは最初の1フレーム目のみを読み取ります。その最初のフレーム内で検出された完成画像にすでに含まれている文字の行が、改行を維持した状態でクラスタリングされます。
一度にいくつの画像ファイルを解析できますか?
ワークスペースでは、1回の処理につきPNG、JPG、またはWebP画像を1枚ずつ処理します。20枚などの一括バッチ処理には対応していません。書式化されたテキストファイルのコピーやダウンロードが完了した後、次の画像をアップロードして処理を継続してください。
改行を維持したテキスト抽出を行う際、元画像のピクセルが変更されたり再圧縮されたりしますか?
いいえ、このツールは元画像のピクセルを編集、再圧縮、または変更することなく文字の位置を読み取ります。元の画像ファイルは処理中も処理後も一切変更されません。

ブラウザ内で無料抽出

画像から自然な改行をそのまま保持

検出されたテキストボックスを読み取りやすい行にクラスタリングし、ピクセルを変更することなくTXT、Markdown、HTML、DOCX形式で出力できます。

関連機能

その他のテキストツールを見る

ブラウザ専用のワークフローにより、画像ファイルからテキストを変換、抽出、フォーマットできます。

ブログ

関連記事