

hero
配送ラベルの住所ブロック
住所ラベルをスキャンすると、受取人と番地の座標が個別の垂直行に分離されます。改行クラスタリングにより、単語が平坦な塊に結合するのを防ぎます。
INVOICEINVOICE
ブラウザ上のExtractタブで改行を維持するOCRを実行し、検出されたテキストボックスを自然な読み取り順序へと整列させます。単一の画像からバウンディングボックスの座標をクラスタリングして行単位で正確に区切り、TXT、Markdown、HTML、DOCX形式で出力できます。元の画像のピクセルは変更されず、アカウントのクレジット消費なしでご利用いただけます。
ご利用の流れ
デスクトップアプリを導入することなく、ブラウザ内で1枚の画像やキャプチャを処理できます。
PNG、JPG、WebP形式の画像ファイルをExtractタブにドラッグ&ドロップします。アニメーションGIFをアップロードした場合は、最初の1フレーム目のみが処理対象となります。
OCRエンジンが完成画像にすでに含まれている文字の位置を検出し、それらのバウンディングボックスを垂直方向の並び順に基づいて、本来の読み取り順序を反映した行へとクラスタリングします。
画面上で検出された改行と行ごとの並び順を確認し、整列されたテキスト行をクリップボードへ直接コピーします。
改行が保持されたテキストをTXT、Markdown、HTML、DOCX形式のファイルとして保存できます。クレジットを消費することなく、無料でご利用いただけます。
クラスタリングされたOCR行
配送伝票や縦に並んだ書類をスキャンする際、改行を維持するオンラインOCRは、検出したバウンディングボックスを行ごとにクラスタリングし、すべての文章が1つの崩れた段落に統合されてしまうのを防ぎます。複雑な複数段組の印刷レイアウトを推測したり、ファイル内に絶対座標を生成したりするのではなく、Extractタブが空間的な位置関係を認識し、完成画像にすでに含まれている文字を自然な読み取り順序の行シーケンスとしてグループ化します。
Extractワークスペースは無料でクレジットを消費せず、ページレイアウトの再構築も行わないため、オンラインOCRを使って画像からテキスト抽出を行う際にも元のピクセルは変更されません。本機能は手軽なオフラインOCRの代替として活用でき、画像のローカライズプロジェクト向けに画像からOCRテキストを取得したり、整理されたテキスト行をJPGからWord文書へ直接書き出したりできます。
実践的な活用シーン
縦に並んだテキストを含む画像を扱う際は、単語を横一列にまとめず、各行を独立して分離させておくことが重要です。
受取人の住所、追跡番号、取扱上の指示をそれぞれ独立した行として保持し、倉庫業務やデータ入力作業をスムーズに行えます。
品目名、数量、合計金額を行単位で抽出し、数値と項目名が横方向に混ざり合って崩れた文章になるのを防ぎます。
スクリーンショットからコマンドライン、パラメータフラグ、ターミナル出力を取得し、命令ごとの垂直方向の改行を正確に保持します。
予測しやすいフォーマット
一般的な文字抽出ツールでは、縦に並んだ複数行が1本の連続したテキストに平坦化されてしまい、並んだ項目の意味や文脈が失われがちです。座標クラスタリングは、検出されたボックス間の垂直方向の間隔を解析することにより、住所や請求書の明細行、技術パラメータなどをそれぞれの独立した行として維持します。ピクセル単位のレイアウト再構築を必要とせず、実用的なテキスト配置を実現します。
抽出サンプル
座標ベースの行グループ化により、実際の文書画像から抽出されたテキストがどのように読みやすく保たれるかをご確認ください。


hero
住所ラベルをスキャンすると、受取人と番地の座標が個別の垂直行に分離されます。改行クラスタリングにより、単語が平坦な塊に結合するのを防ぎます。
INVOICEINVOICE
workspace
明細化された在庫カードを抽出する際、各説明文がそれぞれ独立した改行で維持されます。エクスポートデータは明確な行分離を保ち、データベースツールへの貼り付けもスムーズに行えます。
PACKING LISTPACKING LIST




what
サーバーターミナルのキャプチャでは、コマンドプロンプト行やステータスメッセージがそのまま保持されます。垂直行の分離により、Markdownとしてダウンロードした際も実行ログの可読性が維持されます。
RECIPERECIPE
why
印刷されたロット番号や倉庫コードを読み取る際、エントリごとに独立した行が保持されます。整った縦並びリストをコピーすることも、構造化されたテキストドキュメントとしてエクスポートすることも可能です。
RECEIPTRECEIPT


処理モデル
改行抽出と画像再構築の違いと使い分けをご確認ください。
テキスト座標を自然な改行へとクラスタリングし、画像のピクセルを変更することなく、クリーンなTXT、Markdown、HTML、DOCXドキュメントを無料でエクスポートします。
古いテキストを消去し、元画像のピクセル上に新しいテキストを直接レンダリングする必要がある場合は、有料クレジットを使用する置換タブに切り替えてください。
ブラウザでクリーンに解析できる連続した行テキストを取得するためだけに、重厚なデスクトップ向けパッケージではローカルインストールや一括ライセンスが求められます。
利用者の声
プロフェッショナルがReWordsを使用して、視覚キャプチャから構造化された行を抽出している方法をご紹介します。
“テキストボックスを順序通りの行にクラスタリングしてくれるので、住所ラベルを手作業で再入力する手間が省けました。クリーンなMarkdownをダウンロードできるのも非常に便利です。”
“技術文書を作成するためにターミナルのスクリーンショットから改行を維持して抽出する必要がありましたが、プレーンテキストのエクスポートですべてのコマンドがきれいに整形されました。”
“パッケージの仕様を1枚の写真ずつ抽出することで、品目コードが混ざることなくすべてのSKUをそれぞれの行に保持できました。”
“印刷された参照シートから個別の改行を維持したままWordにエクスポートできたため、ドキュメントのアーカイブ作業をシンプルかつスムーズに行えました。”
“印刷された領収書の内容を1つの連続したブロックにまとめることなく読み取れるため、明細化された経費を経理スプレッドシートに直接コピーする際にとても役立ちました。”
“PNGをドロップするだけで、視覚的な行ごとにHTML段落をエクスポートできるため、印刷されたお知らせをWebポータルに転記する作業が効率化されました。”
よくある質問
関連機能
ブラウザ専用のワークフローにより、画像ファイルからテキストを変換、抽出、フォーマットできます。
ブログ