画像を編集可能なPowerPointに:JPGやPNGを本物のPPTXへ

要点:deckedit.comに画像をドロップすると、オンデバイスのOCRがすべてのテキスト領域を検出し、すべての見出し、箇条書き、キャプションがフラットな画像ではなく通常の編集可能なテキストボックスになった.pptxが返ってきます。全工程はブラウザ内で動きます。何もデバイスを離れません。本ガイドは、このツールが何をするのか、何が本当に編集可能と言えるのか、そして画像入力にどんな実際の限界があるのかについて正直です。

なぜ多くの画像からPowerPointへのツールは嘘をつくのか

画像からPowerPointを検索すると、ほぼすべての結果が内部で同じことをします。空白スライドを開き、JPGをスライドを覆う1枚の画像として埋め込み、.pptxとして書き出すのです。開くことはできます。編集はできません。テキストは画像に焼き込まれています。見出しをクリックしても、語ではなく画像全体が選択されます。

それは画像をPowerPointに変換しているのではありません。画像をPowerPointの殻で包んでいるだけです。閲覧や印刷には問題ありませんが、誤字の修正、見出しのスタイル変更、スライドの翻訳には役に立ちません。

編集可能とは実際に何を意味するか

本当に編集可能な.pptxは、すべてのテキスト要素が独自の文字、フォント、サイズ、色、位置を持つテキストフレームとして保存されています。見出しをクリックすれば打ち直せます。フォントを変えれば反応します。行を並べ替えればレイアウトが流れ直します。それがPowerPoint、Keynote、Google Slidesが作られた形式です。

画像入力からそこに到達するには、ピクセルを読み取り、各テキストブロックを分割し、文字を元の座標に本物のテキストフレームとして書き戻す光学文字認識が必要です。それがフラットな画像から本物の編集可能なスライドへの唯一の正直な道です。それに満たないものは、PowerPointの衣装をまとった画像にすぎません。

5ステップのワークフロー

ステップ1. JPGまたはPNGをDeckEditにドロップ

deckedit.comを開き、画像をアップロードゾーンにドラッグします。JPG、PNG、スクリーンショット、スライドの写真すべてに対応します。サインアップも、アカウントも、サーバーへのアップロードもありません。ファイルは最初から最後までお使いのマシンに留まります。上限は1ファイル30MB、1ドキュメント20ページです。

ステップ2. ローカルOCRがテキストを読む

DeckEditは、利用可能なときはWebGPUを使い、古いハードウェアにはWebAssemblyのフォールバックを使って、OCRパイプラインをブラウザ内で直接実行します。画像をスキャンし、テキストを含むすべての領域を検出し、その場で文字を認識します。1枚のスライド画像は現代的なノートPCで通常数秒です。画像のどのフレームもアップロードされません。

ステップ3. 検出されたテキスト領域を確認

DeckEditは検出した内容を領域ごとに、元の画像に重ねて正確に表示します。見出し、箇条書き、キャプションが正しく分割されたかが一目で分かります。領域が見落とされたり結合されたりした場合は、書き出し前に調整できます。このステップはOCRが何を見て何を見なかったかについて正直です。

ステップ4. ブラウザ内でテキストを編集

検出された各領域は今や本物のテキスト要素です。任意の見出し、箇条書き、キャプションをクリックして、その場で書き直せます。フォント、サイズ、配置、位置は元のものと一致します。誤字を直すためだけにPowerPointを開く必要はありません。インラインエディタは真のWYSIWYGなので、キャンバスは書き出される.pptxの見た目と一致します。

どんな画像入力が使えるか

DeckEditは標準的なJPGとPNGファイルを受け付けます。これにはPowerPoint、Keynote、Google Slides、Figmaの書き出しからのスライドのスクリーンショット、画面やプロジェクターから撮ったスライドの写真、印刷されたスライドのスキャン、AIスライド生成ツールがレンダリングした任意の画像が含まれます。複数ページの変換は最大20ページのPDFで動作します。

スライドのJPGは最も一般的なケースです。DeckEditはJPGをPNGとまったく同じように扱います。テキスト領域を検出し、文字を認識し、それぞれを同じ座標の編集可能なテキストフレームに配置し、元の画像を背景レイヤーとして保持します。出力はすべてのテキスト要素が選択可能な1枚スライドの.pptxです。

PNGのスクリーンショットは、文字の輪郭が鮮明に保たれるため、再圧縮されたJPGよりOCRが読み取りやすい最良の入力です。処理は同じで、テキスト領域を検出し、文字を認識し、元の座標の編集可能なテキストフレームとして配置し、元画像を背景レイヤーとして残します。

複雑なレイアウトの扱い方

スライドが1つの文章の塊であることはまれです。DeckEditは画像を独立したテキスト領域に分割するため、2段組のスライドは1つの塊ではなく段ごとの別々のテキストボックスとして戻ります。各領域は位置、サイズ、推定フォントサイズ、色を個別に保持し、単独で移動、リサイズ、書式変更、削除ができます。

  • 2段組・3段組のスライド: 各段がそれぞれの領域として検出されるため、左段の箇条書きと右段が混ざりません。
  • 表: セル内の文字が個別の編集可能な領域として復元されます。罫線は背景画像の一部として残るので見た目は保たれ、数値やラベルは入力できます。
  • グラフや図: 図そのものは背景レイヤーに保持され、タイトル、軸ラベル、凡例の文字は編集可能なテキストとして戻ります。
  • 写真や暗い背景の上の文字: 元の文字は背景から消去され、オーバーレイとして再描画されるため、暗い画像の上の明るい文字も読みやすく、書式変更もできます。

分割結果が意図と違う場合は、確認ステップで修正します。1つの見出しにすべき2つの領域を結合し、2つの箇条書きをまとめてしまった領域を分割し、書き出す前に位置を正確に合わせられます。各領域は独立した要素なので、詰まったスライドの一部を直しても他の部分は影響を受けません。

正直な限界

OCRは魔法ではありません。極端に低解像度の写真はモデルが必要とする細部を失います。濃い手書きや装飾的なディスプレイフォントは印刷文字より難しいです。一部の構成では非ラテン文字は英語より対応が弱くなります。DeckEditは実行中のOCRモード(WebGPUまたはWebAssembly)を表示するので、どの計算経路が使われたか分かります。確認ステップで領域がおかしく見える場合、それは隠れた失敗ではなく正直なフィードバックです。

その他のガイド

スライドの画像はありますか。編集可能にしましょう。

画像を編集可能なPPTに変換