【動画概要】
オーバーオールを着て全国を放浪しながら仕事をするさっさがお届けする「今夜は〇〇おじさん」。
今回は、神戸大学のゼミで進めている「100年企業の社内報・歴史資料の研究」がきっかけで起きた出来事をお話しします。
戦前からの膨大なPDF資料(約380ファイル・3000ページ)をテキスト化するため、AI(Claude)に相談したところ……言われるがままにターミナルへコードを貼り付けているうちに、パソコンの中に「NDL-OCR(国立国会図書館OCR)」を活用した一括処理プログラムが勝手に完成していました!
AIに使われているのか、AIを使いこなしているのか!?一晩で80万字のテキストを抽出した驚きのAI活用体験(読み取り編)をお届けします。
【目次 / タイムスタンプ】
00:00 オープニング(大阪滞在近況&久々の配信)
00:20 神戸大学のゼミで始まった「100年企業の社内報研究」
02:43 膨大な戦前資料PDF…スキャンデータ解読の壁
04:07 旧字体や縦書きに強い「NDL-OCR」との出会い
05:40 Claudeの指示通りターミナルを叩き続けた30分
07:45 朝起きたら完成!80万字(3000ページ)の一括テキスト化成功
08:48 今後の展望&チャンネル登録のお願い
【配信について】
毎週月曜日・木曜日の夕方頃に配信中!
毎回テーマに沿った「〇〇おじさん」として、仕事やAI活用、全国での日常をお届けしています。
ぜひチャンネル登録・高評価よろしくお願いします!
【ハッシュタグ】
#AI活用 #Claude #NDL_OCR #生成AI #プログラミング初心者 #Python #社内報 #デジタルトランスフォーメーション