タグ

関連タグで絞り込む (0)

  • 関連タグはありません

タグの絞り込みを解除

rubyとRubyとjapaneseに関するHashのブックマーク (2)

  • Ruby で PDF と戯れるの巻 - Qiita

    とちぎ Ruby 会議 05 の懇親会の LT で発表したネタですが、一部の方から関心を持って頂けたようなので記事にします。 関心事の全体 まず、下記のような流れをサーバーで定期的に自動で行いたいという目的があるとします。 WEB で公開されてる PDF を取得 テキストを抽出 テキスト整形 データベースへ格納 今回やること 今回は PDF の取得やテキスト整形やデータベースへの格納は割愛します。 PDF からのテキスト抽出についての紹介だけをします。 今回の題材 今回は適当な go.jp サイトから文化庁の「敬語の指針」を選びました。この PDF を適当に開くと、1ページ目に「敬語の指針」「平成19年2月2日」「文化審議会答申」と書いてあるのが分かると思います。このテキストを Ruby で抽出してみましょう。 なんかライブラリに喰わせればテキストがポンと出てくるでしょ 色々調べた中で、P

    Ruby で PDF と戯れるの巻 - Qiita
  • 2010-08-01

    書いておかないとやっぱり忘れるので面倒でもいろいろメモを残すようにしよう。 topぽいUIの監視ツールが作りたかったのでncursesを使ってみたけどUTF-8文字列が文字化けして表示できなかったので解決策をメモ。 ncursesはそもそもマルチバイト文字の表示に対応していないので、その対応版であるncurseswを使う必要がある。 多くのディストリビューションではそもそもこれは別パッケージとして提供されているので注意。 基的にはncurseswはncursesとソースコードレベル互換ぽいので、ncursesrubyバインディングであるncurses-rubyを適当にいじってncursesw野バインディングとして利用することにする。 ncurses-rubyをncurseswとコンパイル 最新版を以下のサイトからダウンロード。 http://ncurses-ruby.berlios.d

    2010-08-01
    Hash
    Hash 2013/07/06
    Rubyのcursesで日本語を扱う
  • 1