日記(803)

<前 次>

無題

アンパンマンDB用のよみがな生成関数を作ってました。
ほぼひらがなとカタカナだけの変換ですが、入力作業がかなり楽になるものと思います。

例:ロールパンナとハンバーガーキッド→ろおるはんなとはんはあかあきつと

人に読ませるのではなくソートに使うだけなので、濁点などは取り除かれます。

へぶわーーーっ!!

オプーナやってました。
とある湖の底である爺さんと戦いました。
久々に燃えるボス戦!
爺さん本人は気付かない間にお隠れになったのですが、後衛のデカブツ2体が強い!
なにしろHPだけで言えば合計でサラマンダーを上回るし、攻撃力もなかなかのもの。
この場所に来る前に戦った別のボスが意外とあっさりプッチンと潰れてしまっていたので、ますます強く感じました。
そしていよいよラスボスと思われる方から湖の底まで届く大きな声でラストダンジョンにご招待されました。
その後仲間も増えたことだしと思ってサラマンダーと戦いに行ったらサラマンダーも仲間が増えてて返り討ちにあったんですけどね。

ナマライザ、docomoの検索ワードを拾えるようになったので公開しました。
ついでにURLデコードの時にエラー回避した方法の応用で検索ワード抽出全般を高速化できました。

無題

ナマライザ、読み込みながらURLデコードというのはしんどいので、とりあえず表示だけURLデコードに対応させてみました。
あと、docomoの検索ワードを拾えるようにしたいので、そちらに対応したら公開しようと思います。
検索ワードについては、いずれ検索ワードの解析方法をユーザー定義できるようにしたいと思っています。

無題

アクセス解析していたら、アンパンマン質問箱でAND検索を試みた形跡があったので、ちゃちゃっと実装してみました。
ところで、予定ページには既に書いていたのですが、正規表現検索というのを考えています。
例えば、「(苦|((ニ|に)(ガ|が)))(瓜|((ウ|う)(リ|り)))(マ|ま)(ン|ん)」という正規表現を作れば「ニガウリマン」でも「苦ウリまん」でも「にガ瓜まン」でもマッチさせることができるのです。
ただ問題は、ユーザーは普通正規表現を使わないこと、データベースに登録できるのは私の思いついたパターンのみであるということ。
つまり、ユーザーが正規表現で検索することはないと考えたほうが良いのです。
だから逆に正規表現のほうをこちらで用意してやると、ユーザーから来る予想外の表記ゆれにも柔軟に対応できるというわけです。
ところがこちらにも問題がありまして、部分一致ができないんです。
先ほどのニガウリマンの例でいけば、「ニガウリ」で検索すると、正規表現後半の「(マ|ま)(ン|ん)」の部分にマッチしないのでニガウリマンが見つけられないのです。
このあたりさえ解決できれば非常に便利になるはずなのですが…。
ちなみにこれをやると検索性確保のための表記ゆれの入力が不必要になるので、別名の項目自体を抹消するかもしれません。

無題

キ番登録フォームを完全にUTF-8に移行しました。

そういえば、ナマライザで、著名な検索エンジンに限らずURLに検索ワードを含むことがあるので、URLなどをデコードしながら読み込むフィルタをつけることを考えています。

無題

データベースのUTF-8への移行の準備段階として、EUC-JPのデータベースにUTF-8でアクセスする手段を作りました。
データベース自体をUTF-8にするにはそれなりに時間がかかり、その間はデータベースを使うことができないので、移行準備がバッチリ出来上がるまでは、表面上はUTF-8でも中身はEUC-JPを維持しておきたいのです。

無題

UTF-8での保存は意外と簡単でした。
http://d.hatena.ne.jp/so_blue/20080617/1213670472
CreateObject("ADODB.Stream")を使うといいみたいですね。
VB標準のファイル出力とは異なる方法ですが、こだわらなければなかなか楽です。

<前 次>