Apacheログからの集計で日付毎の集計はよくやるのですが、ピーク時間帯だけを抽出して日付単位に合計と推移を評価したいなんてことが良くあります。 Apacheログ→Pandasでread_csv時にParseするわけなのですが、フォーマットは%Y-%m-%d %H:%M:%Sで列に入っていて日付と時間を分離するのもちょっとめんどくさい話になります。日付抽出はfloor('24h')などを使って時間部分を切り捨てればなんとかなりますが、時間部分だけ分離するのは少々苦労します。 結局断念しました。 で、なにか他の方法がないか探ったら・・いいやつがありました。 以下サンプルコードです。Pandas便利です。 import pandas as pd import datetime import numpy as np rng = pd.date_range(start = '2014-01-01'

