タグ

ブックマーク / srad.jp/~yasuoka (2)

  • 書写言語研究におけるサンプルデータの重要性と妥当性 | yasuokaの日記 | スラド

    私(安岡孝一)の2016年2月26日の日記の読者から、近江龍一・西原陽子・山西良典の『ドメインにより意味が変化する単語に着目した猥褻な表現のフィルタリング』(人工知能学会第31回全国大会論文集, 2M2-OS-34a-1, 2017年5月24日)という論文を読んでほしい、との御連絡をいただいた。読んでみたのだが、書写言語研究におけるサンプルデータの重要性を全く理解していない論文で、正直、頭が痛くなった。 研究では猥褻な表現に関する文を集めるために,pixivに投稿されているR-18小説を用いた.R-18小説に分類される小説の中から,2016年10月のウィークリーランキングTop10の小説を選択し,分析に用いた. そんな偏ったサンプルデータ10で、まともな結果が出るわけが無いだろう。しかも、なぜpixivに限定しなければいけないのか、pixivに限定する意図は何なのか、この論文には全く書

    書写言語研究におけるサンプルデータの重要性と妥当性 | yasuokaの日記 | スラド
  • 文部科学省の考えるコンピュータの歴史 | yasuokaの日記 | スラド

    文部科学省が公表した「諸外国におけるプログラミング教育に関する調査研究」(大日印刷、平成27年3月)が、あまりにブッ飛んでいて爆笑した。特に「はじめに」の第一文。 1942年、今日の電子計算機の原型の一つが、ペンシルバニア大学ムーアースクールのJ.P.エッカート、J.W.モークリーによって論文としてACM(Association for Computing Machinery)に発表され、1945年には弾道計算用の実用機ENIAC(Electronic Numerical Integrator and Computer)が開発された。 いや、もう、どこから突っ込んでいいやら。とりあえず、ACMの設立は1947年で、Journal of the ACMの発行開始は1954年。一方、エッカートが1942年に発表した文書となると、たとえば「Light Modulating Method and

  • 1