Data Mining (データマイニング) part 1
■ このスレッドは過去ログ倉庫に格納されています
0001名無しさん@3周年
NGNGちょっくら語ってみろや
0002名無しさん@3周年
NGNG0003名無しさん@3周年
NGNG/ヽ /ヽ
/ ヽ / ヽ
______ /U ヽ___/ ヽ
| ____ / U :::::::::::U:\
| |?/// /Vヽ // ___ \ ::::::::::::::| 何このスレ…?
| |?ll l lノノノ))〉| | | U :::::::::::::|
| |ヽl ´∀`ノ|||U | | ::::::U::::|
| ||/ヽ!トv^ リ?| ├―-┤ U.....:::::::::::::::::::/
| |____ ヽ .....:::::::::::::::::::::::<
└___/ ̄ ̄ :::::::::::::::::::::::::|
|\? | :::::::::::::::::::::::|
?\ \? \___ ?::::::::::::::::::::::::|
0004名無しさん@3周年
NGNG0005名無しさん@3周年
NGNG0006名無しさん@3周年
NGNGとかは思わないので、地味に重回帰分析と多変量解析の勉強だけします。
0007名無しさん@3周年
NGNG米紙「韓国テレビスターが日本の寄付文化を変えた」
0008名無しさん@3周年
NGNGクロス表でいっぱいいっぱいです。馬鹿ばっかりですから。
0009名無しさん@3周年
05/01/30 03:42:290010べべ
05/02/01 00:45:56貧乏人は、重回帰と赤池AICの組合せでがまんしな。
数学音痴の文系はSOMがいいかな。
0011名無しさん@3周年
05/02/02 22:49:11だってさ、レコードが100万くらいで、フィールドがさぁ、7千くらいかな。
ニューロなんかしたら、、、いつ終わるか、、。5千くらいでランダムで拾ってもさ、
意味があるのかなぁ。ふあんだぁ。
0013名無しさん@3周年
05/02/15 23:26:520014名無しさん@3周年
05/02/17 02:58:390015名無しさん@3周年
05/02/17 20:22:04機械系とか分野がわかれるよ。
0016名無しさん@3周年
05/02/18 00:42:18持ちました。商売に使う印象を受けたのですが、日本の大学で研究しているところはありますか。
0017ぼるじょあ ◆yBEncckFOU
05/02/20 08:58:36∧_∧ ∧_∧
ピュ.ー ( ・3・) ( ^^ ) <これからも僕たちを応援して下さいね(^^)。
=〔~∪ ̄ ̄ ̄∪ ̄ ̄〕
= ◎――――――◎ 山崎渉&ぼるじょあ
0018名無しさん@3周年
05/02/20 19:53:26学ぶより、WEKAで遊べ!
これが使いこなせれば、様々な応用分野における分析者として一人前になれるはず
その気になればJAVAのソースを読む事だってできるから、下手な講義を聴講するより
身につくはず
もしも、上記を試し学者としてデータサイエンス理論や分析手法を極める気があるなら、
最低でも博士過程(xx先端技術大とか統数研(?)あたり)に進む必要がある。
学問としては未だ二流扱いなので、やはりKDDで論文発表をするのが王道だ
0019山.崎 渉
05/02/22 19:16:51━―━―━―━―━―━―━―━―━[JR山崎駅(^^)]━―━―━―━―━―━―━―━―━―
∧_∧
ピュ.ー ( ^^ ) <これからも僕を応援して下さいね(^^)。
=〔~∪ ̄ ̄〕
= ◎――◎ 山崎渉
__∧_∧_
|( ^^ )| <寝るぽ(^^)
|\⌒⌒⌒\
\ |⌒⌒⌒~| 山崎渉
~ ̄ ̄ ̄ ̄
∧_∧
( ^^ )< ぬるぽ(^^)
(⌒V⌒)
│ ^ ^ │<これからも僕を応援して下さいね(^^)。
⊂| |つ
(_)(_) 山崎パン
∧_∧ ∧_∧
ピュ.ー ( ・3・) ( ^^ ) <これからも僕たちを応援して下さいね(^^)。
=〔~∪ ̄ ̄ ̄∪ ̄ ̄〕
= ◎――――――◎ 山崎渉&ぼるじょあ
0020名無しさん@3周年
05/02/26 21:22:170021名無しさん@3周年
2005/05/04(水) 21:24:470022名無しさん@3周年
2005/05/04(水) 21:30:26教育用の駄作としか思えない。
そもそもDMでJavaはきっついな。
0023名無しさん@3周年
2005/05/10(火) 21:06:130024名無しさん@3周年
2005/05/15(日) 23:34:57今考えているのはマルチメディア・マイニングです。
その中でも動画を扱って何かしらのマイニングをしたいと思っています。
なんかいいネタないですかね?
動画にこだわらなくてもいいんで、こうゆうことをデータマイニングしたら
面白いとか、そんなのがあったら教えていただきたいです。
0025名無しさん@3周年
2005/05/21(土) 14:25:16てか、WEKA日本語化してくれ・・・
0026名無しさん@3周年
2005/05/28(土) 13:05:060027名無しさん@3周年
2005/06/01(水) 14:09:310029名無しさん@3周年
2005/06/11(土) 14:53:24分析なんてできね
0030べべ
2005/06/12(日) 09:56:47決定木以外で使えそうなclassifierは
SOMreg
サポートベクターマシンを重回帰ライクに変身させたもの。
多重共線性にめっちゃ強い重回帰って思い込めばいい。
LinearRegression
重回帰分析だけれど二つ機能が強化されている。
1.赤池AICを使って意味の無い項を自動的に消してくれる。
2.リッジ回帰 ・・・ 多重共線性を回避するためのくふう。
0031名無しさん@3周年
2005/06/12(日) 10:56:58同じく、予測に専念するなら意味のない項を消す必要もない。
リッジ回帰もなんかあれだし。
wekaは決定木だけだね。
0032べべ
2005/06/14(火) 02:18:10マルチコが重要では無い分野もあるんですね。
この話を棚上げすれば、「WEKAは決定木」だけ
といわれるとほぼ否定はできない。
そうすると使えるのは、J48とDecisionStumpく
らいかな。
グラフ機能も気に入ってますが。
でもバグが。
0033名無しさん@3周年
2005/06/14(火) 21:47:43狭義のデータマイニングではマルチコなんて一切問題にしないと思うんだけど?
0034名無しさん@3周年
2005/06/15(水) 04:25:47但しオプションメニュでGUIを有効にしてから動かしてくれよ
0035名無しさん@3周年
2005/06/15(水) 22:28:400036名無しさん@3周年
2005/06/16(木) 23:46:40Hidden Layerの追加・削除はマウス操作でできる
ちなみに自動設定ではデフォルトで、
(入力変数の数+出力のカテゴリ数)÷2 の数の
1層のHidden Layerになる (Hidden Layerがaの場合)
入力変数の数+出力のカテゴリ数 のHidden Layerにしたければ、
Hidden Layer設定にbを指定する
Hidden Layer設定に0を入れた場合は、Hidden Layer無しになる
GUIによる操作だけではなく、Hidden Layer設定でいろいろな設定が可能
だと思われる
0038名無しさん@3周年
2005/06/19(日) 09:25:14実務ではない。
0040名無しさん@3周年
2005/06/19(日) 11:58:240042名無しさん@3周年
2005/06/19(日) 15:23:57004337
2005/06/19(日) 15:36:30ごめん。でも一応線形モデルに限った話をしてるつもりはなかったんだ。
特徴選択しないみたいにかいてあったから、ちょっと疑問に思っただけ。
結局、クロスバリデーションかなんかで色々試したりして特徴選んだり、
正則化項の係数とか決めるんでしょ?
0045名無しさん@3周年
2005/06/19(日) 15:40:340046名無しさん@3周年
2005/06/19(日) 23:19:03個人使用なら、さんざん既出のWEKAだね。
使い勝手、動作の安定性はいまいちだが、主だったマイニング手法は
揃っているし、最近じゃ市販のツールが備えているプロセスフローを
アイコンと矢印によって図式化して実行する環境まで揃えている。
WEKAが決定木だけのツールだなんていうのは、どこぞの頭悪い工作員
の発言としか思えない。
市販ツールには200万円以上の価値があると認めている一人だが、
手法の数や機能の比較だけでその価値を語ることはできないのさ。
0047名無しさん@3周年
2005/06/20(月) 22:23:300048名無しさん@3周年
2005/06/20(月) 23:00:040049べべ
2005/06/27(月) 21:49:35たとえば説明変数x1, x2, x3に値を与えたとき、目的変数y1, y2を一度に
出力してくれるソフトです。
y1, y2は量的尺度でも名義尺度でも。
0050名無しさん@3周年
2005/07/02(土) 17:50:222000万件くらいのCSVデータ読ませてるんですが1時間してもロードが終わりません・・・
0051名無しさん@3周年
2005/07/15(金) 00:02:472000万件はすごいですね。実務では普通ですか?
クレメンタインだったらどれくらいの時間で読み込んでくれるでしょうかね?
まあ、PCの性能によるんでしょうね。
0052名無しさん@3周年
2005/07/15(金) 21:42:150053べべ
2005/07/22(金) 00:42:053-4-4 で発生していた visualize のバグが無くなってます。つまり、
プロットをクリックするとインスタンスの情報が表示されるようになり
ました。
きちんとメンテをしていることがわかりましたので本格的に使ってみ
ます。
0055名無しさん@3周年
2005/08/07(日) 02:52:030056名無しさん@3周年
2005/08/16(火) 05:54:20何製ならおまえは満足なんだ?
0057名無しさん@3周年
2005/08/17(水) 00:10:25理由はjapaより速いのと、個人の好み。
japa
0058名無しさん@3周年
2005/08/22(月) 19:18:45教科書見たら「マルチコの回帰式は問答無用で破棄すること」とか書いてあって、
素直にそれを信じてたんだけど、実務だとマルチコになっても全然OKってことなんですかね?
すごい・・・目から鱗です!
できればその辺詳しく教えていただきたいです。
0059名無しさん@3周年
2005/08/23(火) 00:32:24目的が予測(Prediction)か推定(Estimate)かということかと
一般的なデータマイニングはモデルの構造より予測精度が重要なのです。
線形回帰で精緻にモデル構造を同定するようなケースでは、
マルチコには気をつける必要がある
マルチコ発生状態ではモデルの予測値は安定していたとしても
パラメータ推定結果はふらついていて、たまたまモデルがそういう
構造になっただけかもしれないからね
リッジは荒っぽい言い方をすると、分母が0付近になる様なクリチカル
ポイント(Rank落ち)を意図的にちょいとずらしてパラメータ推定結果を
安定させるテク
0061べべ
2005/09/17(土) 08:44:25製造現場でマイニングを使うならマルチコは常に注意
しないといけないね。 主因子を誤ってしまうと現場
から怒鳴られ、ITなんか信用できねーとけちをつけ
られます。 (っておどかしたりして)
実践を積みながらまたは例題を解きながら理論を勉
強されることをお勧めします。
0062名無しさん@5周年
2005/09/17(土) 09:04:33それはマイニングというか統計学だろ。
0063べべ
2005/09/17(土) 21:19:30ベイズ統計やニューロ、重回帰、決定木をすべて使ってますので、
この意味ではマイニングでしょうね。 それでどの手法もマルチコ
の影響は受けます。影響を受けやすいのと、受けずらいのとがあり
ます。
それと統計学はマイニングの一部というか、必須科目と考えていま
す。 ベイズ統計は統計学ですが、情報を掘り起こすのにとても役
立ってますのでマイニングの一手法だと考えてます。
重回帰以外の手法でマルチコの説明をしている文献って知りません
か?
0064ななし
2005/09/18(日) 10:07:150065べべ
2005/09/22(木) 02:00:43!
0066名無しさん@5周年
2005/10/08(土) 22:59:190067名無しさん@5周年
2005/10/08(土) 23:39:270068名無しさん@5周年
2005/10/10(月) 16:03:37現場では線形判別分析とロジスティック回帰が半々。
それが現実
0069名無しさん@5周年
2005/10/29(土) 00:57:010070名無しさん@5周年
2005/10/29(土) 03:20:440071名無しさん@5周年
2005/10/29(土) 04:56:250072名無しさん@5周年
2005/10/30(日) 17:35:230073名無しさん@5周年
2005/11/01(火) 23:02:480074名無しさん@5周年
2005/11/03(木) 23:44:450075名無しさん@5周年
2005/11/06(日) 08:16:110076名無しさん@5周年
2005/11/06(日) 08:22:020077名無しさん@5周年
2005/11/07(月) 23:57:44特異モデルの漸近的挙動解析なら東工大の渡辺澄夫チームなのでは。
IBIS2005にも出してるみたいだが、今年のテーマもそれなのかは見てない。
0078名無しさん@5周年
2005/11/10(木) 21:53:550079名無しさん@5周年
2005/12/15(木) 17:12:130080マイニング素人
2006/01/02(月) 16:12:16どうやって進めたらいいんだろうな??
本気です!!!!!!
0081名無しさん@5周年
2006/01/31(火) 03:41:43漏れもリーマンで畑違いの文系大学中退野郎なので
下地の知識が全くないけど、参考図書とか日本語サイトとか
ぜひ教えていただきたいです!
実は最近になって、取り扱い商品(200万点以上!)の
新しい視点からの分類を業務でやらなくてはいけなくなり、
カテゴリー立てとそれぞれの商品を分類する作業を
自動化するためにデータマイニングを行う必要が出てきたわけです。
商品のスペックなどは既にデータベースに入ってるし
新規項目の追加作業や入力作業は外注で
サマーシーズン(6月)までに仕上がればいいのだけれど
肝心のカテゴライズなどを専門家や企画会社に外注する予算が
見積もりで専務段階で不許可になってしまったため
社内チームで知恵を絞って片付けてしまおうということに・・・。
せいぜい十数万くらいのソフトや参考書を購入する程度の
予算しかおりないはずなので、頭痛いです。
0082名無しさん@5周年
2006/02/06(月) 21:28:230083名無しさん@5周年
2006/02/07(火) 02:14:02ttp://blogs.yahoo.co.jp/pironotakarabako/6583234.html
0084名無しさん@5周年
2006/02/07(火) 03:44:19どうもありがとう!
でも難しくてよく理解できませんでした。
SVMや決定木は知ってるけど上っ面しか知らなかったので。
・・・勉強必要ですね。
0085名無しさん@5周年
2006/02/11(土) 21:12:43【金鉱脈】データマイニングのスレ【発見】
http://pc8.2ch.net/test/read.cgi/linux/1139645444/
0086名無しさん@5周年
2006/03/23(木) 14:25:49http://www.datamation.jp
0087名無しさん@5周年
2006/03/24(金) 03:56:44・アソシエーション (Association)
・k-meansクラスタリング
・階層的クラスタリング
・決定木 (GINI、エントロピー)
・一般線形モデル
・Nearest neighborモデル
・ニューラルネットワーク (多層パーセプトロン(MLP))
・回帰の木
・線形回帰
・ロジスティック回帰
・ラジアルベーシス関数 (Radial basis function - RBF)
サンプルコードあり
0088名無しさん@5周年
2006/03/27(月) 07:21:390089名無しさん@5周年
2006/03/27(月) 08:22:21BASICなどで書いて実際に動かしてみると良く分かると思います。
0090名無しさん@5周年
2006/04/17(月) 23:21:380091名無しさん@5周年
2006/04/21(金) 22:09:10素人は引っ込め
0092名無しさん@5周年
2006/05/15(月) 05:16:35いまいち分類が分からなくて。。。
0093名無しさん@5周年
2006/06/24(土) 23:08:320094名無しさん@5周年
2006/08/10(木) 21:57:58どこかで公開してないですか?
0095名無しさん@5周年
2006/08/22(火) 00:16:29質と量の両面において異なるから”?
数式を使わないデータマイニング入門 岡嶋裕史 光文社 2006/05/17
http://d.hatena.ne.jp/starocker/20060521
0096名無しさん@5周年
2006/08/29(火) 18:49:03なんか参考になりそうなサイトはないだろうか
0097名無しさん@5周年
2006/08/30(水) 06:32:45オレは matlab で書くときに somtoolbox の knn を真似したら早くなった。
euclid 距離の計算が秀逸だった(確かそこは別ファンクションだったと思うが)。
0098名無しさん@5周年
2006/08/30(水) 20:43:46matlabは使ったことないんだが
somtoolboxをDLしてknn.mを覗いてみた
やはり√は計算せずに
squared euclidean distanceだけ計算して遅延処理するんだな
計算が秀逸だってのはここの部分?
% Euclidean distance matrix between row vectors in X and Y
U=~isnan(Y); Y(~U)=0;
V=~isnan(X); X(~V)=0;
d=abs(X.^2*U'+V*Y'.^2-2*X*Y');
0099名無しさん@5周年
2006/08/31(木) 10:21:13そそ。おれなんかだと2重ループはしないまでも1重ループはしちゃってたから
全然速度が違った。ソースコードを読んでいなかったらそんな手法があるなんて知らずにずっと過ごしていたかもしれない。ガクブル
0100名無しさん@5周年
2006/08/31(木) 10:24:14あ、matlab を使ったことがないということなので一応。
matlab では for ループを使う処理をしないでできるだけ built-in 関数を使うようにするのが肝要なんです。早さが段違いに。
0101名無しさん@5周年
2006/08/31(木) 19:42:41ああ、最初暗号に見えてたんだが
これ因数分解した後に、多分転置行列を使って
ループ処理に相当するものを実行してるわけだよな、気づかなかった
C++でだけどsomtoolboxも一部参考にしながら
KNN法、何とか実装完了できますた
色々ありがとな!
0102名無しさん@5周年
2006/09/24(日) 14:00:54http://www.trueteller.net/
0103名無しさん@5周年
2006/09/27(水) 18:29:35昔、某企業でいろいろクライアントを抱えてデータマイニングやってました。
なかなかクライアントの要求するような精度・品質のモデルや分析ができることは少なく、実務をやっていた人間としてはつらい分野でした。
会社のバックアップ体制があまりよくありませんでした。短期間で成果を出す必要があったのです。
あのころのチームの人たちは離散して、多数が会社を辞めてしまいました。仕事の方向性もデータマイニングからみな離れてしまいました。私もです。
データマイニングを仕事にするならば、やはりちゃんとした長期的な自己研鑽、研究ができるような事業会社・大学などの機関のバックアップを得て、ちゃんと長期的にデータを見ていける立場でデータマイニングをする仕事を得られればよかったのかな、と思います。
0104名無しさん@5周年
2006/09/29(金) 15:41:41長期的に研鑽しなければならない、ってことはプロとしての
技量がまだないうちにクライアントを持っちゃったってこと
ですよ。
いろいろなアルゴリズムを一通り勉強して、ケースバイケース
で使い分けて・・・ってなんて甘いこと言ってるとプロに
なれないんですよ。これ、一般的に信じられている
「データマイニングの常識」のウソなんですよ。
だって、1つ1つ研究すれば学術論文が書けるほど奥深いものです。
そんなものを全部やろうとしたらものにならなくて当然ですよ。
「いろいろできる」は、「何もできない」ってこと。
自社のアプローチをしっかり持っている、ってことがプロの要件です。
いろんなアルゴリズムが詰まった有名なデータマイニング・システム、
あれ危ないですねえ。ご愁傷さまです。
0105名無しさん@5周年
2006/10/01(日) 02:14:08データマイニングの基礎編
http://www.nikkei-nbsonline.com/course/kouza_xav50501.html
0106名無しさん@5周年
2006/10/01(日) 03:27:13統計数理研究所が開発した主なプログラム
http://www.ism.ac.jp/computer_system/software_j.html
0107名無しさん@5周年
2006/10/02(月) 09:51:23タイチローさんですね。たくさん本出してるけど、正直、
データマイニング業界は迷惑してるよ。
統計はデータマイニングに含まれるけど、統計=データマイニング
じゃないからね。「ニューメディア」とか「マルチメディア」とか
かつの流行語は、どれも便乗組がその言葉を多用することにより、
定義があいまいになり、最終的に死語になって行ったよね。
「データマイニング」も同じ経過を辿ったね。
出版社もちゃんとした見識を持って欲しいものだ。
0108名無しさん@5周年
2006/10/09(月) 08:31:11あなたはただの研究者で実務経験がなさそうだ。
0109名無しさん@5周年
2006/10/10(火) 05:06:340110名無しさん@5周年
2006/10/13(金) 16:41:41>109
104で言っていることの意味が理解できてる?
コミュニケーション能力の達人さま。
0111名無しさん@5周年
2006/10/13(金) 22:33:180112名無しさん@5周年
2006/10/14(土) 05:45:11研究室でご苦労様。実社会では使われない研究ガンバだ。一度も実社会でやったことないのでは?
0113名無しさん@5周年
2006/10/14(土) 10:46:39108だけど、自分はコミュニケーション能力について言ってるわけではない。
104は実務の中でクライアントは数学的な細かい話なんて誰も興味がないって事が解ってなさそうだなと思っただけ。
数学的な精確さより、いかに巧くアウトプットを見せられるかが重要。
>>111
そういった会社も結構ある(あった)けどどこも芳しくなさそう。
理由は実務でデータマイニングに携わっている人間ならわかるでしょ?
0114111
2006/10/14(土) 14:01:52情報の価値が低いか 市場の開拓からやらないといけないからかな
しかも米国の真似が基本で 自ら作った技術じゃないものな
0115名無しさん@5周年
2006/10/14(土) 15:24:59価値・必要性を正しく理解し、すべてのデータマイナーが
目的に合った正しい手法を正しく適用して、まともな
成果を上げる、ということは夢物語ですよ。
世の中の2/3ぐらい(いやそれ以上?)は間違いだらけ、
というのが現実。それでも、データマイニング技術の
すべてがウソだというわけではなく、ちゃんとした成果
の出る状況、方法、ツールは確かにあります。
結局、自分がヘボなグループに入るのか、まともな
グループに入るのか、ということですよ。
少なくとも総花的な解説書やツールは、手ごろな教材には
なっても、実用向けじゃないってことは肝に銘ずべきかと。
0116名無しさん@5周年
2006/10/15(日) 03:53:020117名無しさん@5周年
2006/10/15(日) 09:27:33それを日本に持ってくるとよってたかってヘボにしてしまう。
現在の日本でのデータマイニングは、戦前の品質管理のような
段階だね。欧米に決定的に差をつけられていることに気がつく
までは、真剣に取り組むことができない。
真剣に取り組むと、10年か15年ぐらいで追いつくことはできる
でしょ。そうすると、また「日本型」という思想が出てきて、
良い面もあれば、悪い面もあったりと。良い面は徹底して洗練
させるとこだが、悪い面は宗教みたいに、あるいはバカの一つ
覚えみたいになってしまうとこだな。
現段階ではまだ安直に「日本型」みたいな変形をすると、
骨抜きになってろくなことがない。
0118名無しさん@5周年
2006/10/15(日) 15:18:260119名無しさん@5周年
2006/10/15(日) 17:58:35システム・ベンダー(BIプロバイダー)の区別がついてない。
良質で独創的なデータマイニング技術を持っている会社は、
残念ながらそんなに大きくない。アカデミックでは有名でも、
ビジネスの世界ではまったく無名。当然、日本には本格的な
営業基盤を持ってない。宣伝もしてなきゃ展示会にも出てない。
だから、フツーの会社には気づかれてもいない。残念。
日本語版まであっても、フツーの人は気がつかない。
蛇の道は蛇で、評価眼のある人間にしかピンと来ないように
なっている。質の悪いクライアントを持つと商売にならない
のでクライアントを選んでるのだ。したがって、けっして安く
はないが、有名ベンダーよりもずっと良質なサポートが可能。
ファーストフードと高級レストランの違いみたいなもんだな。
0120名無しさん@5周年
2006/10/15(日) 23:00:290121名無しさん@5周年
2006/10/16(月) 23:21:21はやく学部を卒業しような。
0122名無しさん@5周年
2006/10/16(月) 23:33:48研究室のお子様は引っ込んでろ。
0123名無しさん@5周年
2006/10/16(月) 23:39:25それが根本的問題か。オモチャじゃないんだよ。
0124名無しさん@5周年
2006/10/17(火) 00:13:33ブレークダウンして作ることから始まるわけなんだけど、先生も生徒も
それをどうするかも知らなかったわけ。OracleとかSQLの操作もあんまり
できないわけよ。国公立の大学だった。会社派遣で行かされて気を失った。
まあ、おままごとしてな。
0125111
2006/10/17(火) 03:19:080126名無しさん@5周年
2006/10/19(木) 21:18:400127名無しさん@5周年
2006/10/20(金) 14:17:39ベンダーにも責任の一端があるが安直な結果を期待するからダメなのよ。
たとえばCRMに使うのなら、本気で顧客を理解しようとしているかどうかだよ。
そうじゃない香具師が使うからオモチャにしかならないんだよ。ばーか。
お子様はさわるな。
0128名無しさん@5周年
2006/10/20(金) 14:40:140129名無しさん@5周年
2006/10/23(月) 22:22:300130名無しさん@5周年
2006/10/24(火) 12:17:010131名無しさん@5周年
2006/10/24(火) 20:03:500132名無しさん@5周年
2006/10/24(火) 21:12:350133名無しさん@5周年
2006/10/25(水) 22:28:510134名無しさん@5周年
2006/11/02(木) 08:23:450135名無しさん@5周年
2006/11/10(金) 00:07:19どうすれば使えるのでしょうか?
アドバイス、よろしくお願いします。
0136名無しさん@5周年
2006/11/12(日) 05:30:470137名無しさん@5周年
2006/11/12(日) 10:44:030138名無しさん@5周年
2006/11/13(月) 01:03:470139名無しさん@5周年
2006/11/14(火) 01:28:03政治家東大理3卒医師や一流ブランド大企業の奴らには使わせたくないんだ。
どうやったら識別出来る?
あと、米系大手外資系証券米系戦コン正社員にも
使わせたくないんだ。どうやったら識別出来る?
0140名無しさん@5周年
2006/11/14(火) 01:29:43どうやったら奴らからのアクセスを識別出来る?
0141名無しさん@5周年
2006/11/14(火) 08:29:110142名無しさん@5周年
2006/11/14(火) 20:14:27http://etc4.2ch.net/test/read.cgi/motenai/1163269007/
0143名無しさん@5周年
2006/11/15(水) 08:30:230144名無しさん@5周年
2006/11/27(月) 00:27:470145名無しさん@5周年
2006/12/10(日) 10:00:270146名無しさん@5周年
2006/12/12(火) 00:54:440147名無しさん@5周年
2006/12/17(日) 11:59:440148名無しさん@5周年
2006/12/17(日) 19:18:460149名無しさん@5周年
2006/12/18(月) 00:36:190150名無しさん@5周年
2007/02/25(日) 01:23:29ないでしょうか?ググッてもたいしたサイトが出てこず。。。(><)
0151名無しさん@5周年
2007/05/07(月) 02:44:240152名無しさん@5周年
2007/05/29(火) 05:15:30なぜなら、とりあえずでももっともらしい結果を出せてしまうから。
GIGO(GarbageIn,GarbageOut)をしていることに気が付いていない。
適当なModelingをしても、それが妥当かどうかを検討するだけのModelに対しての知識がある人が少ない。
専門でやっている人は研究者だし、研究者は実務しらないし、で実務の担当者はモデルを知らない。
お互いに、「専門バカ」、「理論すら知らない」と馬鹿にしあうだけで、その両穂を兼ね備えている人材が極めて少ない。
DataMiningの適切な応用がすすんでいない理由の一つである気がする。
0153名無しさん@5周年
2007/05/29(火) 11:05:410155名無しさん@5周年
2007/06/16(土) 21:24:230156名無しさん@5周年
2007/08/17(金) 19:26:420157名無しさん@5周年
2007/08/19(日) 11:25:38んで、何処のを使うん?
0158名無しさん@5周年
2007/08/20(月) 02:00:430159名無しさん@5周年
2007/08/20(月) 20:21:32回帰しか頭に無いのだろうが、それすらバグだらけだぞ。
0160名無しさん@5周年
2007/08/21(火) 02:06:07売上貢献できればバグOK。EMの借金払うんだよ。
0161名無しさん@5周年
2007/08/26(日) 11:34:05頑張れよ。
0162名無しさん@5周年
2007/08/30(木) 01:10:260163名無しさん@5周年
2007/12/18(火) 19:59:13研究する機関なのか?
国立情報学研究所第7回市民講座
社会を探るデータマイニング 〜データの山から新たな発見!〜
日 時: 2008年1月16日(水)18:30〜19:45
場 所: (東京都千代田区) 学術総合センター 2階 中会議場
講 師: 市瀬 龍太郎(国立情報学研究所准教授)
http://www.nii.ac.jp/shimin/index-j.shtml
http://events.nikkeibp.co.jp/seminar/detail/538806
0164名無しさん@5周年
2007/12/19(水) 03:09:26ゴニョゴニョした訳だが
コレでニートレーダーにクラスチェンジ…
するにはDBの構築から始めんといけんのよなぁ
そしれ人手はともかく先立つものは無し。
嗚呼収益があがる日はくるのだらふか…
0165名無しさん@5周年
2007/12/19(水) 08:44:22怪しいアンケートやらとにかくかきあつめてみた信頼性ってなにそれ? ってゆう
ようなゴミみたいなネタにガマの油ふりかけてもっともらしいおまじない唱えて、
欲しい結論やクライアントの希望どおりの結論だすための、ま、いってみりゃ、様式美。
コンピューター占いの二番煎じってとこだよね。
0166名無しさん@5周年
2007/12/19(水) 13:13:280167名無しさん@5周年
2007/12/21(金) 18:33:550168名無しさん@5周年
2007/12/21(金) 21:55:50実務者は難しすぎるって初めから投げてる場合が多いけど、研究者が歩み寄る姿勢の方が極端に無い
>>164
DB構築がどこまでを指してるかわからんが・・・
OracleもSQLServerもタダで使える時代
DB設計ツールもDBDesignerなどフリーな物がある
チューニングに関して言えばそれなりの知識が必要だけど、
チューニングツールもそれなりに付属してるからそれ使えば・・・
0169名無しさん@5周年
2007/12/21(金) 22:29:500171名無しさん@5周年
2007/12/23(日) 14:47:57Oracleって無料なんですか?
0173164
2007/12/24(月) 03:18:38なかったっけ?自分はDB2だが(こちらも無料版あり。
>168
データの取得・入力方法を気にしていた。
運用と書くべきだったかもしれん。
設計とチューニングはまぁマニュアルを熟読して"べからず"を避け、
使えるオプションを試す以外にないだろう
0175164
2007/12/25(火) 04:28:29もっとプリミティブな話でマイニングに使うデータを
どこから取得して(加工して)データベースに突っ込むか、
またその労力を日々のルーチンワークとして賄える位に
自動化・省力化できるか、という辺りです。
なにせ0からDBを作らなきゃならない。株価位はどこにでも
転がってるだろうけど、財務とか為替とか他のパラメーターを
取ってきて入力するとなると手間が馬鹿にならない事を危惧している訳です。
ニートだから時間はあるけどそれにかかり切りにはなれないし、
結局先立つものの為に働かなきゃならないし。
0176名無しさん@5周年
2007/12/28(金) 00:53:37ただ単に分散が最も大きくなるように分類を行い、回帰分析を行っているだけですか?
それともそれぞれの末端ノードでの回帰が最もフィットするように分類させているのでしょうか?
そうだとしたらどのようなロジックで・・・
0177名無しさん@5周年
2007/12/28(金) 17:25:20http://video.nifty.com/cs/catalog/video_metadata/catalog_071228051260_1.htm
秋葉系格闘家が名古屋大学相撲部で戦う映像
http://video.nifty.com/cs/catalog/video_metadata/catalog_071228051258_1.htm
0178名無しさん@5周年
2007/12/28(金) 17:26:08http://video.nifty.com/cs/catalog/video_metadata/catalog_071228051260_1.htm
秋葉系格闘家が名古屋大学相撲部で戦う映像
http://video.nifty.com/cs/catalog/video_metadata/catalog_071228051258_1.htm
0179名無しさん@5周年
2008/01/05(土) 18:02:000181名無しさん@5周年
2008/01/13(日) 10:55:580182名無しさん@5周年
2008/01/13(日) 11:06:49実務で使いたいと思うのなら実務担当者が歩み寄ればいいだけの話。
実務へ研究成果を広めたいと思うなら研究者が歩み寄ればいい。
それだけだよ。
実務担当者の言い分は筋が通っていない。研究成果を実務へ落とし
込みたいと思うだけで頭を使わない。
落とし込む為に頭を使って調整するのはアナタの仕事ですから!
残念!
0183名無しさん@5周年
2008/01/13(日) 20:36:370184名無しさん@5周年
2008/01/13(日) 20:47:21でもそんなのカンケーネー
0186名無しさん@5周年
2008/03/09(日) 21:26:400187名無しさん@5周年
2008/03/10(月) 01:39:11http://www.cs.waikato.ac.nz/~ml/weka/index.html
見る限り終わってないんじゃね?
気になるならMLに登録して直接聞いてみればいい。
0188名無しさん@5周年
2008/03/12(水) 23:56:010189名無しさん@5周年
2008/04/09(水) 00:35:20SQLサーバ買えば無料で付いてくるんだよね?
最強っぽいんだけど。
0190名無しさん@5周年
2008/05/15(木) 20:41:57SPSS Data Mining Day
日時:2008年6月17日(火) 受付開始 9:30〜
会場:セルリアンタワー東急ホテルB2F セルリアンタワー ボールルーム
東京都渋谷区桜ヶ丘26-1
参加費:無料(事前登録制)
主催:エス・ピー・エス・エス株式会社
http://www.spss.co.jp/dmd/index.html
0191名無しさん@5周年
2008/06/08(日) 19:30:170192名無しさん@5周年
2008/08/01(金) 10:53:30あるんですか?
0193名無しさん@5周年
2008/08/01(金) 12:40:14データマイニング毎日しているということは、少ないでしょうが、
マイニングの結果を日夜利用している企業は多いですよ。
その面から見ると、
必要不可欠として使用しているケースと
無ければないでどうにかなるが使用しているケース
に分かれるかと思います。後者の多くはマーケティング利用に
みられ、前者はリスク分析関連に見られます。
カードクレジットや個人融資などの顧客判別では、当たりまえに
なっています。
こんなところで良いですか。
0194名無しさん@5周年
2008/08/14(木) 03:25:470195名無しさん@5周年
2008/08/22(金) 17:41:28データマイニングアルゴリズムを知りたいのですが、お薦めの本、HPがあれば教えてください。
0196名無しさん@5周年
2008/08/22(金) 18:57:180197名無しさん@5周年
2008/08/22(金) 20:36:280198名無しさん@5周年
2008/08/22(金) 20:54:04共分散構造分析はマイニングの範疇というより
代表的な統計アプローチ。
クラスターは、それぞれにある(扱うデータ量等の関係で)でも
ごっちゃになってる。
まあ、データ分析全体をマイニングと呼ぶなら、別にそれでいいが。
ところで本題。
オーム社の「データマイニングの基礎」あたりはどうでしょう。
Webにもたくさん転がっているので(特に海外)その辺も参考にして
みたらどう?
youtubeにも有るので、英語の勉強かねてってのもありかな
0199名無しさん@5周年
2008/08/22(金) 20:57:12共分散構造分析は、豊田先生あたりので出てないのかな?
誰か教えてあげてください。
0200194
2008/08/23(土) 12:21:25紹介どうもです。基礎の本は入手しましたが、
なかなか道は険しそうです。
決定木ってなに?というレベルなのでw
統計力学は学生時代にやったからその延長で
対処できると思ったんですが orz
0201195
2008/08/25(月) 12:51:22ありがとうございます。
一度探してみます。
豊田さんの共分散構造分析の書籍はあらかた購入しました。
youtubeで講義でも見れるのですか?
0202名無しさん@5周年
2008/11/06(木) 23:04:170203名無しさん@5周年
2008/11/25(火) 19:42:51SPSSのデータマイニングソフトって、1500万円もするの?どんな有能なソフトなの?
SPSS Clementine
http://japan.zdnet.com/hikaku/story/0,3800078090,00000015p,00.htm
0204名無しさん@5周年
2008/11/25(火) 22:41:01でもSASのエンタープライズマイナーだと、
レンタルの初年度でこのくらいとられる
0205名無しさん@5周年
2008/12/01(月) 16:06:260206名無しさん@5周年
2008/12/01(月) 23:13:43それで済む人はそれでいいだろう
0207名無しさん@5周年
2008/12/02(火) 03:57:100208名無しさん@5周年
2008/12/20(土) 16:30:060209名無しさん@5周年
2008/12/20(土) 16:52:080210名無しさん@5周年
2008/12/21(日) 16:29:120211名無しさん@5周年
2008/12/22(月) 12:33:38基本は自然言語処理の延長で、技術的にもそれを踏襲(ふとう)している。
マーケティング分野の利用が多いが、応用のための分析手法はマイニングというより統計手法の利用が中心。
現在の景気のような、未曾有(みぞうゆう)の事態が発生している世の中では重宝されそうに感じるが
分析結果事態はぼや〜っとしたイメージを出力している程度なので、結果を信じて怪我(かいが)しない
ように注意が必要。
<麻生太郎(ましょうたろう)でした>
ただし。インターネットデータの文言・文書検索の部分では、統計手法よりも
データマイニングの技術が利用されることが多い。
<これは太郎君ではありません>
0212名無しさん@5周年
2008/12/22(月) 13:26:14マイニングの厳しい定義はあるわけ?
統計は単なるツールでしょ?
分野によってはマイニングというと
因果関係のあいまいな相関ばかりみつけて
役に立たないと揶揄されているようだけど。
0213名無しさん@5周年
2008/12/22(月) 16:34:02あくまで応用の一つ。
時に統計の手法も利用される(利用できるものは何でもと言ったほうが
いいだろうか)。
基本は大容量データを対象としたところからのスタートなのだが
なんだ〜かんだ〜で、個人解釈で広がっちゃっているってな感じ。
テキストマイニングは、言葉として「マイニング」がつくので
データマイニングの仲間と思われがちだが、データマイニングの考えを
使うこともある。といったほうが良いかもしれない。
アンケートによくある少量のデータだと、統計手法に頼るしかないだろうしね。
>因果関係のあいまいな相関ばかりみつけて
>役に立たないと揶揄されているようだけど。
そのとおりだね。
でもマイニングが悪いというより、利用者と教える側の問題が大きいでしょう。
実務データなので、数理だけでなくデータそのものを分かって使わないとね〜。
と勝手なこと言っちゃいました
0214名無しさん@5周年
2008/12/23(火) 00:50:45それらを使った知識発見(因果関係、異常などの発見等)、テキストマイニングの内容も扱ってるし、結構何でもありな感じなのかな
0215名無しさん@5周年
2008/12/23(火) 01:36:43と袂を分けた)知識発見だけど、時間とともに特に日本では
教育研究分野の論文ネタ不足から、色々参入してきて
好き勝手なことを言い始めたというのが真実でしょう。
統計的データマイニングとかね。大学でのテキストマイニングのブームも同類
(形態素解析等々の基礎技術は別)。
大量データを回せないツールでも、マイニング出来ると言い張ったり(勿論
一部はできる)。
元々の発祥分野の人工知能の研究者も、こっちの水が甘いぞと
また入ってきたりで、何でも有りになったってところですね。
特殊な分野向けの手法はそれとして、適用範囲の広い手法は限られて
いるのが現状。
先ほどの、「因果関係のあいまいな相関ばかりみつけて」などは
本格的な実務応用ではそれ程使われているわけではない。広告的には
使われてますが。
まあ、まずはどの分析にもあるように、基本的なもの(クロス表なり
なんなりの分野に適したもので)で、しっかりとデータを眺めること
から始めるのが本来でしょう。
データの見方を自由に、ときに割り切った見方で。といのはマイニング的
といっても良いかもしれませんね。その面では、アプローチを好まない方も
いるでしょう。
0216名無しさん@5周年
2008/12/24(水) 12:59:15フィッシャーの線形判別分析の分離度って
負の値をとることがあるかな?
0217名無しさん@5周年
2008/12/28(日) 16:50:36ぶっこんでもっともらしい図を作って論文作れないかなー、と夢想している
私がいる。
0219名無しさん@5周年
2008/12/29(月) 05:26:10この分野に興味があるんだけど、どこから勉強し始めていいのか
分からない。大学(院)レベルでどういうテキスト使って勉強
するのが良いのか知りたい。
教えてよ、すっごくエロいひと。
0220名無しさん@5周年
2008/12/29(月) 13:57:490222名無しさん@5周年
2008/12/29(月) 14:46:39大学教員はみんな解雇すべきだね。
0223名無しさん@5周年
2008/12/29(月) 17:00:240225名無しさん@5周年
2008/12/29(月) 18:19:55統計とか論理的思考は勿論だろうけど、例えば微積分だとか複素数とか
そういうの知ってると役に立つ?
0226名無しさん@5周年
2008/12/29(月) 18:38:24> 例えば微積分だとか複素数とか
> そういうの知ってると役に立つ?
微積分は画像処理には使う。幾つかの機械学習アルゴリズムにも使う。
複素数はいらない。
0227名無しさん@5周年
2008/12/29(月) 18:48:38あと、ベクトル埋め込みだの次元削減だのってことを真面目にやろうとすると、最近は多様体とか使うから、微分幾何学も役に立つかも
この辺は、データマイニングと言うより機会学習の話っぽいけど
0228名無しさん@5周年
2008/12/29(月) 18:54:330229名無しさん@5周年
2008/12/29(月) 20:59:05何を専門に研究するかで必要なテクニックはかなり限られると思うんだけど。
0230名無しさん@5周年
2008/12/29(月) 21:06:450231名無しさん@5周年
2009/01/02(金) 12:16:24コンピューターサイエンスに属するのか?
それとも情報?
0232名無しさん@5周年
2009/01/03(土) 23:54:46?どうしてるのかな?
0234名無しさん@5周年
2009/01/04(日) 10:22:03100GBのテキスト読ませてるけど終わんない。どうしよ。
0235名無しさん@5周年
2009/01/04(日) 13:50:451Gも読めないよ。そもそもメモリを100G積んでいるわけないんでしょ?
Rはオンメモリで分析データを全てメモリに配置します。
Rはまだ学生と研究者の為のツール。
これが現実なんだよね。
0236名無しさん@5周年
2009/01/04(日) 14:17:590237名無しさん@5周年
2009/01/04(日) 15:08:45実際に100G扱うような人なら対処方法もわかるはず。
Rを捨てSASで処理とか。
100MBでも正直きついよね。
よく落ちる。
>>236
パッチ当てると100G扱えるのですか?
0238名無しさん@5周年
2009/01/04(日) 16:30:37そういうRでデータマイニングみたいな本は、「大量のデータから知識発見」ってことより「統計、機械学習的手法によるデータの解析」について書かれてるんじゃないか?
0239名無しさん@5周年
2009/01/04(日) 16:33:04それと、「~の規制がかけられてる」んだったら自分でソース
とってきてそれを修正してビルドするべき。
C、C++を知らないなら、自分で学べ。
いちいち人にやってもらおうなんて思うなよ。
0242名無しさん@5周年
2009/01/04(日) 16:59:06探せばなんでもあるよ。機械学習のパッケージも沢山ある。
Googleリサーチも全体的にPythonを使用して研究してるのは有名。
0243名無しさん@5周年
2009/01/04(日) 18:28:120244名無しさん@5周年
2009/01/04(日) 18:42:30興味本位で同じことできるか試しただけです。
2GBの壁はでかい。Rの本がたくさんでてるから、試そうと。
アプリを処理ごとに分けてたら仕事が終わらない。
会社としては一個のアプリで大半をやれればありがたや。無理
だけど。
DBからの切り出しからスコア付けまで複数のアプリでまたがると
面倒なんです。
0247名無しさん@5周年
2009/01/04(日) 19:20:070248名無しさん@5周年
2009/01/04(日) 20:44:570249名無しさん@5周年
2009/01/04(日) 21:36:11データマイニングなんて言えるレベルではないのよね。
0251名無しさん@5周年
2009/01/04(日) 22:20:27試す前にどうかなと。やはりSASで加工します。
焦ってました。正月明けにSASでデータをTRANSPOSEします。
0252名無しさん@5周年
2009/01/04(日) 22:31:290254名無しさん@5周年
2009/01/04(日) 23:40:00procでぐりぐりやるのは嫌なので新しいアプリとか覚えようかと思って
大晦日から正月にかけて自前サーバでがんばしてました。
0255名無しさん@5周年
2009/01/04(日) 23:51:53気にすんな
DATAステップを中心に作った方がいいよ。
市販の本では紹介されてない機能で相当なものがある。
必要なら、他言語とインタフェイスもとりやすい。
0256名無しさん@5周年
2009/01/05(月) 00:25:200257名無しさん@5周年
2009/01/05(月) 02:02:490258名無しさん@5周年
2009/01/05(月) 07:38:31.NETやJava等々とインタラクティブにやり取り
できるよ。オプション無しでね。
0260名無しさん@5周年
2009/01/05(月) 20:15:530261名無しさん@5周年
2009/01/06(火) 22:45:23設定とかありますか?調べても出てこなくて。
0263名無しさん@5周年
2009/01/08(木) 12:27:31まあ学生なんだろうけど頑張ってエクセルのデータでも集計してなよ。
0264名無しさん@5周年
2009/01/08(木) 13:46:350265名無しさん@5周年
2009/01/08(木) 14:32:45エクセルなんて使う奴学生にもいねーよ
0267名無しさん@5周年
2009/01/08(木) 15:04:07確かにPythonでWeaveからCを使って
簡単に最適化出来るのは神だな。
湾岸戦争の頃のサダム・フセインに匹敵する神だな。
でもガチでCエクステンション書くのは結構面倒くさくね?
0269名無しさん@5周年
2009/01/08(木) 19:27:380270名無しさん@5周年
2009/01/08(木) 20:40:340271名無しさん@5周年
2009/01/08(木) 21:12:15他にはどこにも行けなくなるんだがなw
0273名無しさん@5周年
2009/01/09(金) 01:51:31人いる?
0274名無しさん@5周年
2009/01/09(金) 06:21:52持ってるスキルとか知識が全部中途半端
0275名無しさん@5周年
2009/01/09(金) 06:56:40データマイニングは自分で学ぶものだろ?
あれは学問的な知識うんぬんよりも、経験の方が大事なんだから。
0276名無しさん@5周年
2009/01/09(金) 08:29:57一方、組織を動かすスキルがかなり大事かな。
0277名無しさん@5周年
2009/01/10(土) 10:24:16恥ずかしいから止めときなw
0278名無しさん@5周年
2009/01/10(土) 12:23:35小売とかなんかな
0281名無しさん@5周年
2009/01/10(土) 14:13:12基本をちょっと勉強したいのだけど、門外漢なので
どのテキストから始めるのがいい感じか判断出来ません。
関係書とかネットを見た感じでは、プログラミングと数学的にはついていけます。
適当にAmazonとかネットで評判が良さそうなテキストのリストを作って見ました。
Wittenのテキストの第一版だけは図書館にあったので、読んでますが、もう少し
レベルが高くてもいいかなという感じです。
このリストの中か他で、お薦めのテキストあったら教えてくれると嬉しいです。
Principles of Data Mining (Adaptive Computation and Machine Learning)
by David J. Hand (Author), et al.
Introduction to Data Mining
by Pang-Ning Tan (Author), et al.
Data Mining: Practical Machine Learning Tools and Techniques, Second Edition
by Ian H. Witten (Author), Eibe Frank (Author)
Data Mining: Concepts and Techniques
by Jiawei Han (Author), Micheline Kamber (Author)
Pattern Recognition and Machine Learning (Information Science and Statistics)
by Christopher M. Bishop (Author)
0282名無しさん@5周年
2009/01/10(土) 16:24:240283名無しさん@5周年
2009/01/10(土) 19:26:300284名無しさん@5周年
2009/01/10(土) 19:29:450285名無しさん@5周年
2009/01/10(土) 21:00:28こいつ本当に馬鹿だな。
0286名無しさん@5周年
2009/01/11(日) 05:48:330287名無しさん@5周年
2009/01/11(日) 16:11:060288名無しさん@5周年
2009/01/11(日) 16:54:080289名無しさん@5周年
2009/01/11(日) 18:51:58ドイツマルクにきまってんだろ
0290名無しさん@5周年
2009/01/11(日) 19:02:160292名無しさん@5周年
2009/01/11(日) 22:58:110293名無しさん@5周年
2009/01/12(月) 06:48:05作ったもの(あるいは学んだもの)を適用することが目的と
なっちゃて来てるのが問題になってんだ。
流通で効果があったとか・・・元々集計すらできていなかった
世界で何かやれば効果があるのは当たり前。
それが夢と思われただけ。
0294名無しさん@5周年
2009/01/12(月) 15:05:160295名無しさん@5周年
2009/01/12(月) 15:12:320296名無しさん@5周年
2009/01/12(月) 15:25:200298名無しさん@5周年
2009/01/12(月) 16:44:06それが普通だよ。
data mining は趣味でやるもんだって前々から言ってるだろ。
0299Tea and Coffee Time
2009/01/12(月) 18:19:17『データマイニング、マインドコントロールと電波首輪理論の関連性』に関して
は下記参照してください。
http://infowave.at.webry.info/200711/article_1.html
0302名無しさん@5周年
2009/01/16(金) 10:56:58論文でっちあげんだからよ、レス300くらいじゃまだ足りねーんだよ。
0303名無しさん@5周年
2009/01/16(金) 11:57:47郭、閣・・・・まだたんない?
0305Tea and Coffee Time
2009/01/18(日) 11:24:33掲示板における匿名性がどれだけ高いかと、情報漏洩ルートがあるかどうかは重要な視点である
と考えられます。下記参照してください。
http://infowave.at.webry.info/200804/article_1.html
上記に情報漏洩ルートがあるかどうかの確認法の一例を提示しています。確認法
はほかにも考えられると思います。
再度言いますが、2ちゃんねるの存在自体がひとつのデータマイニングではないでしょうか。
『データマイニング、マインドコントロールと電波首輪理論の関連性』に関して
は下記参照してください。
http://infowave.at.webry.info/200711/article_1.html
0306Tea and Coffee Time
2009/01/21(水) 19:19:13しかし、一方では情報保護・セキュリティ強化を推進しながら、一方では
人的情報漏洩ルートを作ろうとする動きが東京・大阪などを中心として
出てくる可能性があります。
『量子暗号化技術の進展と電波首輪理論「共謀罪と傍聴法・個人情報保護
法の無力化」』に関しては下記参照してください。
http://infowave.at.webry.info/200609/article_1.html
0307Tea and Coffee Time
2009/01/21(水) 19:28:33という実験がアメリカのMIT(マサチューセッツ工科大学)で既になされています。
(日本語訳解説については下記参照)。
http://hotwired.goo.ne.jp/news/20050802302.html
http://hotwired.goo.ne.jp/news/technology/story/20050803307.html
日本では個人を常時リニアタイムに監視する行為は法律で禁じられています。
このような行為はU.S.Aでさえ問題になっています。(下記参照)
http://hotwired.goo.ne.jp/news/20051101203.html、
しかし、「リニアタイムに監視」でさえも可能にしそうな動きがあります。
「諜報機関の設置」です。諜報機関の設置によって個人情報保護法が軽視・無視
されるようになると、個人にたいする調査、場合によっては「嫌がらせ」・「ほのめかし」
等が携帯電話の電波首輪機能を使って可能になりそうです。
諜報機関の設置、「電波首輪理論」に関しては下記参照してください。ニュースに
なっている部分もあります。
http://infowave.at.webry.info/
http://ime.nu/infowave.at.webry.info/200609/article_1.html
特定個人・集団に対する監視・嫌がらせ等を含めて、集団思考をマインドコントロールしようとする
行為はすでに始まっている可能性が高いようです。通例、ターゲットと呼ばれる被調査者(被害者)
が気づいたときには「嫌がらせ」・「ほのめかし」・「悪評流し」などを使った特定個人・集団の
周囲のマインドコントロールがなされているという意見もあります。マインドコントロールシステムの一部として
このような「嫌がらせ」・「ほのめかし」・「悪評流し」システムが含まれていることが多いのではないのでしょうか。
また、携帯を使った「リニアタイム監視」ができなくとも、個人の監視・調査は「電波首輪理論」で可能です。
個人情報保護法が無力化している事が大きな原因と考えられます。現段階は電波首輪理論を用いたマインドコントロール
システムを確実に構築するための時期になっています。
0308Tea and Coffee Time
2009/01/21(水) 19:31:34Nシステムが合法と解釈されるならば、携帯電話の位置情報盗聴も「防犯上」
合法と解釈される可能性があります。携帯電話の電波首輪機能が調査に使われるのです。
(下記参照)
http://infowave.at.webry.info/200812/article_1.html
0309名無しさん@5周年
2009/01/22(木) 13:03:53マハラビノス・タグチ・メソッドやタグチ・シュミット法とMLPやガウシアンプロセスなどでは、どのように用途に違いがあるのでしょうか?
すいませんが教えてください。
0310名無しさん@5周年
2009/01/22(木) 17:00:43http://www.orange-mikan.com/index.php?topic=2761.0
0311名無しさん@5周年
2009/01/23(金) 20:14:000312名無しさん@5周年
2009/01/24(土) 00:43:56荻野メソッドだよ
0313名無しさん@5周年
2009/01/26(月) 19:13:510314Tea and Coffee Time
2009/01/31(土) 15:08:32『平成20年中の通信傍受の実施状況等に関する公表』(下記参照)
http://www.moj.go.jp/PRESS/080130-1.html
に詳細が載っています。令状が出て逮捕者がない番号2と番号5の2件は
「無関係盗聴」として今後議論対象になる可能性が高いです。無関係盗聴
は2006年までに86パーセントになっていると指摘されています。
(下記参照しました。)
http://archive.mag2.com/0000207996/20080224221332000.html
今後、さらに問題となる可能性が高いです。
0315名無しさん@5周年
2009/01/31(土) 16:17:59日本は遅れているので、こういったものを使いなさい
http://www.secunet.com/index.php?ln=2
0316名無しさん@5周年
2009/02/15(日) 04:27:480317名無しさん@5周年
2009/02/15(日) 14:30:18http://glossary.cdaj.co.jp/01000050/s01000/000619.html
ガウシアンプロセスとは,パターンマッチングの手法の一つで,
modeFRONTIERに搭載されている応答曲面生成手法の一つです.
ガウス分布を重ね合わせ,サンプリング点をなめらかに通る曲面を生成しますが,
その際,ガウス分布の重ね合わせ係数(これをHyperprameterと呼ぶ)を求める必要があります.
この係数を求める部分にニューラルネットを用いており,
その学習にベイズアプローチを用いてオーバーフィッティングを防止しています.
このガウシアンプロセスは強力な回帰モデルであり,非線形性の強い応答の近似に適しています.
また,作成した応答曲面をプログラムソース(C,Fortran,Java)として外部に出力することができます.
0318名無しさん@5周年
2009/02/16(月) 01:41:13なんだが。
0319名無しさん@5周年
2009/02/17(火) 01:23:19てっきり電話会社のことかと思ったぞ。
0321名無しさん@5周年
2009/02/17(火) 04:23:150322名無しさん@5周年
2009/02/17(火) 04:25:21Discavery => Discovery
0323名無しさん@5周年
2009/02/17(火) 10:11:30Wiley - Making Sense Of Data
Advanced Data Mining Technologies in Bioinformatics
Agent Intelligence through Data Mining
AMACOM Distributed Data Warehousing Using Web Technology
BrainySoftware.Dimensional.Data.Warehousing.with.MySQL.A.Tutorial.Apr.2007
Building.a.Data.Warehouse.With.Examples.in.SQL.Server
Data Mining Opportunities and challenges
Data Mining A Knowledge Discovery Approach
Data Mining In Time-Series Databases - World Scientific Press
Research and trends Data Mining Technologies and applications
Data Mining with Computational Intelligence
Data Mining with Ontologies
Data Mining-A heuristic approach
Data modeling techniques for data mining IBM
Data Modeling
Data Warehouses and OLAP
Data warehousing and data mining for telecommunication
Data Mining with Neural Networks
0324名無しさん@5周年
2009/02/17(火) 10:12:22Evolutionary Computing in Data Mining
Foundations and Advances in Data Mining
Intelligent Data Mining
Data Mining and Knowledge Discovery Technologies
Handbook of Database Security Applications and Trends
High performance Data Mining scaling algorithms applications and systems
IGI Publishing Data Mining Patterns New Methods and Applications
Introduction to Data Mining and its Applications
Kimball & Ross - The Data Warehouse Toolkit 2nd Ed
Knobbe A.J. Multi-Relational Data Mining
LargeScale_Parallel_Data_Mining
Lawrence.Erlbaum.Assoc.The.Handbook.Of.Data.Mining.eBook-LiB
Lecture notes in Data Mining
Lecture Notes In AI - Data Mining Theory, Methodology, Techniques
Mathematical methods for knowledge discovery in data mining
Mit_Press_-_Principles_Of_Data_Mining
Morgan.Kaufmann.Data.Mining.Practical.Machine.Learning.Tools.and.Techniques.Second.Edition
Pattern Recognition Algorithm for Datamining
Privacy Preserving Datamining
Quality measures in Data Mining
S.A.Becker - Effective Databases For Text And Document Management
Sequence Data Mining
Swarm Intelligence in Data Mining
Data.Mining.Using.SAS.Enterprise.Miner
Data Mining Concepts and Techniques 2nd Ed
この中でお奨めなのは、どれ?
0325名無しさん@5周年
2009/02/17(火) 17:45:10だろうな。
学問じゃないから。
0326名無しさん@5周年
2009/02/17(火) 18:15:28Perfumeフォトブック『Perfume Portfolio(パフューム ポートフォリオ)』
ttp://www.amazon.co.jp/Perfume%E3%83%95%E3%82%A9%E3%83%88%E3%83%96%E3%83%83%E3%82%AF%E3%80%8EPerfume-Portfolio-%E3%83%91%E3%83%95%E3%83%A5%E3%83%BC%E3%83%A0-%E3%83%9D%E3%83%BC%E3%83%88%E3%83%95%E3%82%A9%E3%83%AA%E3%82%AA-%E3%80%8F/dp/4847018168
0327名無しさん@5周年
2009/02/18(水) 00:49:370328名無しさん@5周年
2009/02/19(木) 01:16:53文献少ないね。
0329名無しさん@5周年
2009/02/24(火) 17:53:49…でも怪しいのも多いなぁ
日本だと業務としてやってる大きな企業ってないのかね
0330名無しさん@5周年
2009/02/25(水) 02:04:25SPSSと同じでは?
0331名無しさん@5周年
2009/02/25(水) 18:39:330332名無しさん@5周年
2009/02/25(水) 21:14:47ちゃんと解析とかの素養があるんだろうか
0333名無しさん@5周年
2009/02/26(木) 00:40:38道具は立派なもの持ってるところ多いよ。
0334名無しさん@5周年
2009/02/27(金) 06:19:12日本IBM・日立・東芝かな
それぞれ昔からソフト作ってたはず
>「データマイニングの企業です!」
って企業は大体コンサルの道具としてしか使ってないよね
ちゃんと研究開発も手をつけてる企業ならいいけどそんなの全然見かけないし
0335名無しさん@5周年
2009/02/27(金) 19:36:240336名無しさん@5周年
2009/02/27(金) 20:30:10職種に「研究・開発」とあってもやってることは全然別(または予算的な意味で全然研究になってない)
というパターンがあるから気をつけるべきだな
・実際にデータマイニングのソフトウェア作ってて
・そのソフトが一番使える
という基準で企業を選ぶのはどうだろう
少なくともコンサル寄りではなく開発寄りだと思う
0337名無しさん@5周年
2009/02/28(土) 02:32:180338名無しさん@5周年
2009/02/28(土) 04:08:58マーケティングリサーチじゃなくて、そういうマイニングの需要っていうのはないの?
0339名無しさん@5周年
2009/02/28(土) 04:56:19どこですか
0341名無しさん@5周年
2009/02/28(土) 09:53:12文章分類は普通ではないが行われている
結構多くの人が考えつくことなので、一度はトライすることかな
考えることは、すでに結構やってるものだよ
それと、全般的に言って単一手法では限界があるので、
もっと先に行ってる
0342名無しさん@5周年
2009/02/28(土) 10:12:06普通にやってるの主語は何?
研究者? 企業?
質問の意図は、文書分類などのマイニングを開発依頼する企業はあるの?ということだった。
「需要」があるか?と聞いているわけで。
0343名無しさん@5周年
2009/02/28(土) 12:51:480344名無しさん@5周年
2009/02/28(土) 17:06:520345名無しさん@5周年
2009/02/28(土) 18:17:53ツールをまともに使いこなしてるって聞いたことないよ。
科学的にやっても結局文系の横槍で塵芥戦術取るだろ。
0346名無しさん@5周年
2009/03/01(日) 02:38:03企業の宣伝文句にしか役に立ってないね。誇大広告。
0348名無しさん@5周年
2009/03/01(日) 10:14:01普通に企業か大学かと言えばよかろうに。
荒らしたいなら話は別だが。
議論するなら、
大学は企業を馬鹿にせず、
企業は大学を馬鹿にせずやってくださいな。
0349名無しさん@5周年
2009/03/01(日) 12:37:20長い目で見てくださいって
言えないよな
暇つぶしてるように
見られがちだ
0350名無しさん@5周年
2009/03/01(日) 12:41:27それはきつい。
そんな会社やめちまえw
0352名無しさん@5周年
2009/03/01(日) 15:31:08どういう職種になるのか?
SE?プログラマ?アナリスト?
0353名無しさん@5周年
2009/03/01(日) 15:35:540354名無しさん@5周年
2009/03/01(日) 16:06:210355名無しさん@5周年
2009/03/01(日) 16:15:03今は管理職だが、大抵はDMは一般職担当だよ。
みんなやめるがな。実際の企業データを触れるのはよいがな。
0356名無しさん@5周年
2009/03/01(日) 17:42:300357名無しさん@5周年
2009/03/01(日) 21:52:490358名無しさん@5周年
2009/03/01(日) 22:15:15馬鹿だね。
0359名無しさん@5周年
2009/03/01(日) 22:18:400360名無しさん@5周年
2009/03/02(月) 00:51:30ならないわけよ。仮説はあらじめ決まってる。マイニングでは
ないな。役職ごとに言うこと違うし。日本では無理。めちゃくちゃさ。
0361名無しさん@5周年
2009/03/02(月) 01:01:58けっこうそうでもないところ多いよ。
でも、それはそれで、あなたの為だから。ためだから。
西山茉希みたいなもんかな。
0362名無しさん@5周年
2009/03/02(月) 01:57:31ちゃんと使ってる業界ってどこ?
戦略的な部署が研究開発系の部署に作らせて、
運用は情報システム部署がやるとかだと正しそうだが、
一般職だとExcelでグラフ作るのと同じレベルになるw
終ってるぞ
0363名無しさん@5周年
2009/03/02(月) 08:30:56ここに載ってるようなところでも
コンサルの基礎知識 from 2chコンサルスレ
http://www34.atwiki.jp/consulting/
0364名無しさん@5周年
2009/03/02(月) 10:45:55でたらめにやってるよ。会社名晒したいね。
0365名無しさん@5周年
2009/03/02(月) 15:20:070366名無しさん@5周年
2009/03/02(月) 15:45:250367名無しさん@5周年
2009/03/02(月) 19:47:10是非晒してほしいなあ
大きい所も小さい所も
0368名無しさん@5周年
2009/03/02(月) 20:21:37「エイや!」でやっちまうから。ステップワイズを動かして
適当にOLSをやるのさ。変数が数百ぐらいあるOLS(爆)
総研も総研で理系はマーケやCRMを嫌ってるというか肌が合わないから。
まあ、入社して経験してみ。
>>367
俺のいる会社だ(自爆)ふつーに宣伝してるよ。恥ずかしいくらい。
0369名無しさん@5周年
2009/03/02(月) 22:11:330370名無しさん@5周年
2009/03/03(火) 00:42:18明るい話題ないの?
0371名無しさん@5周年
2009/03/04(水) 00:27:36聞きにくいこと聞くけど、
「エイや!」でやるのと数学的に精緻にやるので精度に差が出る?
あと変数が数百ぐらいあるOLSやって何が問題なの?
さあ、答えられるかな?
0372名無しさん@5周年
2009/03/04(水) 01:04:32無駄打ちアプローチが増えるんでは?利益を考えればだ。
0373名無しさん@5周年
2009/03/04(水) 22:49:160374名無しさん@5周年
2009/03/04(水) 23:54:36(爆)だってさ
0375名無しさん@5周年
2009/03/05(木) 02:18:040376名無しさん@5周年
2009/03/05(木) 21:57:130377名無しさん@5周年
2009/03/06(金) 00:59:44本当にDMがわかってる?
それよりなにより、本当に仕事就いてんの?
0378名無しさん@5周年
2009/03/08(日) 19:33:21ただのニートが入ったこともないのに総研について騙ってるのかも知れないぞ?
まあそうすると俺のレスも信用できるものじゃないけどな
0379名無しさん@5周年
2009/03/09(月) 17:03:59Data Mining Report
http://www.dni.gov/electronic_reading_room/ODNI_Data_Mining_Report_09.pdf
(8pp, 518KB)[Released 6 March 2009]UNCLASSIFIED
0380名無しさん@5周年
2009/03/09(月) 19:43:420381名無しさん@5周年
2009/03/21(土) 17:13:36論文作れるソフト教えてください。できれば論文も自動で書いてくれるのがいいです。
0382名無しさん@5周年
2009/03/22(日) 07:31:49ゝ∨ノ >>381がクソ投稿 ,,,ィf...,,,__
)~~( 出している間に _,,.∠/゙`'''t-nヾ ̄"'''=ー-.....,,,
,i i, ,z'"  ̄ ̄ /n゙゙''''ー--...
,i> <i 文明はどんどん発達し r"^ヽ く:::::|::|:::〔〕〔〕
i> <i. ていく・・・・・・。 入_,..ノ ℃  ̄U ̄_二ニ=
`=.,,ー- ...,,,__ |,r'''"7ヽ、| __,,,... -ー,,.=' >ーz-,,,...--,‐,‐;;:'''""~
~''':x.,, ~"|{ G ゝG }|"~ ,,z:''" ___
~"'=| ゝ、.3 _ノ |=''"~ <ー<> / l ̄ ̄\
.|)) ((| / ̄ ゙̄i;:、 「 ̄ ̄ ̄ ̄| ̄| ̄ ̄ ̄\
))| r'´ ̄「中] ̄`ヾv、 `-◎──────◎一'
├―┤=├―┤ |li:,
|「 ̄ |i ̄i|「.//||「ln|:;
||//__|L_」||__.||l」u|:;
|ニ⊃| |⊂ニ| || ,|/
|_. └ー┘ ._| ||/
ヘ 「 ̄ ̄ ̄| /
つ SCIgen - An Automatic CS Paper Generator
- http://pdos.csail.mit.edu/scigen/
0383名無しさん@5周年
2009/03/28(土) 18:24:15SimpleWord V1.63は簡易テキストマイニングツール
http://www.i-juse.co.jp/cgi-bin/suuri/amc2.pl?MNO=140&CNO=458&DBID=PU&UID=PU-16852&URLID=293
0384名無しさん@5周年
2009/03/28(土) 19:02:30統計スレッドで聞いたらどうだろう
「マイニング」がついてるからきちゃったかな?
0385名無しさん@5周年
2009/03/28(土) 22:52:22シミュレートと直接関係ないじゃん
数学板いくべきじゃね?
0386名無しさん@5周年
2009/03/28(土) 22:56:42それは的はずれ
シミュレーションとは(ものにより)関連性がある
0387名無しさん@5周年
2009/03/28(土) 23:07:20よく嫁
直接関係ないだろ
実際俺はデータマイニングした結果をベースに
シミュレーションを行ってモデルのパラメータ制御をおこなってる
でもデータマイニングはシミュレーションではないぉ
0388名無しさん@5周年
2009/03/28(土) 23:17:02しかたないんじゃない。
0389名無しさん@5周年
2009/03/29(日) 03:01:45広義なら信長の野望とかもシミュレートだろう?
0390名無しさん@5周年
2009/03/29(日) 12:32:490391名無しさん@5周年
2009/03/29(日) 14:01:50スレなんだぜ。
まあ難しく考えるなってゆうこっちゃ
0393Tea and Coffee Time
2009/04/05(日) 08:25:36に関連してです。
『<連載>求人票に見る警視庁天下りの実態(11回)「通信・IT」』
http://news.livedoor.com/article/detail/3695494/
(以下引用)
NTT各社。NTTと警察といえば、癒着すれば難なく可能なのが盗聴や
通話記録の入手。最近の誘拐事件などでは、携帯電話の発する電波から被
害者や犯人の居場所特定がよく報道されますね。
「東日本電信電話(NTT東日本)は取材拒否でした。ですが、ご指摘の
通り、同社で警察OBが何をしているのかは非常に重大な問題です。過去、
私が取材した事件でも、NTTの警察OBが関与し、違法な盗聴が行われて
いました。』(以上引用)
個人情報保護法を無力化する人的情報漏えいルートがあるかどうかは今後
問題になりそうです。
0394Tea and Coffee Time
2009/04/05(日) 08:31:28に関連してです。
『キーマン・大賀の背後に警察OBズラリ (ゲンダイネット)』
http://news.www.infoseek.co.jp/society/story/16gendainet02040188/
(以下引用)
『「個人情報を警察から入手していた大手消費者金融が、『情報は警察だけ
でなく、日本シークレット・サービスからも得ていた』と認めたのです。
個人情報が民間企業に筒抜け、という大変な問題です。』
(以上引用)
人的情報漏洩ルートがあるようですと、個人情報保護法も無力化し、
電波首輪理論が成立します。電波首輪理論に関しては下記参照してください。
特に固定位置情報の漏えいがされているかどうかはになります。
http://infowave.at.webry.info/200609/article_1.html
http://infowave.at.webry.info/200507/article_1.html
あからさまに個人情報保護法無視をしている可能性も高いですね。
間接的な情報漏洩の可能性に関しては下記参照してください。
http://infowave.at.webry.info/200711/article_1.html
0395Tea and Coffee Time
2009/04/05(日) 08:34:49に関連してです。(>>393 >>395に関して)
極端な意見になるかもしれませんが、個人情報保護法を制定したのは
「個人情報を守っているふり」をする、あるいは「権力者が都合の良い
時に個人情報をまもるため」であると考えられないでしょうか。
一方では「個人情報保護法」をつくっておき、一方では「人的情報漏洩ルート」
をつくっているのはなぜでしょうか。興味深いことに、この法律とは別の(集団の)
人を通じた情報伝達ルートを一種の「世間」であると主張をする人がいいます。
つまり、情報は(間接的に)漏洩されて伝わるのが当然であり、個人情報が保護
されていると考えている人が「世間知らず」であると主張するわけです。
ただし、「個人情報保護法」をつくったのも、実はある意味の世間を使って
「人的情報漏洩」を促しているのも同じ政党であるという実態調査結果がでない
という保証がないのが怖いところです。
どうなのでしょうか。
0396Tea and Coffee Time
2009/04/05(日) 08:42:46データマイニングを通じて、プライバシーや個人情報保護法を尊重して
調査をする場合よりも、間接的情報漏洩を通じて個人を特定し、あとから、
データマイニングを含む後付け調査(調査したふり)をして調査費用(予算)
にするという手法がとられていないかは重要な観点になります。
あからさまに個人情報保護法無視をしている可能性も高いですね。
間接的な情報漏洩の可能性に関しては下記参照してください。
http://infowave.at.webry.info/200711/article_1.html
0397名無しさん@5周年
2009/04/15(水) 21:28:17しかし、右側を通行する自転車の何と多いことか(無論、違法行為である)。
時には法律を守るべき警察官までもが、制服で警察の自転車で右側を通行している。
これは何故か?
実はこれには陰謀が関係している。
自転車で右側通行をしている連中は、他国の工作員なのである。
その証拠は、米中韓の3国が右側通行であることだ。
もともと、日本は長らく米の占領下にあり、現在でも属国の風合いが強い。
近年においても、米は属国化を推進するため、工作員を送り込んでいる。
中は、竹島を始め、本土までも自国の領土にしようと目論んでいる。
また、韓もドラマなどを送り込むことに飽きたらず、工作員を派遣し、
日本に右側通行を根付かせようと躍起だ。
やがて、右側通行が既成事実化し、日本の道路交通法が改正されるのも、そう遠いことでは無かろう。
そのときこそ、奴らの思うつぼである。
つまり、自転車で右側通行している連中は、工作員、非国民、売国奴なのである。
忠実なる日本の国民は、奴ら国賊の陰謀には手を貸さず、阻止することに全力で協力して貰いたい。
0398名無しさん@5周年
2009/04/15(水) 23:58:230399名無しさん@5周年
2009/04/16(木) 00:12:10そしておまえの母さんもきっと偽物だぜ
0403名無しさん@5周年
2009/05/04(月) 15:52:270404名無しさん@5周年
2009/05/14(木) 16:42:280405名無しさん@5周年
2009/05/16(土) 02:01:170406名無しさん@5周年
2009/05/17(日) 02:09:090407名無しさん@5周年
2009/05/19(火) 00:10:470408名無しさん@5周年
2009/05/19(火) 02:50:270409名無しさん@5周年
2009/05/20(水) 18:04:25結婚予定の予定は全て潰す。
0410名無しさん@5周年
2009/05/22(金) 10:13:460411名無しさん@5周年
2009/06/07(日) 17:11:410412名無しさん@5周年
2009/06/07(日) 17:24:090414名無しさん@5周年
2009/06/08(月) 10:37:370415名無しさん@5周年
2009/07/12(日) 21:36:17最近のコンピュータ将棋には最適制御理論が組み込まれています。
そのことを是非知ってもらいたくて書き込みしました。
それの情報の書かれているドキュメント
http://www.geocities.jp/bonanza_shogi/gpw2006.pdf
それの話題が書かれているスレ
ボナ4のソースを読んで書き込むスレ
http://anchorage.2ch.net/test/read.cgi/bgame/1233229938/
0417名無しさん@5周年
2009/08/04(火) 21:55:02SPSSを、IBMが買収したようですね。
”米IBMは7月28日(現地時間)、統計解析とデータマイニング向けソフトウェアを開発する米SPSSの
買収で合意したと発表・・・SPSSは統計解析ソフトウェアでは非常に長い歴史を持っており、研究
者や学術研究の分野では広く利用されている。近年ではその技術を利用して膨大なデータ分析と
企業のビジネス改善を行うデータマイニングの分野に進出しており、高い評価を得ている・・・”
米IBM、データマイニングの米SPSSを12億ドルで買収 2009/07/28
http://journal.mycom.co.jp/news/2009/07/28/063/
0418名無しさん@5周年
2009/08/08(土) 16:20:15”いくつかの変数に基づいて別の変数の実数値を予測する手法である回帰分析は,大
量のデータから有用な情報を取り出すデータマイニング技術の一つとして,様々な分野
で実用化されている.回帰分析においては,可読性と汎化性が非常に重要である.可読
性とは,得られた回帰式をどのように解釈可能かどうかを,汎化性とは,未知のデータ
に対していかに精度良い予測値を推定するかを意味する.重回帰や数量化理論一類など
による線形回帰モデルでは,回帰式が線形となるため,可読性は非常に良い.しかしな
がら,線形であるために,非線形の関係を持つデータに対して高い汎化性能を期待する
ことはできない・・・・”
多層パーセプトロンによる可読性と汎化性に優れた回帰分析に関する研究 名工大 棚橋裕輔
http://repo.lib.nitech.ac.jp/bitstream/123456789/460/1/ko2009tanahashi.pdf
0419Tea and Coffee Time
2009/08/09(日) 00:11:16と考えられます。下記参照してください。
http://infowave.at.webry.info/200804/article_1.html
上記に情報漏洩ルートがあるかどうかの確認法の一例を提示しています。確認法
はほかにも考えられると思います。
再度言いますが、2ちゃんねるの存在自体がひとつのデータマイニングではないでしょうか。
『データマイニング、マインドコントロールと電波首輪理論の関連性』に関して
は下記参照してください。
http://infowave.at.webry.info/200711/article_1.html
0423名無しさん@5周年
2009/08/26(水) 16:58:350424名無しさん@5周年
2009/11/29(日) 10:41:440425ライフログというプライバシーと思考盗聴の関連性
2010/01/30(土) 17:20:09皆さんの個人情報やプライバシー情報の漏洩・流出と『思考盗聴』とよばれる
現象には関連性があるのではないでしょうか。
『ライフログ集合体と個人情報・プライバシー問題(『思考盗聴』とよばれる現象の一種について)』
http://infowave.at.webry.info/201001/article_2.html
「思考盗聴装置」という機器があるわけではないと思うのですかどうでしょうか。
もしもあるとしたら、 通信伝達の媒体は何でしょうか。電磁波でしょうか。少なくとも
ずっと電磁波を頭に浴びせられていたら、脳に障害を起こしますよ。携帯電話の電磁波
でさえも長時間浴び続けると 脳に悪影響がでるといわれています。
0426名無しさん@5周年
2010/04/07(水) 23:10:100427名無しさん@5周年
2010/04/10(土) 11:33:390428名無しさん@5周年
2010/04/10(土) 19:03:430429名無しさん@5周年
2010/04/16(金) 22:45:51???
0430名無しさん@5周年
2010/04/21(水) 21:42:34あまりチームとして体制も整って無いし、スマートなやり方より結局は人海戦術の方が効率良いんだよねぇ。
こっちの業界だと某S社は成果残してるみたいだけどね…
0431名無しさん@5周年
2010/04/22(木) 01:46:28S社。それは数理システム。
0432名無しさん@5周年
2010/04/28(水) 12:05:440433名無しさん@5周年
2010/05/21(金) 06:31:28来週、関西学研都市のNTT基礎研で一般公開があるようですね。
「NTT コミュニケーション科学基礎研究所オープンハウス2010」
【日程】 2010 年 5 月 27日 (木) 12:00-17:30 5 月 28日 (金) 9:30-16:00
【会場】 NTT 京阪奈ビル (京都府相楽郡精華町光台2-4「けいはんな学研都市」)
入場無料・事前登録不要
http://www.kecl.ntt.co.jp/openhouse/2010/
0434名無しさん@そうだ選挙に行こう
2010/07/10(土) 23:07:49年に一度、ウェブサイトの文書を集めたCD-ROMが学術目的で販売されている。
その文章から社会現象とホームページに出てくる単語の頻度の傾向が
変わる。その統計を取る論文があったなあ、、、。かなり昔だけれど。
けれどもこのCD-ROMを買うのが一番データマイニングをするのに
手っ取り早いと思うがなあ、、、。
0435名無しさん@5周年
2010/07/26(月) 19:39:140436名無しさん@5周年
2010/07/29(木) 05:33:37Yes
■ このスレッドは過去ログ倉庫に格納されています