自然言語処理スレッド その2at TECH
自然言語処理スレッド その2 - 暇つぶし2ch104:デフォルトの名無しさん
07/05/03 07:23:18
>>95
あーそれ読んだことある!
確かに「LISPを」勉強するときはそのシリーズいいね。

105:デフォルトの名無しさん
07/05/06 23:07:13
自然言語処理のしの字も知らない俺にオススメな本はありますか

106:デフォルトの名無しさん
07/05/06 23:10:05
「テキストマイニングを使う技術/作る技術」が読みやすくていいよ

107:デフォルトの名無しさん
07/05/06 23:27:08
>>105
田中穂積著 自然言語処理―基礎と応用

108:デフォルトの名無しさん
07/05/06 23:44:31
URLリンク(www.amazon.co.jp)

最近新しい教科書出ないよな


109:デフォルトの名無しさん
07/05/07 07:41:55
>>108
FSNLPってよく推薦されてるけど、そんなにいいか?
あんまり好きじゃないんだけど。

110:デフォルトの名無しさん
07/05/07 09:06:41
すごく偏りがあるのは認める

111:デフォルトの名無しさん
07/05/07 11:31:02
>>108
どっかの研究室で訳してくれないかな

奈良先あたりでさー

112:デフォルトの名無しさん
07/05/07 20:04:41
>>111
URLリンク(www.amazon.co.jp)
ちょっと薄いけどこれじゃだめか?

113:デフォルトの名無しさん
07/05/08 00:06:01
やっぱあれだな。
一口に自然言語処理と言っても形態素解析や係り受け解析のような基礎技術から
テキストマイニングとかのアプリケーションまで幅が広すぎる。
おまけに今は機械学習の各手法を知らないと論文も読めないし、なかなか大変。

研究するって訳じゃなければそんな真剣に考えなくてもいいか。結局何が目的にかによるな。

しかし、新しめトピックもカバーしたライトで実用寄りの入門書は存在しないというのが実情では
ないだろうか。


114:デフォルトの名無しさん
07/05/08 06:32:02
>>113
新しくてライトで実用的って無理じゃね?
「SVMという魔法のツールがあります」から始めるのか?

115:デフォルトの名無しさん
07/05/09 07:50:37
SVMってちゃんと理解しようと思うと
甘利タンの情報幾何学まで引っ張り出さないとダメ

116:デフォルトの名無しさん
07/05/09 09:02:27
文系出身の俺には無理

117:デフォルトの名無しさん
07/05/10 00:08:06
文系ならなおさら言語構造に詳しいだろw

118:デフォルトの名無しさん
07/05/10 05:15:00
116はSVMのことでしょ。

119:デフォルトの名無しさん
07/05/10 07:50:33
自然言語処理をやっている研究室って
画像処理をやっている研究室より数が少ないよね?

120:デフォルトの名無しさん
07/05/10 07:53:46
MSが日本語のNLP研究やり始めたからな…
日本オワタ

121:デフォルトの名無しさん
07/05/10 08:36:52
>>120
終わんねーだろ・・・
常識的に考えて・・・

122:デフォルトの名無しさん
07/05/10 10:55:18
画像処理のほうが

123:デフォルトの名無しさん
07/05/10 11:49:07
世界共通言語

124:デフォルトの名無しさん
07/05/10 12:53:44
英語のこと?

125:デフォルトの名無しさん
07/05/10 15:38:07
エスペラント語に決まってんでしょ

126:デフォルトの名無しさん
07/05/10 19:45:55
何それ?

127:デフォルトの名無しさん
07/05/10 19:55:06
自然言語処理の<教科書>に登場する
(文科系?)言語学者はチョムスキー
の他は誰?

128:デフォルトの名無しさん
07/05/10 20:02:36
チョムスキーが文科系って・・・

129:デフォルトの名無しさん
07/05/10 21:56:22
スタンフォード大HPSGのSag?

130:デフォルトの名無しさん
07/05/12 07:12:08
ロシア人?

131:デフォルトの名無しさん
07/05/12 08:15:59
LFGのBresnan

132:デフォルトの名無しさん
07/05/19 13:34:51
自然言語処理やったらメーカーに入れるの?

133:デフォルトの名無しさん
07/05/19 14:09:12
メーカーなんて自社製品売ってなんぼだから。自然言語処理とか関係ない。

134:デフォルトの名無しさん
07/05/19 14:16:41
修士卒で自然言語処理関係の仕事をやってる人なんていないよ、と教授に言われました。。。

135:デフォルトの名無しさん
07/05/19 14:38:26
うちは歓迎する

136:デフォルトの名無しさん
07/05/19 15:59:57
むしろ、自然言語処理で学部卒とかどうしようもないっしょ
そんな短時間で何が習得できるってんだ。

137:デフォルトの名無しさん
07/05/19 16:03:14
>>135
どこ?
うちの院(マスター)は過去五年間の就職実績で関連した企業なんて、
ヤフー、ジャストシステムくらいだよ

138:デフォルトの名無しさん
07/05/19 16:04:18
NTTデータとか

139:デフォルトの名無しさん
07/05/19 16:20:43
NTTデータ、Google、MSR、Yahoo
この辺は、院卒前提でしょ。


140:デフォルトの名無しさん
07/05/19 16:26:41
自然言語をまじで処理する仕事したけりゃ、
院卒前提だろうな

141:デフォルトの名無しさん
07/05/19 17:20:44
データって関連してるの?
ただのSIかと思ってた

142:デフォルトの名無しさん
07/05/19 19:39:06
うちのとこ(メーカー)は音声・言語のUI開発してるんだけど、
音声や自然言語をやってた学生には来てほしいよ
でも、いっつも、ぜんぜん違うことやってた学生ばっか来るんだよね


143:デフォルトの名無しさん
07/05/19 19:42:31
カーナビとか?

144:デフォルトの名無しさん
07/05/19 19:53:39
>>142
いい勘してる

145:デフォルトの名無しさん
07/05/19 21:46:58
パイオニア?松下?

146:デフォルトの名無しさん
07/05/19 22:33:49
Microsoft Research行きたいよー

147:デフォルトの名無しさん
07/05/19 23:13:38
自然言語処理の研修室かPLDの研究室か迷ってるんだよなぁ
まぁ行くのは来年度の事だけど

148:デフォルトの名無しさん
07/05/19 23:14:50
自然言語は止めといた方が良いよ

149:デフォルトの名無しさん
07/05/20 19:55:01
n-gramモデルを調べようと思ったのですが、何かわかりやすい解説がされてる資料はありませんでしょうか?
完全に知識0からなので、これらがどう有用なのか、とか、どういう研究に使われてるかなどもわかれば嬉しいのですが・・・。



150:デフォルトの名無しさん
07/05/20 21:04:21
ググレカス (AAry

151:デフォルトの名無しさん
07/05/20 22:30:37
自然言語処理研究者の馴れ合いキモス

関西、特に奈良、京都ばっかじゃん

152:デフォルトの名無しさん
07/05/20 22:32:59
>>151
研究室 特定すなww

153:デフォルトの名無しさん
07/05/20 23:59:36
奈良線と京大の馴れ合いですか?

154:デフォルトの名無しさん
07/05/21 00:46:39
NTT

155:デフォルトの名無しさん
07/05/21 01:06:30
>>151
そういうあんたも業界人?

156:デフォルトの名無しさん
07/05/21 01:40:25
名大

157:デフォルトの名無しさん
07/05/21 01:51:54
京大と奈良先端の人多杉ww
関西人ばかりだということが丸わかりのスレだなwww

>>149
簡単な知識だからgoogle先生で十分
厳密さを求めるなら元論文で

158:デフォルトの名無しさん
07/05/21 02:06:43
なんで関西人は自然言語処理好きなの?

159:デフォルトの名無しさん
07/05/21 02:44:33
一昔前、まったく自然言語処理が注目されてなかった時に
予算がなかなか下りなかったって歴史的時代背景じゃね?

で、たまたま、やってた数少ないところが、京大だったって話かと。
奈良先端だって、比較的若い大学院大学っしょ

160:デフォルトの名無しさん
07/05/21 06:46:27
鳥取大学(´・ω・`)ショボーン

161:デフォルトの名無しさん
07/05/21 23:55:49
東工大は最近どうなん?

162:デフォルトの名無しさん
07/05/22 00:06:11
なぜ東大がでない?

163:デフォルトの名無しさん
07/05/22 00:25:17
鳥取は、京大に居たやつが始めたんだっけな。
関東勢はどうも弱いよな。

164:デフォルトの名無しさん
07/05/22 00:46:25
JAIST

165:デフォルトの名無しさん
07/05/22 11:09:55
徒弟制度じゃないけど、
元をたどればN尾先生の弟子だったり孫弟子だっり。

166:デフォルトの名無しさん
07/05/22 11:28:03
ながおタンね

167:デフォルトの名無しさん
07/05/22 12:36:19
ながおタンハァハァ

168:デフォルトの名無しさん
07/05/22 17:54:15
自動翻訳機が発明されないことを祈るスレ
スレリンク(english板)l50

向こう100年はできないと思ってるらしいぞ

169:デフォルトの名無しさん
07/05/22 18:10:22
機械翻訳の技術が向上していけば
より上質な翻訳が出来る翻訳家以外あぼーんだな

170:デフォルトの名無しさん
07/05/22 20:05:45
でも、所詮今の機械翻訳って、大企業が金に物を言わせて巨大な辞書を作ってお茶を濁してる感じでしょ。
もう破綻した手法だが、だからと言って別の手段だと誤訳率が上がるんだよなぁ。

171:デフォルトの名無しさん
07/05/22 20:13:40
100億文くらい例文集めても駄目か?

172:デフォルトの名無しさん
07/05/22 20:58:17
英語はほとんどが比喩表現だから辞書いくら作っても無駄w

173:デフォルトの名無しさん
07/05/22 21:12:39
翻訳機械が完成されるのと、脳に意味を直に送信できるようになるのではどちらが先ですか。

174:デフォルトの名無しさん
07/05/22 21:21:32
>>172
>英語はほとんどが比喩表現
そこで、G. Lakoffが登場し、UC Berkeleyの自然言語
処理グループとの共同研究で巨額なNSF資金を獲得する。

175:デフォルトの名無しさん
07/05/22 21:23:32
ぬおお!足りぬ・・・・足りぬぞ・・・!コーパスがッ!

176:デフォルトの名無しさん
07/05/22 22:02:03
まぁ、機械翻訳なんてのは大企業に任せときなさいって
どうあがいても学術機関では敵わない。
小さなコーパスで何か画期的な事が出来るようなモデルを考えるとかじゃない限りな。



177:デフォルトの名無しさん
07/05/23 06:11:12
ATRも大企業になるのか?

178:デフォルトの名無しさん
07/05/23 22:16:50
国からの補助金は削減された?

179:デフォルトの名無しさん
07/05/23 22:18:14
優しくてかわいい彼女が欲しい脳
頭がよければモアベター

180:デフォルトの名無しさん
07/05/23 22:19:28
大規模な誤爆をしました

181:デフォルトの名無しさん
07/05/25 17:00:46
>>1-178を機械翻訳した結果が>>179だぞ。

日本の自動翻訳もここまできた!

182:デフォルトの名無しさん
07/05/25 20:50:27
Google翻訳よりExcite翻訳、Excite翻訳よりYahoo翻訳の方がいいな

183:デフォルトの名無しさん
07/05/25 21:04:15
>>182
>Yahoo翻訳の方がいいな
私もそう感じます。理由をご存知の方はいらっしゃいますか?

184:デフォルトの名無しさん
07/05/25 21:21:07
それは、そう思った理由が、そもまま理由じゃないか?

185:デフォルトの名無しさん
07/05/25 21:28:27
URLリンク(www.google.com)
googleのこの辺を読んでみると、
googleはパラレルコーパスで統計的に処理してるっぽい

日:おはようございます.
英:Good morning.
独:Guten tag.

みたいに各言語の対訳を大量に作ってるのかいな?

186:デフォルトの名無しさん
07/05/26 02:27:55
>>183
Yahooはなぁ、"ぬるぽ"を翻訳したら「ガッ」になった事があって嗤ったっけ


187:デフォルトの名無しさん
07/05/26 11:15:35
私もそう感じます。理由をご存知の方はいらっしゃいますか?

google翻訳
→I so feel. As for the person who knows the reason it is and others the [tsu] plain gauze is? 

yahoo翻訳
→I feel so it, too. Does a person knowing a reason come?

googleはしっかりしろ
検索ボットやgmailやgoogle docでテキストを只で手に入れてんだからさー



188:デフォルトの名無しさん
07/05/26 15:34:45
50歩100歩のような。。。

I think so too, Does anyone know the reason?
とか、もっと自然に訳してくれるソフトはないの?
Webの無料翻訳じゃなくて、富士通のAtlasとかでも全然だめなのかな。

189:デフォルトの名無しさん
07/05/26 17:04:07
【福島】男性教諭、同級生を冷やかしていた生徒を注意し頭を叩く→保護者に謝罪
スレリンク(newsplus板:1番)
スレリンク(newsplus板:2番) ←

【愛知・発砲立てこもり】解決まで約29時間…「いつまで作戦考えていたのか」「仲間を長時間放置したことは許せない」 県警内からも批判の声
スレリンク(newsplus板:1番)
スレリンク(newsplus板:3番) ←


その他大量多数。
語句の並び替えて文意をめちゃくちゃにするだけで、

  つ ま ら な い し 、う ざ い か ら や め ろ よ 

形態素解析覚えたての馬鹿のしわざだろう?
馬鹿ほど使って見せたがるからな。

あと君、著作権法第20条同一性保持権違反だから。

著作権法
(同一性保持権)
第20条 
著作者は、その著作物及びその題号の同一性を保持する権利を有し、
その意に反してこれらの変更、切除その他の改変を受けないものとする。


190:デフォルトの名無しさん
07/05/26 17:15:39
>>187
テキストがあったって意味が分からないと知識にはならんがな。

191:デフォルトの名無しさん
07/05/26 18:10:38
excite翻訳のbizlingoはatlasがベースだろ?

192:デフォルトの名無しさん
07/05/26 20:50:41
オープンソースの英日機械翻訳のプロジェクトはまだないのかな。
結局、機械翻訳っつーのはコーパスをガシガシ整備しさえすりゃいいんでしょ?
ほら、同音多義語なんかは今風にタグでジャンル別に分類すればいいわけだし。
なんかそんな難しい分野じゃない気がしてきた

193:デフォルトの名無しさん
07/05/26 20:55:06
( ^ω^)タダでコーパス書いてくれる人が居ればね

194:デフォルトの名無しさん
07/05/26 21:06:38
オープンソース厨は(゚⊿゚)イラネ

195:気まぐれアナスイ
07/05/26 21:11:04
上手く理解すれば出来ると思いますが?

196:デフォルトの名無しさん
07/05/26 21:55:55
ソースを部品と見抜けない人には(オープンソースを使うのは)難しい

オープンソース思想家は去れ。
オープンソース厨と罵倒するのは簡単だ。

197:デフォルトの名無しさん
07/05/26 23:33:48
日本語WordNetの構築は、なぜ行われないの
でしょうか? EDR関係者が邪魔をしているの
でしょうか?

198:デフォルトの名無しさん
07/05/27 01:20:56
関西の連中が牛耳ってるからだろ?
自分とこの研究室で研究させて論文生産して
院生をATRとかNICTあたりに突っ込んで
また自分とこの研究室と一緒に研究させて論文生産して

199:デフォルトの名無しさん
07/05/27 20:00:16
図星かよwww

200:デフォルトの名無しさん
07/05/27 20:02:51
>>198が見えない

201:デフォルトの名無しさん
07/05/27 20:05:16
内輪過ぎて大半の人がついてきてないんじゃね?w

このスレは、NISTと京大と鳥取と、ATR、NICTの提供でお送りしました。


ここム板だから、あんまり内輪すぎる話をするのもどうかと

202:デフォルトの名無しさん
07/05/27 20:39:59
まったくの専門外の分野から自然言語処理をやるマもいないだろ?


203:デフォルトの名無しさん
07/05/27 20:44:01
いくらでもいるだろ

204:デフォルトの名無しさん
07/05/27 21:07:14
JAISTのこともときどき思い出してやってください

205:デフォルトの名無しさん
07/05/27 22:57:59
[JN]AIST

206:デフォルトの名無しさん
07/05/28 02:18:19
JAISTとか、能無しが行くところだろ。
名前が似てるだけでNAISTの姉妹っぽい扱いされてるのが気に入らん。全然格が違うのに。
まるで電気通信大学と、大阪電気通信大学みたいだ。


207:デフォルトの名無しさん
07/05/28 02:22:56
いやいや、いくらなんでもこのスレは内輪すぎるだろ・・・w
既に部外者が入り込める雰囲気じゃねぇwww
いくら業界狭しといえど、ちょっと狭すぎないか

という俺は、ここに名前すら挙がってない大学の自然言語処理の研究室の人間だけどな・・・orz

>>206
大学院大学に入学資格に関して格差なんてあんの?
学部と違って、大学院に関しては好きな所に入れるイメージあるんだけど。
担当教官とさえ話が合えば・・・

208:デフォルトの名無しさん
07/05/28 02:55:35
まさにセクトの内ゲバだなww

209:デフォルトの名無しさん
07/05/28 03:45:04
>>206
どっちも同じだろw
誰でも入れる院に変なプライド持つなよ

210:デフォルトの名無しさん
07/05/28 10:34:54
何か関西に恨みでもあるのかよ。

211:デフォルトの名無しさん
07/05/28 20:32:28
一応はっとくね

【言語】国立国語研究所、1,000万語分の日本語コーパスを試験公開
スレリンク(newsplus板)

212:デフォルトの名無しさん
07/05/30 00:42:54
200文字程度のデータを読み込んで、
その文書が英日独仏西伊のどの言語
かを判断するツール/モジュール/
ライブラリを探しています。できれば
perlで使えるものが良いですが、何か
ございますか?

213:デフォルトの名無しさん
07/05/30 00:46:09
Lingなんとか::なんとかっていうモジュールがCPANにあったな・・・

214:デフォルトの名無しさん
07/05/30 12:13:56
googleとつるんでるbasis techで売ってるよ

215:デフォルトの名無しさん
07/05/31 20:58:07
YO!

216:デフォルトの名無しさん
07/06/03 20:22:13
誰かGosen使ってみた人いる?
いたらインスト情報プリーズ。
なんか動かんorz
API周りの変更が原因っぽいが。


217:デフォルトの名無しさん
07/06/04 01:11:41
この分野ってさ
ノーベル賞とか、取ろうと思えば取れるような分野なの?
過去に受賞した人とか居るのかな?

チョムスキーが提唱したような、人間の脳による、正確な生成文法をキチンと科学的に解明出来れば、取れそうなもんだが
ぶっちゃけ、それもう自然言語処理の分野から外れてるような。


いやぁ、今高校2年なんだが、将来どんな分野に行くか考えてる時期で、自然言語処理に興味あるんだけど
どうせなら、ノーベル賞くらいと思ってねwww
恥ずかしい夢物語だけどw


218:デフォルトの名無しさん
07/06/04 01:24:10
ノーベル生理学賞取るんなら、医学系行って言語野調べたほうがよさそうな。
自然言語処理なら、ノーベル賞よか、チューリング賞じゃないか?


219:デフォルトの名無しさん
07/06/04 11:29:58
自分で賞を創設する

220:デフォルトの名無しさん
07/06/04 22:08:28
やっぱ、ここは長尾賞

221:デフォルトの名無しさん
07/06/04 22:24:19
長尾翔ってもうなくね?

222:デフォルトの名無しさん
07/06/05 02:47:37
誰かチューリング賞くらい取れよ。
日本人じゃあまだ誰も出てないだろ?

個人的にCPU開発者の嶋正利とか、TRONの坂村健とか、ちょっと格が落ちるがRubyのまつともとかは、
とってもいいくらいだと思うんだがな。
ACM会員じゃないとかがやっぱでかいんだろうか、それともアメリカの日本のコンピュータ封じか?

アジアだと、中国人が受賞してたっけ。



223:デフォルトの名無しさん
07/06/05 16:48:52
なんでまつもと氏が取るんだよw

224:デフォルトの名無しさん
07/06/05 17:43:56
matzはないw

225:デフォルトの名無しさん
07/06/05 18:34:10
マッツって聞くと松屋で牛丼でも食ってきたくなるんだよ
行ってくるわ

226:デフォルトの名無しさん
07/06/05 21:34:35
>>222
>誰かチューリング賞く
同性愛者以外は対象外?

227:デフォルトの名無しさん
07/06/05 23:05:38
フォートランの人がとってたから、matzにもチャンスはあるんじゃね?


228:デフォルトの名無しさん
07/06/06 00:38:33
URLリンク(ja.wikipedia.org)

スレチな流れですね。

229:デフォルトの名無しさん
07/06/06 08:31:01
>>228
つい数ヶ月前に亡くなられたのか。 黙祷。

230:デフォルトの名無しさん
07/06/06 15:00:06
>>216
俺はできたけど、どこで詰まるの?

231:デフォルトの名無しさん
07/06/06 15:23:54
mecabの焼き直しだっけ?

232:デフォルトの名無しさん
07/06/06 16:23:50
mecab->sen->gosen
mecab0.8系?

自前辞書がコンパイルできなかったから、senに戻したよ。
もうmecab-javaにしたい。

233:デフォルトの名無しさん
07/06/06 19:43:27
自然言語処理界のアイドルって誰?

長尾タン?
工藤ちゃん?
たつを?


234:デフォルトの名無しさん
07/06/06 20:15:45
長尾タンハァハァ

235:デフォルトの名無しさん
07/06/06 21:34:56
辻たんも黙ってないぞ

236:デフォルトの名無しさん
07/06/06 21:36:45
松っちゃんもいるがな

237:デフォルトの名無しさん
07/06/06 21:57:11
>>234
本人乙

238:デフォルトの名無しさん
07/06/06 23:14:16
長尾バロス

239:デフォルトの名無しさん
07/06/11 16:08:09
AAMTアゲ

240:デフォルトの名無しさん
07/06/11 20:02:39
はいはいまた馴れ合い

241:デフォルトの名無しさん
07/06/15 15:29:40
URLリンク(hal3.name) かな

242:デフォルトの名無しさん
07/06/19 06:47:41
excite翻訳で 

スゲиシ┐ゝ,ザァ,ユЮ. 
θイ,ゎモモモモマいデ. 
びデた,ゝС,さーモモモモデゝねг 

↑を中国語→日本語翻訳してみると・・・・ 
URLリンク(www.excite.co.jp) 

こういうのってわざとやってるの?
それとも偶然なの?

243:デフォルトの名無しさん
07/06/19 17:23:02
朝は必ず私は厨房の妹に飛びかかって、すがりついてお願いして、交尾
して乳をむさぼって、ただぱんぱんぱんぱん穴の中で犯すのがあま
りに犯します凶悪で、妹は身ごもって、今しようがなくぱんぱんぱんぱん妹の友達を犯して我慢します

偶然というより
中国語の文字コード見れば氷解するんじゃないかな

244:デフォルトの名無しさん
07/06/19 20:50:43
うほっmoonとかも?

245:デフォルトの名無しさん
07/06/19 21:22:31
大量のコーパスとして学術論文データが欲しいのですが、PDF論文データを大量にGETできる方法はないでしょうか?

246:デフォルトの名無しさん
07/06/19 21:25:39
○○周年記念DVDとか なかったっけ?
どこの学会は忘れたが…。

247:デフォルトの名無しさん
07/06/19 22:03:50
変な日本語多いじゃん

248:デフォルトの名無しさん
07/06/25 20:04:39
yamcha-0.33.tar.gzを展開してインストールしようと思ったんだけど、
Makefileが入ってないのは仕様ですか?

249:デフォルトの名無しさん
07/06/26 10:03:44
しょうです

250:デフォルトの名無しさん
07/06/26 12:44:52
public static void main(String[] args){
int [] [] Ma=new int[Machine+1][K+1];
int [] forbid=new int [Job+1];
int [] penal=new int [Job+1];
int Obj=0;

for(int i=1;i<=Job;i++){
int mindue=10000;
int assignJob=0;
for(int i2=1;i2<=Job;i2++){
if(mindue>(duedate[i2]+forbid[i2])){
mindue=duedate[i2]+forbid[i2];
assignJob=i2;
}
}

251:デフォルトの名無しさん
07/06/28 12:12:18
コーパス中の任意の場所が類似しているというのを線形時間ぐらいで近似的に見つけ出すという方法を考えてるんですが、

2chでは特にそういうの(類似表現)多そうですが

助詞が入っていないとか間違ってるとか、
語尾や言い回しが微妙に違うとか、
主語、目的語が違うとか

これとこれとこれと....これが類似してる と示せます
そして、その「これ」が、先に与えられているわけではない、というやつです。

※エントリとエントリの類似度を測るのではないです。
任意のエントリ中の任意の部分文字列と
任意のエントリ中の任意の部分文字列との中から
(つまり可能な全ての部分文字列の組)


そういうのを全部見つけ出す方法考えたんですが
その、評価方法を知らないでしょうか?

見つけ出す方法は大体できてるんですが、
それがこんなに有効なんですよと、示すための(他の手法との)比較方法がわかりません。(そんな研究が存在しているのかどうか)




252:デフォルトの名無しさん
07/06/28 12:16:50
>そういうのを全部見つけ出す方法考えたんですが

kwsk

253:デフォルトの名無しさん
07/06/28 15:03:33
lcs?

254:デフォルトの名無しさん
07/06/28 16:53:14


コーパスの例は適当です。

①東京・臨海地区に新しく開設される警察署の名称が「東京湾岸署」となる可能性がでてきました。まだ正式決定ではないですが、
別に踊る大捜査線を意識したものではないのだそうです。.....

②警視庁が来年3月に臨海地区に開署予定の警察署の名称に「東京湾岸署」とする条例改正案を提出する方針らしい。
踊る大捜査線を意識してないと発表してるけど、.....

③「東京湾岸署」新設へ 「踊る大捜査線」意識せず
臨海副都心に新設される警察署の名称が「東京湾岸署」に決まった。......


① [臨海地区に新しく開設される警察署の名称が「東京湾岸署」]
② [臨海地区に開署予定の警察署の名称に「東京湾岸署」]
③ [臨海副都心に新設される警察署の名称が「東京湾岸署」]

が、それぞれ 似ている Ⅰ

① [踊る大捜査線を意識した]
② [踊る大捜査線を意識して]
③ [踊る大捜査線」意識せず]

が、それぞれ 似ている。Ⅱ

というように、(厳密一致ではなく)似てると思う部分を(線形時間ぐらいで)列挙するもちろん、①②③は便宜上書いているだけで、このように文書が分かれていなくても

類似検索などでは 「踊る大捜査線を意識」というようなクエリーを与えられてからⅡを返せばよいが、
そうではなく、コーパスを読み込んだときに、こういう類似パターンを「先に全て」列挙する(人間が気づいていない類似パターンがあるかもしれない)


255:デフォルトの名無しさん
07/06/28 17:54:14
卒論の時期なのかな

256:デフォルトの名無しさん
07/06/28 19:42:17
>>251
遺伝子の配列アラインメント問題関連で調査すると良いかもしれないです

257:デフォルトの名無しさん
07/06/29 00:46:45
ブロックソーティング

258:デフォルトの名無しさん
07/07/03 12:30:05
SVMでOK。

259:おねたん
07/07/04 21:36:59
SVMと同様なクラスに分類されるアルゴリズムはいろいろあるだろ
SVMに拘る意味が不明だと思った。知ってる言葉並べただけ?

260:デフォルトの名無しさん
07/07/06 06:04:01
>>259
ハイパーパラメータが少ないし、libsvmなど出来合いのツールで手っ取り早くできるからじゃない?


261:デフォルトの名無しさん
07/07/06 07:16:25
だからブロックソートが一番早いっつーの
インデックスを作る時間を考慮しなければ最大でも線形時間ですむ

262:デフォルトの名無しさん
07/07/06 10:32:13
SVMというバカチョンツールが出てきたから
つまんなくなったな

カーネル法の奥は深いけどさ

263:デフォルトの名無しさん
07/07/06 14:42:47
SVMのおかげでベースラインには困りません

264:デフォルトの名無しさん
07/07/06 16:53:40
誰か僕にノンパラベイズを教えてください

265:デフォルトの名無しさん
07/07/07 10:33:32
つ今年のACLツートリアル

266:デフォルトの名無しさん
07/07/07 11:04:45
どこ?

267:デフォルトの名無しさん
07/07/07 19:47:06
このスレの人達にいくつか質問が.

エスペラントでは単語の後に品詞を示す接尾語がついていて,
少なくとも品詞解析のレベルまでは曖昧性なしで行けると思うんだけど,
こういう,ある程度文法が整理された人工言語をコンピュータで解析している研究とか知ってる人がいたら教えてください.

エスペラントとかを話す人はかなり少ないけど,
コンピュータによる理解が容易であるなら普及にもつながるはず…と思うんだがそこら辺はどう思う?
たとえば,ある言語Xから英語や中国語へ正確な翻訳ができるなら,Xを勉強するコストを支払うか,という質問.

268:デフォルトの名無しさん
07/07/07 20:33:51
>>266
プラハ

269:デフォルトの名無しさん
07/07/07 20:51:34
そういう問題じゃねえw

270:デフォルトの名無しさん
07/07/07 22:16:19
>>267
エスペラント語から英語や中国語へ翻訳ができても、逆ができないなら、魅力はほぼないと思う。
こっちから何か伝えることはできても、相手の言ってることはわからないんじゃ、英語でも覚えるほうがマシ。

逆に、エスペラント語と英語や中国語との間で相互に正確な翻訳ができるなら、当然エスペラント語経由で英中・中英の正確な翻訳ができる。
この場合、エスペラント語はコンピュータが理解してれば充分で、人間は覚える必要がない。

…ってことで、その路線でも普及しないと思うよ、エスペラント語。

271:デフォルトの名無しさん
07/07/08 00:18:45
>>270
でも誰かに読ませるためにHTMLとかを覚える人は沢山いるでしょ.
インターネット上で何か発信したいと思ったらその言語で書けば主要な言語に翻訳されるわけだから,
読む方にとってみれば相当の省力化になると思う.

書く方にしても,マニュアルとか書く人にしてみたら一つ書けば多言語のマニュアルができあがるわけだし.

272:デフォルトの名無しさん
07/07/08 01:24:10
>>267
中間言語にエスペラント語を使った自動翻訳システムがあると聞いたことがある

273:デフォルトの名無しさん
07/07/08 03:35:16
>>272
はいはい

274:デフォルトの名無しさん
07/07/09 02:57:45
>>272
適当に探したら
URLリンク(www.cs.berkeley.edu)
とかがそうだった

275:デフォルトの名無しさん
07/07/16 13:28:35
統計翻訳っていまいちじゃね?

276:デフォルトの名無しさん
07/07/19 10:53:11
MeCab

277:デフォルトの名無しさん
07/07/19 19:38:08
ChaSen

278:デフォルトの名無しさん
07/07/20 11:06:59
JUMAN

279:デフォルトの名無しさん
07/07/20 14:14:31
KAKASI

280:デフォルトの名無しさん
07/07/20 15:47:43
Ukkonen's algorithmが分からん

281:デフォルトの名無しさん
07/07/21 02:57:43
奇遇だな。俺も今Ukkonen's algorithmを実装してる。
確かに難しい。今まで書いたプログラムの中で一番難解だ。


282:デフォルトの名無しさん
07/07/21 07:14:42
(・∀・)ウッコネン!

283:デフォルトの名無しさん
07/07/21 09:36:42
MecabやChaSenってURLを一まとめに扱ってくれないみたいですが、扱えるようにするパッチとかはありませんか?

284:デフォルトの名無しさん
07/07/21 13:02:31
解析結果に後処理かますのが一番簡単そう。

285:デフォルトの名無しさん
07/07/22 12:22:03
Win版MeCabにUTF-8を突っ込むのは無理なの?
やっぱ、EUC以外だと、./configureのオプションつけるしかないのかな?

この辺、iconvでも使って、パフォーマンスは落ちるけど、コマンドライン引数で何とかできるようにすればいいのに

286:デフォルトの名無しさん
07/07/22 13:31:03
>>285
そういうラッパーを自分で書けばいいだろ

287:デフォルトの名無しさん
07/07/22 13:57:54
win版も工藤が作ったの?

コードのセンスは良くないよね

288:デフォルトの名無しさん
07/07/22 14:18:30
Haskellってどうよ。

289:デフォルトの名無しさん
07/07/22 14:18:32
正直、MeCabとChasenは辞書を共通にしてもらえるとありがたかった・・・。
そしたら、俺の仕事が大変楽になったのに・・・。
どっちもDARTSライブラリ使いまわしで、DobleArray構成してるんだよね?



290:デフォルトの名無しさん
07/07/22 14:39:45
dartsのベンチって誰かとった?
他にもっと速いのないの?

291:デフォルトの名無しさん
07/07/23 06:51:06
Txは、dartsよりサイズが小さくなるけど、今のところまだ遅いみたいね。

292:デフォルトの名無しさん
07/07/23 08:51:19
Suffix Arrayは駄目なの?

293:デフォルトの名無しさん
07/07/23 10:08:25
はい?

294:デフォルトの名無しさん
07/07/24 05:56:53
ライブラリの話をしてるんだろが・・・


295:デフォルトの名無しさん
07/07/24 14:47:36
ライブラリ途中下車の旅

296:デフォルトの名無しさん
07/07/24 19:20:00
自然言語処理のゴール地点はどこだと思いますか?


297:デフォルトの名無しさん
07/07/24 19:22:29
コンピュータと人間で人間らしい会話ができたらかな

298:デフォルトの名無しさん
07/07/24 20:19:24
チューリングテスト?
それって特定の分野に絞ればもう合格してたような希ガス

299:デフォルトの名無しさん
07/07/24 22:56:11
ELIZAタイプは例外ルールだとよ。

300:デフォルトの名無しさん
07/07/25 07:56:58
昔ラクターってソフトがあってな

301:デフォルトの名無しさん
07/07/25 09:11:04
ねーよ

302:デフォルトの名無しさん
07/07/25 20:22:11
URLリンク(en.wikipedia.org)
あるーよ

303:名無しさん@そうだ選挙に行こう
07/07/29 16:34:48
     いいか、みんな
        (゚д゚ )
        (| y |)

   ハードディスクが中国で人気が在ると言っても
                
     ハード ( ゚д゚) ディスク!
       \/| y |\/

   exciteの中国翻訳で日本語に訳してみよう。
        ( ゚д゚) ハードディスク
        (\/\/

   すごい事になりますた。
        ( ・д・)
        (| y |)
URLリンク(www.excite.co.jp)

304:名無しさん@そうだ選挙に行こう
07/07/29 19:41:07
こうでんしゃって新卒とってるのかなー

305:デフォルトの名無しさん
07/07/30 15:38:50
>>303
各種ディスクドライブ
でやってみると…

306:デフォルトの名無しさん
07/07/30 23:47:39
「ババブーディンゴ」とか。

307:デフォルトの名無しさん
07/07/31 18:52:56
LFG理論に基づく自然言語処理を30年近く続けてきたRon Kaplanが
Powerset社に参加し,サーチエンジンに自然言語処理を本格的に
応用する。

Kaplan, who has led the [Xerox PARC] “natural language” group for several years,
joined Powerset as chief technology officer in July.

URLリンク(72.14.235.104)


LFGを応用すると,こんな検索が可能となるそうだ。
“Who acquired IBM?” Google will give you lots of results about companies that
IBM acquired, even though that’s not what you asked. Powerset, on the other
hand, will give results of the companies that acquired IBM units

LFGは日本語の処理も可能で,多言語対応版はXFGと呼ばれている。

ACL2007ではPowerset社COEが基調講演を行った。講演後にKaplanとともに
皆の祝福を受けていた。

308:デフォルトの名無しさん
07/07/31 21:19:55
せきねしね

309:デフォルトの名無しさん
07/08/01 09:45:52
ごめん、検索エンジンを高機能化するって
いったい現状のどこが不満なのかわからん。
推論マシンみたいにしたいって事?

310:デフォルトの名無しさん
07/08/01 09:48:53
心を読み取る装置は本当に実在する!!

僕、実は思考盗聴されているんですけど!その3
スレリンク(jinsei板)

311:デフォルトの名無しさん
07/08/01 10:00:01
キーワード入れるんじゃなくて、いわゆる自然文検索ってことかしら?

312:デフォルトの名無しさん
07/08/01 12:28:35
今のGoogleってwikiがいつも上位に来て、ちょっと間違ってるような気がする。
最近出来たばっかりのページでも「正しい」内容を書いてあるページを
理解して、そこを上位にして欲しい。

313:デフォルトの名無しさん
07/08/01 13:12:05
ようするに

"日本国の総理大臣は誰ですか?"
"今流行のファッションはなんですか?"

って検索すると、答えのページが出てくるって話だろ。




Prologを実装したらよくね?w


314:デフォルトの名無しさん
07/08/01 13:37:55
Powersetが14億7千5百万円を投資家から集める
Powerset gets $12.5M

URLリンク(72.14.235.104)

日本の自然言語処理も高く売れるといいね。

Powerset/PARCのLFGパーサー出力を次にどのように意味分析するかは,
企業秘密なのだろう。講演を聞いても分からなかった。同じACL2007で
元PARCの研究者がLFG+意味解釈について発表していた。彼女は,
Powersetとは関係ないが,参考になるかも。

URLリンク(www.aclweb.org)

315:デフォルトの名無しさん
07/08/01 13:52:47
URLリンク(www.freewebs.com)

316:デフォルトの名無しさん
07/08/01 14:03:14
基本語彙群を理解でき、かつ、基本語彙のみにより他の語を完全に理解できるという状況を考える。
未定義の語を基本語彙へ置き換えることで定義すれば、理解できた(定義された)文は、基本語彙のみにより記述されている。
ただし、語に複数の意味がある場合、意味で分類しなければならない。どの意味になるかは、文の理解に必要で、
人工知能が正確な意味を確認する状況も想定される。例えば、「肩車」を「肩」と「車」の
複合語として読み取った場合、「車」は一般的な「自動車」の意味なのかを確認する必要があるかもしれない。

317:デフォルトの名無しさん
07/08/09 21:43:03
このスレの住人って2chの過去ログを解析して関連スレを列挙するくらい朝飯前ですか?
そんな感じの処理に役立つソフトやライブラリ、アルゴリズムを教えてください。

318:デフォルトの名無しさん
07/08/09 21:55:45
カテゴリ分けに必要な辞書作成に、時間と労力を消費するから
個人がどうとか言うレベルの話ではないと思われ。


319:317
07/08/09 22:12:49
えー。でもローカルに落とした過去ログって何かもったいなくないですか?
個人利用にとどめれば2chは訴えたりしないだろうし、一種のコーパス、知識データベースとして
見ればなかなかオイシイですよ。特に質問スレ。
聞いたことあるな~って単語があったとき、詳しく知るためにgrepしたこと数知れず……。
もしかして私だけ?( ̄~ ̄;)

320:317
07/08/09 22:25:32
ローカルの過去ログ集合に対して、各ログを形態素解析

平均との差分を取って、出現箇所の偏りが激しい単語を抽出

それらの単語について共起確率を計算、適当にカテゴリ化

カテゴリ内の距離を詳しく計算

みたいな感じで地図つくったらなんか便利そうなのよね。

321:デフォルトの名無しさん
07/08/10 00:08:11
A社のコーパスをNさんが機械的に処理して何らか統計情報(単語のリスト、出現数、共起確率など)を得た場合、
この統計情報は誰のものになりますか?
A社のコーパスのかわりに、B社のWEBサイトの文章を使った場合についても教えてください。

322:デフォルトの名無しさん
07/08/10 07:55:01
>>321
統計情報のみの提供なら、統計情報は統計情報を作った人の物。



323:デフォルトの名無しさん
07/08/11 09:01:35
そうなの?

だめなんじゃない?

324:デフォルトの名無しさん
07/08/11 09:02:23
社会保険庁の名前処理で
声かけられた人いる?

325:デフォルトの名無しさん
07/08/11 09:19:14
DoubleArrayとSuffixArrayを比べた場合。
SuffixArrayの利点は何かあるんでしょうか?
直感的に(実装が)分かりやすいくらい?

326:デフォルトの名無しさん
07/08/11 12:48:12
比べるのが間違ってる。

327:デフォルトの名無しさん
07/08/11 13:47:05
90年代のアルゴリズムと比べるとかありえない…
特定分野に限れば、Suffixに構築速度の点で一応分がある

あとDoubleアレイは辞書引き特化だから、全文検索に使うのは一工夫いる

328:デフォルトの名無しさん
07/08/12 03:38:32
>>323
Googleとか、普通に検索エンジンのデータ流用してるし、売ったりもしてるっしょ。


329:デフォルトの名無しさん
07/08/12 09:32:49
市販の辞書はダメでしょ?

辞書ファイルをぶっこぬいて
それを処理したら・・・

330:デフォルトの名無しさん
07/08/14 18:15:10
そういや、Googleのクエリサーバーのディスクスペースってどれくらいあんのかな?
そこから大量の統計データ取ってそうだけど。


331:デフォルトの名無しさん
07/08/14 21:38:33
クエリサーバとかディスクスペースとか、なんて前時代的な。

332:デフォルトの名無しさん
07/08/15 18:30:14
>>329
辞書とか確率とか、自然言語処理って圧縮操作に似てるところがあるから、
オリジナルの劣化圧縮版と見做されると危険は常にあるよね。

市販の辞書をコーパスにするのがまずいっていうのは、そういう背景があってのことでしょ?
言い換えるなら、情報の有無自体が辞書の価値だからさ。

333:デフォルトの名無しさん
07/08/15 18:31:20
記号論的人工知能も、自然言語処理も、
なんか時代に取り残されてる感じだよね。

統計学を熟知したスーパーハカーが趣味で書いたコードのほうが
実際には訳に立ちそうな感じ。スパムフィルタとか。

334:デフォルトの名無しさん
07/08/15 19:12:48
>>332
そういえば、Googleは他人のサイトのデータを勝手に使って、色んなサービス(検索エンジン自身も)をやってるわけだけど
ああいうのって、裁判起こされたりしないのかな?

335:デフォルトの名無しさん
07/08/15 19:43:48
>>334
Google「おいおい、俺らは利用者のためにサービスを向上させてるだけで、
     それ以外のことはしてないぜ?」
Google「俺らのサービスは、利用者をオリジナルのサイトに案内することだ。
     そのために要約を作ったり、統計を使ったり、辞書を作ったりする。
     ついでに広告も出す」
Google「どうしても嫌ならサイトのトップディレクトリに robots.txt 置けよ。
     お望みどおり、サイトが『存在しなかった』ことにしてやるからwww」

という感じ。

336:デフォルトの名無しさん
07/08/16 18:48:50
なんというネットマフィアw

337:デフォルトの名無しさん
07/08/16 20:34:24
Googleは他人のふんどしで相撲を取ってる、というイメージが付きまとって
好きになれない。

338:デフォルトの名無しさん
07/08/16 21:52:42
>>334
なんかグレーゾーンって著作権やってる弁護士に聞いたことある。
特にキャッシュなんかはまずいらしいけど。

339:デフォルトの名無しさん
07/08/17 18:58:12
しかしそのGoogleの食べ残しに群がるだけの研究の多いこと。

340:デフォルトの名無しさん
07/08/17 22:27:14
もうGoogleがいるから研究する気なくなりそう。


341:デフォルトの名無しさん
07/08/18 02:13:49
っていうか逆逆
研究やってるヤツが、Googleに引き抜かれるんだよ。
Googleそのものが研究の大部分をやってたわけじゃない。
Googleがいるから研究が出来ないとか、根本からおかしい。
あそこは所詮商業的な活動をする企業だよ。

342:デフォルトの名無しさん
07/08/18 10:36:37
Googleに人材引き抜かれる
→優秀な人はGoogleで研究する & Google以外は人が減る
→Googleに太刀打ちできない!

あってると思うが?
あと研究が"出来ない"とはだれも言ってない。

343:デフォルトの名無しさん
07/08/18 17:46:22
ホラ来た脳内妄想強弁するおかしな奴

344:デフォルトの名無しさん
07/08/18 19:07:24
構文解析アルゴリズムってどれがいいの?


345:デフォルトの名無しさん
07/08/18 19:50:57
脈絡のない単発質問は
回答しても時間の無駄なので却下

346:デフォルトの名無しさん
07/08/19 03:54:03
>>345
掲示板で脈絡とか痛い奴だな。
わかんねーならただROMってろよ、低脳。

347:age
07/08/19 13:03:15
>>344
ルール?確率?

348:デフォルトの名無しさん
07/08/19 14:39:32
その件は却下だそうです

349:デフォルトの名無しさん
07/08/19 22:18:58
>>347
なんでもいいんで研究で使ってるアルゴリズム教えてください。

350:デフォルトの名無しさん
07/08/19 23:29:42
>>349
わかんねーならただROMってろよ、低脳。

351:デフォルトの名無しさん
07/08/19 23:59:49
話題提供もできねぇ奴がのさばるな>>350

352:デフォルトの名無しさん
07/08/20 00:05:01
いつもいつものパターンとして、
唐突な単発質問に真面目に答えてやると、
どっかのバカ匿名掲示板の運用者が
それをネタにまたぞろバカビジネスを企画する
って展開もう飽き飽きだからなぁ。
真面目に答えて欲しいなら、金を出せ。以上だ

353:デフォルトの名無しさん
07/08/20 01:08:53
糞過疎スレの癖に一丁前に荒れててワロタ

354:デフォルトの名無しさん
07/08/20 11:45:10
>>349
URLリンク(acl.ldc.upenn.edu)

355:デフォルトの名無しさん
07/08/21 14:33:53
suffix array作って、lcp求める、までコードを書いたのですが、
そこから単語出現頻度を求めるとなると、SIL,LBLという手法を使うみたいでして、
これがいまいちパッとしない感じがしてしまうのですが、
現在でも使われているのでしょうか?

356:デフォルトの名無しさん
07/08/21 17:43:48
URLリンク(www.sematics.co.jp)

357:デフォルトの名無しさん
07/08/22 08:58:57
英国辞書出版社が辞書編纂に使用してきたシステムを
一般公開。日本語の検索もできて、便利。
Adam Kilgarriffはこの世界では結構有名。
URLリンク(www.sketchengine.co.uk)

358:デフォルトの名無しさん
07/08/22 10:05:26
>>355
ここは金を払わないとまじめに答えたくないヤツしかいないから、他にあたった方がいいよ。

つーか、このスレ何の為のスレなんだろうな。

359:デフォルトの名無しさん
07/08/22 15:18:42
まあ、誰も答えてくれないのは355の質問が結局何を聞きたいのか分からないからなわけだが。

>>355
Suffix ArrayのはMSRのChurchさんが昔書いたジャーナルを読んだら大体分かる筈。
現在も使われてるかという質問なら
「使う奴も居る。もうちょっと頭の良さげな方法を使ってる奴も居る」
としか答えられない。

360:デフォルトの名無しさん
07/08/22 17:06:45
少なくとも、ここ1・2年の発表で、研究としてSILやLBLを使ったのは見た事は無いな。
業務では使ってるかも知れないし、使ってないかも知れない。


361:デフォルトの名無しさん
07/08/22 20:11:31
SILとかLBLってなに?

362:デフォルトの名無しさん
07/08/23 12:29:48
>>359
「もうちょっと頭のよさげな方法」ってなに?


363:デフォルトの名無しさん
07/08/23 22:06:54
すぐ質問する人工無能が涌いてるな。

364:デフォルトの名無しさん
07/08/23 22:11:29
病院発見

365:デフォルトの名無しさん
07/08/23 23:31:24
>>360
コイツはしったかか?

366:デフォルトの名無しさん
07/08/24 00:13:50
現在でも使われているのでしょうか? っていう質問が悪かったんですかね。

suffix arrayの構築法なんかは進化がむちゃくちゃ速いようだったので、
SILとLBLがそんなん使うなよ!ってレベルのものなのか不安になりまして。(参考にしたのは2005年のものでした)

今は
URLリンク(project.carrot2.org)
を参考にして作ってます。SILとLBLに比べたらずいぶんわかり易いです。

367:デフォルトの名無しさん
07/08/24 09:59:24
NAISTの連中が身内以外に情報あげるわけないじゃんw
このスレは、NAISTの連中が、素人の質問を見ながらニタニタするスレだよ!

368:デフォルトの名無しさん
07/08/24 11:52:31
奴らの閉鎖性にはびっくりするよ
質問のメール出しても論文欲しいって言ってもそっけないし

369:デフォルトの名無しさん
07/08/24 12:52:10
どういう流れでNAISTが出て来るのだ?

370:デフォルトの名無しさん
07/08/24 14:04:27
NAISTのあの研究室はそんなに偉いのか??


371:デフォルトの名無しさん
07/08/24 14:24:36
NAIST(笑)

372:デフォルトの名無しさん
07/08/25 01:20:44
奈良先を批判する書き込みが増えたとたんそれらしい書き込みがなくなったのは>>367が言ってることが正しいってことがわかるね。

373:デフォルトの名無しさん
07/08/25 02:52:30
・・・?

374:デフォルトの名無しさん
07/08/25 04:12:10
NAISTの連中って馬鹿のくせにプライドだけは一丁前だからなぁ

375:デフォルトの名無しさん
07/08/25 04:39:25
NAISTを知らんバカ

376:デフォルトの名無しさん
07/08/25 04:40:52
頭が悪いからすぐ釣れるw

377:デフォルトの名無しさん
07/08/25 04:42:19
お、食いつき早いな

378:デフォルトの名無しさん
07/08/25 04:53:55
そもそも、何故suffix arrayの話からNAISTを叩くのか分からぬのだが。

379:デフォルトの名無しさん
07/08/25 04:58:49
誤爆から始まったんだろう

380:デフォルトの名無しさん
07/08/25 09:14:28
JUMANとCHASENなんか死んでもつかわん
あんな糞ライブラリ

やっぱり工藤ちゃんだね

381:デフォルトの名無しさん
07/08/25 10:12:15
誰か>>380につっこまなくて良いの?
特に奈良先や京大の人とか

382:デフォルトの名無しさん
07/08/25 14:23:37
全入NAIST(笑)

383:デフォルトの名無しさん
07/08/25 15:16:36
>>380
わかってて書いてるんだろうか・・・

384:デフォルトの名無しさん
07/08/25 18:44:52
速度も糞
精度も糞
コスト値推定も糞
ライブラリとしても糞

mecab最強

385:デフォルトの名無しさん
07/08/25 18:55:26
本気で分かってなくて書いてるんだな。
工藤氏はNAIST出身
Chasenの開発もやってた人。
そのChasenを改良したのがMeCab
そのMeCabをフルスクラッチで書き直してネイティブJavaにしたものが、Sen

386:デフォルトの名無しさん
07/08/25 19:12:00
釣れちゃったwwwwwwwwwwwwwwwwwwwwwww

387:デフォルトの名無しさん
07/08/25 22:52:48
MecabはWindows版、Perl版が糞
あれなら無いほうがマシ

388:デフォルトの名無しさん
07/08/26 09:20:09
>>385
>MeCabをフルスクラッチで書き直してネイティブJavaにしたものが、Sen
処理速度はMeCabが圧倒的に早い?

389:デフォルトの名無しさん
07/08/26 11:19:46
>>388
こんな事言うとJava信者から猛バッシング食らうかも知れないけど
それは、Javaが圧倒的に遅いからだと思う。
コード的にはSenは随分綺麗になった。


390:デフォルトの名無しさん
07/08/26 11:43:55
Mecabはソース読んだことないからわからないが、Senのコードは結構ヘボいぞ。

391:デフォルトの名無しさん
07/08/26 14:55:14
今時中学生が書く程度のコードだと思った。
正直な感想です。

392:デフォルトの名無しさん
07/08/26 16:06:17
中学生がプログラミングなんてやらんだろ。
やっても、BASICでゲーム製作が関の山
正直な感想って、どんだけ捻くれてるんだよw

393:デフォルトの名無しさん
07/08/26 16:49:24
>>392
読めばわかるよ。

394:デフォルトの名無しさん
07/08/26 17:17:24
中学生がプログラミングと言うマイノリティな状況を想定してる時点で察しろ。

つーか、もしプログラミングをunder18世代が出来るとすれば、14~16くらいの方が一般的にハイレベル。
世界的なすげぇPGやハッカーは、みんなこの年代だし。俺らみたいな頭の固いヤツよりはるかに良いコードを書くよ。
そういう意味では、中学生的コードの書き方と言うのは、絶賛と言う意味になるわけだが…

395:デフォルトの名無しさん
07/08/26 17:19:41
>>394
頭は柔らかいかもしれないが、一番分かりやすいのが変数・関数名のつけ方がry
Senのコードはまさにそれ。ハッカー的コードだが、教養の無さが露見

396:デフォルトの名無しさん
07/08/27 07:49:31
漏れもここで叩かれるぐらい有名になりてー

397:デフォルトの名無しさん
07/08/27 12:41:16
>>392
やりますからw

398:デフォルトの名無しさん
07/08/27 13:03:13
中学生じゃなくて
程度の低い高校生じゃなかろうか

399:デフォルトの名無しさん
07/08/28 02:12:27
なんか関係ないことがずっと続いてますのでそれらしい話題を。

自然言語処理を研究している人たちは計算機科学的アプローチ、認知科学的アプローチ、アルゴリズム的アプローチ、言語学的アプローチ、どのアプローチで研究してますか?

400:デフォルトの名無しさん
07/08/28 07:53:47
思いつきアプローチw

401:デフォルトの名無しさん
07/08/28 08:28:51
>>394
本人様ですか?
そりゃ失礼w

402:デフォルトの名無しさん
07/08/28 09:54:53
>>399
そういう偏ったアプローチはやりません。

403:デフォルトの名無しさん
07/08/28 11:04:38
統計工学的アプローチ

動けばよかろうなのだァッ!!

404:デフォルトの名無しさん
07/08/28 13:18:18
>>403
流行だね。でもちゃんと結果でるし。

405:デフォルトの名無しさん
07/08/28 14:39:22
今時工学的な応用を考えないでいる人なんて珍しいんじゃね?

406:デフォルトの名無しさん
07/09/01 18:31:45
この業界って、研究用プログラムって基本的に何で動かすの?
UNIX系?それとも、最近はWindows?
いつも、Cygwinでゴリゴリコーディング&動作させながら
時代錯誤じゃないか?って思うようになってきた。

407:デフォルトの名無しさん
07/09/01 18:33:57
linuxでやってるんだろ

408:デフォルトの名無しさん
07/09/01 21:41:45
ソラリスに決まってんだろ。

最近は、コンパイラ性能は、MSのがかなり強いんだって?
gccで十分とか思ってたが、そんなに差があるものなのだろうか。

409:デフォルトの名無しさん
07/09/01 21:44:59
今時Solarisはねーよwww

410:デフォルトの名無しさん
07/09/01 22:28:57
Mac OS Xという可能性も。
というか、この分野のMac率の高さは異常。
でもまあ、大規模な実験はそれなりにリッチなハードに入ったLinuxでやるのが普通かと。

411:デフォルトの名無しさん
07/09/01 23:49:12
Mac OS Xが常識だろ。windowsならcygwin

412:デフォルトの名無しさん
07/09/02 00:25:06
mac os xのなにがいいわけ?

413:デフォルトの名無しさん
07/09/02 00:28:17
UNIXだから。

とか?w
ネタでしょ?本当にMacOSXなんて使ってんの?


414:デフォルトの名無しさん
07/09/02 00:31:03
普通は簡単な開発は、WinでCygwin
普通の実験は、Linux
大規模になると、どっかのメインフレーム間借りして24時間数ヶ月回すって感じ。

Macは流石にネタだろう・・・。
聞いた事無いぞ・・・。

Solarisは、数十年前では定番だったが、今はありえない。


415:デフォルトの名無しさん
07/09/02 01:17:09
Macで開発してLinuxで回すって人も結構いる。
でも、単に自然言語の研究者にMacユーザが多いからかもしれん。
個人的にはマルチバイトな言語をやるんならWin使った方が苦労が少ないと思う。

416:デフォルトの名無しさん
07/09/02 04:42:10
なんで Solaris がありえねーんだよ低能が。
並列処理を有効利用できない技術不足君ですか。

417:デフォルトの名無しさん
07/09/02 07:51:21
solarisだと並列処理がすごいの?

418:デフォルトの名無しさん
07/09/02 09:06:04
linuxでもwindowsでも並列処理はできるね

419:デフォルトの名無しさん
07/09/02 09:47:10
Cygwin使うのに何か理由あるのかな。

420:デフォルトの名無しさん
07/09/02 10:08:44
OSXは結構見るけど。

421:デフォルトの名無しさん
07/09/02 21:12:48
>>419
本番環境に合わせるためでしょ。
開発はWinの方がやりやすいし。

>>416
今時Linuxでも並列処理出来るだろ。
なんで、わざわざそんだけの為にソラリスなんだよw


422:デフォルトの名無しさん
07/09/02 23:46:24
Linuxのタスクスイッチが(ry
Kernel読むとわかるけど、ふつー読む気にならん位のソースなんだよなあれって

423:デフォルトの名無しさん
07/09/03 00:23:26
Solaris だと凄いんじゃなくて他がダメなだけ。Linux を例に挙げると安定度やスケーラビリティに問題がある。
できるとかいってるアホがいるけど、どうせまともな検証もせずに「俺の作ったのは動いたよ」レベルなんだろ?
小物データを片手で数えられるような CPU で処理してる低能にはわかんないかもね。

424:デフォルトの名無しさん
07/09/03 00:27:24
Solaris厨必死だwww

425:デフォルトの名無しさん
07/09/03 00:40:08 BE:281470829-2BP(400)
ぶっちゃけPOSIX互換ならどれでもいい。
それ以上のお話は他所でやってくれ

426:デフォルトの名無しさん
07/09/03 01:05:09
まあ、別に並列に拘らなくても新し目のCPUを幾つか積んだLinux機数台で
適当に書いたコードをきりきり回せば良いんじゃね?
商用Unixにかけるコストをハードウェアにかけた方が後々楽。

427:デフォルトの名無しさん
07/09/03 01:16:15
>>423
化石にも程がある。
今の時代、一体どれだけのLinuxユーザーが居ると思ってるんだ。
そんなもん、とっくに検証されて、改善されてるだろ。

>Linux を例に挙げると安定度やスケーラビリティに問題がある。
随分昔の知識か、またどうせ受け売りか、先入観だろ。
馬鹿馬鹿しい反論だな。そう言うなら、ソース出せ。
どうせ自分で検証して無いくせに。してたとしても、それは自分の実装が悪いんだろ。

428:デフォルトの名無しさん
07/09/04 09:44:32
今更、犬ってwww

429:デフォルトの名無しさん
07/09/04 10:03:32
これからLinuxでしょ。世の中は。

430:デフォルトの名無しさん
07/09/04 10:12:25
最近、新しく用意したマシンは、全部OpenSolaris(SXCE)にしてるよ。
Nexentaは期待してるけど、まだだね。

DTraceはべんりだよ。面倒くさいけど。

431:デフォルトの名無しさん
07/09/05 07:13:05
( ´_ゝ`)

432:デフォルトの名無しさん
07/09/05 21:02:40
>>427
ほほう。典型的な低能ですな。そんなに Linux をマンセーしたいのかい?
ユーザーが多いって、おま Linux なんて 2 コアとかせいぜい 4-8 コアの趣味人層がメインだろうが。
それ以上もいないとはいわんが、レアである事は間違いない。

> 随分昔の知識か、またどうせ受け売りか、先入観だろ。

なんか必死だな。ただ思い込みの激しいだけかもしれんけど。
こっちは検証した結果だめだったていってんだよ。他にも現行のスケジューラの問題点は指摘されてんだろ。
検証してねーのはおまえだろう。一応 CFS には期待してますよ。

433:デフォルトの名無しさん
07/09/05 21:08:00
うん、だから、ソース。

434:デフォルトの名無しさん
07/09/05 21:53:19
>>432
なんで必死なの?
大体、そんな大層ご立派な計算機環境であなたはどんなご立派な成果を出してるの?

435:デフォルトの名無しさん
07/09/05 23:04:11
>>434
お前痛々しいよ

436:デフォルトの名無しさん
07/09/05 23:10:25
>>434
煽っても無いものは出せんよ

437:デフォルトの名無しさん
07/09/07 07:42:19
URLリンク(jp.sun.com)
URLリンク(jp.sun.com)

438:デフォルトの名無しさん
07/09/07 08:00:24
URLリンク(ja.wikipedia.org)

439:デフォルトの名無しさん
07/09/08 07:31:03
なんだ
馴れ合い大好き奈良先のsun厨が書き込んでいたのか

440:デフォルトの名無しさん
07/09/08 14:41:14
ったく、これだから全入は

441:デフォルトの名無しさん
07/09/08 15:07:37
ま、前聞いたら、かの大学のかの研究室のメイン環境はGentooらしいけどね。
Gentooの中の人がいるらいいんで。

442:デフォルトの名無しさん
07/09/08 15:16:54
どうも人口無能です

440>>
全入ってなに?奈良先が全員入学できるってこと?アホな僕に愛の手を

443:デフォルトの名無しさん
07/09/08 15:58:55
>>441
なるほどそれで最近目立った成果がないのか。
不思議だったんだけど謎が解けた。

444:デフォルトの名無しさん
07/09/08 16:37:46
443>>人口無能にわかるように教えてくれぇ~

445:デフォルトの名無しさん
07/09/08 17:54:18
お前は、人口無能じゃなくて、天然無能だろ。


446:デフォルトの名無しさん
07/09/08 22:35:15
個人的に集めたテキストデータから共起辞書を作って
閲覧するツールって、文書書いたりするときに
すごく役に立ちそうだけど、共起辞書でぐぐっても
あんまりヒットしない。

なんでこんなに知名度低いの?
もしかして検索の仕方間違えてる?

447:デフォルトの名無しさん
07/09/08 22:45:28
EDRを本格的に活用している最近の研究はありますか?
フィリーでないのが利用者が少ない原因ですか?

448:デフォルトの名無しさん
07/09/09 00:57:14
奈良先は定員割れの話を聞くな…
うちも人ごとではないが

449:デフォルトの名無しさん
07/09/09 01:13:49
自然言語処理と画像処理に関しては、奈良先はまだ大丈夫でしょ。
まだまだ、ブランド力はある。

ま、それも時間の問題だろうがな。
今まで他がこの分野に目を付けなかっただけの事。


450:デフォルトの名無しさん
07/09/09 01:16:32
他が真剣にやりだしたら奈良先のアドバンテージなど・・・

451:デフォルトの名無しさん
07/09/09 08:00:47
灯台、鏡台も馴れ合ってるから大丈夫だよ

452:デフォルトの名無しさん
07/09/09 18:20:02
googleも最近は自動でクエリ拡張するじゃない?
あれはシソーラスはどうやって作ってるんかしら。

453:デフォルトの名無しさん
07/09/09 21:35:13
>>447
EDR使って何したいの?


454:デフォルトの名無しさん
07/09/10 01:06:07
統計の構文解析アルゴリズムのなかで、非決定的アルゴリズムある?


455:447
07/09/10 07:40:25
>>453
というか、WordNetは、今でも多くの
研究者が利用しているのに、日本の研究者が
EDRを積極的に利用していないような印象を
受けたので、質問してみました。

456:デフォルトの名無しさん
07/09/10 12:23:59
>>454
統計的なアルゴリズムはもとから非決定的なのでは?

457:デフォルトの名無しさん
07/09/10 12:36:09
>>456

そう?

458:デフォルトの名無しさん
07/09/11 00:14:54
同じデータ食わせれば同じ結果吐くんじゃ?そういうことではなくて?

459:デフォルトの名無しさん
07/09/11 00:20:37
URLリンク(ja.wikipedia.org)

460:デフォルトの名無しさん
07/09/11 08:25:37
wikipediaのデータは信用ならん。
嘘ばっか書かれすぎ。

461:デフォルトの名無しさん
07/09/11 08:39:28
と根拠も示さないお前の言い分よりもはるかに信用できる

462:デフォルトの名無しさん
07/09/11 11:40:45
プログラミングの世界で非決定性というのは
ひとつの問いかけに対して、複数の解がありうる場合を
いう。このWikipediaの非決定的アルゴリズムの説明は
これを完全に欠いており、 >>460 が正しい。

463:デフォルトの名無しさん
07/09/11 11:49:30
ほう、それで嘘はどこ?

464:デフォルトの名無しさん
07/09/11 13:05:34
無い

465:デフォルトの名無しさん
07/09/11 16:52:01
低脳すぎwww

466:デフォルトの名無しさん
07/09/12 00:58:32
晒しage

467:デフォルトの名無しさん
07/09/12 02:43:18
>>460
>>462

468:sage
07/09/15 21:10:57
トポロジーを用いた意味解析って??

469:デフォルトの名無しさん
07/09/15 21:22:13
チョムスキー大復活の悪寒

470:デフォルトの名無しさん
07/09/15 23:27:25
形態素の遷移を表した複雑なグラフ構造を
2Dあるいは3Dしか表示できない現代のディスプレイに
上手く表示するにはどうすれば???

グラフ理論とかそういうのが必要ですか?

471:デフォルトの名無しさん
07/09/16 13:20:31
画像処理スレ池

472:デフォルトの名無しさん
07/09/16 15:09:36
何だ、こたえられないのか

473:デフォルトの名無しさん
07/09/16 15:11:19
はいはい
グラフ理論とかそういうのが必要必要

474:デフォルトの名無しさん
07/09/16 15:21:42
ま、所詮この程度だよなw

475:470
07/09/16 16:29:47
助言ありがとうございます。
画像処理スレで質問してみようと思います。

476:デフォルトの名無しさん
07/09/18 21:27:56
Powersetって?

477:デフォルトの名無しさん
07/09/18 21:57:06
POwerSeT GOOGLE

478:デフォルトの名無しさん
07/09/20 11:01:20
力集合?

479:デフォルトの名無しさん
07/09/20 11:14:54
べき集合だろw

480:デフォルトの名無しさん
07/09/21 23:15:44
それはshould setだろ?

481:デフォルトの名無しさん
07/09/21 23:30:47
super set

482:デフォルトの名無しさん
07/09/22 13:52:00
はぁ?

483:デフォルトの名無しさん
07/09/22 14:36:55
ウィキペディアってネタとしてちょうどいいと思うんだけど、
HTML化するようなパーサってないのかな?

484:デフォルトの名無しさん
07/09/22 14:37:33
↑無かったら作ろうと思うんだけど

485:デフォルトの名無しさん
07/09/22 17:30:43
haa?

486:デフォルトの名無しさん
07/09/22 17:32:50
>>483
日本語でおk

487:デフォルトの名無しさん
07/09/22 18:51:22
>>485
>>486
お騒がせしました。
結局パーサー書きました。

488:デフォルトの名無しさん
07/09/22 22:52:38
なぜHTMLにする?

489:デフォルトの名無しさん
07/09/24 05:22:47
TeXにしたほうがいいよな。

490:デフォルトの名無しさん
07/09/24 05:23:15
なぜtex

491:デフォルトの名無しさん
07/09/24 05:23:50
レスはやっ

492:デフォルトの名無しさん
07/09/24 08:57:38
>>468
芝公園の小僧、出てきたな

493:デフォルトの名無しさん
07/09/24 09:05:14
その件はカテゴリー文法の研究を参照しるといったのに

あとは『構造の自動抽出』(ADIOS)な

494:デフォルトの名無しさん
07/09/24 11:25:04
wikipediaなら、XMLで持ってきて後はどうにでもなるんじゃないの?

495:デフォルトの名無しさん
07/09/24 12:04:54
>>494
どういう風に?
やっぱりRubyとか使うんですか?

496:デフォルトの名無しさん
07/09/24 13:29:35
HTMLにする理由がよくわからないってだけで、
XMLを読み込んでどうするかは、何やるか次第だからわからんけど。。

rubyが好きとか、使いたいモジュールがrubyにあるなら、rubyにするんじゃない?
俺はたぶんJavaを使う。XML関係は充実してるし、jdk1.5から入った、
concurrent周りが結構充実してるので、そういうの使って、
(無理矢理)並列化して、たくさんあるCPU/CPU coreをフル稼働するのが最高。
まあ、このスレだと、こういう低レベルな話は関係なさそうだけど…

497:デフォルトの名無しさん
07/09/24 13:51:44
要約すると単なる妄想

498:デフォルトの名無しさん
07/09/24 14:33:30
ありがとう。

499:デフォルトの名無しさん
07/09/24 16:49:55
>>497
確かに酷いもんだな
ゲノムやっとけゲノム。
なまばけがくじょうほうしょり。

500:デフォルトの名無しさん
07/09/25 03:21:25
rubyとかゲノムとかここは酷いインターネットですね

501:デフォルトの名無しさん
07/09/25 10:36:30
ruby最高!フォー!

502:デフォルトの名無しさん
07/09/25 14:06:53
まつもと乙

503:デフォルトの名無しさん
07/09/25 18:51:17
ruby乙

504:デフォルトの名無しさん
07/09/25 20:48:05
>>500
HTMLにする理由がわからない・・・XMLを読み込んで・・・
というあたりから、なにも知らないというか調べてもいないってことが分かる。
尚且つ、何やってんの馬鹿?みたいな態度で批判してる。
これらを合わせると、rubyとlinuxを使ってるかなーと。
rubyとかlinuxは実践しなくても妄想力だけで偉くなれるから。
それでrubyが出てくるわけで他意はない。

505:デフォルトの名無しさん
07/09/26 03:06:51
rubyを批判するのはいくないと思います

506:デフォルトの名無しさん
07/09/26 03:58:05
  _____ 
  (すた☆らき)
   ̄ ̄\| ̄ 
URLリンク(www.freewebs.com)


507:デフォルトの名無しさん
07/09/26 12:53:18
HTMLにする理由は確かにわからんなw
XMLデータ取ってきて、タグ排除して、生コーパスにして、インデキシング作成するならともかく・・・



508:デフォルトの名無しさん
07/09/26 16:48:50
HTML厨自重

509:デフォルトの名無しさん
07/09/26 19:27:43
>>505
rubyを批判してるんじゃなくて、rubyを使うやつにはなぜかカスが多いと・・・

510:デフォルトの名無しさん
07/09/27 00:15:09
ruby好きとバイオインフォ屋にはろくなの居ないな

511:デフォルトの名無しさん
07/09/27 00:19:15
かすでも何となく使えるのがrubyだから。

512:デフォルトの名無しさん
07/09/27 01:56:14
rubyのコンセプトは?

513:デフォルトの名無しさん
07/09/27 09:47:32
>>512
loveとend

514:デフォルトの名無しさん
07/09/27 10:39:42
短小・・

515:デフォルトの名無しさん
07/09/27 20:17:22
もうrubyしか見えない

516:デフォルトの名無しさん
07/09/27 21:03:11
Javaもいい言語なのに、なぜか使ってるやつはカスばかり。
不思議だよねぇ。

517:デフォルトの名無しさん
07/09/27 21:05:59
> XMLデータ取ってきて、タグ排除して、生コーパスにして、インデキシング作成するならともかく・・・
馬鹿発見。

518:デフォルトの名無しさん
07/09/28 03:07:06
なんでも馬鹿馬鹿言えば良いものではない。
馬鹿の典型。

519:デフォルトの名無しさん
07/09/28 03:08:46
>>507
ちょw
それで共起取るのが俺の卒研ww
そしてその処理はCだがな。Rubyとか馬鹿言語は死んでも使わん。

520:Ruby
07/09/28 08:27:15
<馬鹿馬鹿言うなー!
   お前らより余程頭が良いわ!

と申しております。

521:デフォルトの名無しさん
07/09/28 09:27:26
>>519
ダメだこりゃ

522:デフォルトの名無しさん
07/09/28 10:18:21
XML意味ねえ

523:デフォルトの名無しさん
07/09/28 10:30:50
XMLは、単に元から提供されてるデータ構造でしょ。
わざわざXMLを選んでるんじゃなくて、元がその形式だからしょうがない。

多分、話がかみ合ってない人は、wikipediaのデータが、xml形式で提供されてるのを知らないんだろうな。
まぁ、そこからHTML化はありえないが・・・

524:デフォルトの名無しさん
07/09/28 10:33:52
>>519
よう俺
タグ外しは流石にperlの正規表現使ったけどな。Cって共起計算の方だよな?タグ外しまでCでやってるとかならテラアフォすw
XMLパーサー使えば、データだけ簡単に取れると思ってたら、ファイルサイズが巨大すぎてそもそもパーサーが読み込んでくれなかった罠・・・orz

525:デフォルトの名無しさん
07/09/28 10:40:51
rubyとかperlはCを使えないようなアホが使う言語
俺は死んでもあんなもん使わない

526:デフォルトの名無しさん
07/09/28 13:13:05
やりたい処理への向き不向きでプログラミング言語は使い分けるだろう。常考。


527:デフォルトの名無しさん
07/09/28 13:26:08
>>525
お前が一番アホ

528:デフォルトの名無しさん
07/09/28 23:17:58
>>527
Cを使いこなせない低脳乙w

529:デフォルトの名無しさん
07/09/28 23:37:38
            ∩_
           〈〈〈 ヽ
          〈⊃  }
   ∩___∩  |   |
   | ノ      ヽ !   !
  /  ●   ● |  /
  |    ( _●_)  ミ/ <こいつ最高にアホ
 彡、   |∪|  /
/ __  ヽノ /
(___)   /

530:デフォルトの名無しさん
07/09/28 23:43:34
URLリンク(www.premiumtv.12gbfree.com)

531:デフォルトの名無しさん
07/09/29 03:54:45
>>528

ruby = Cが使えない低脳

rubyがCで実装されていることをふまえて証明してくれ


532:デフォルトの名無しさん
07/09/29 04:36:51
機械言語処理を語るスレはここですか?

533:デフォルトの名無しさん
07/09/29 06:10:36
>531
それが何か意味のある事か?
perlを見たまえ

534:デフォルトの名無しさん
07/09/29 06:16:18
            ∩_
           〈〈〈 ヽ
          〈⊃  }
   ∩___∩  |   |
   | ノ      ヽ !   !
  /  ●   ● |  /
  |    ( _●_)  ミ/ <こいつ最高に低学歴
 彡、   |∪|  /
/ __  ヽノ /
(___)   /

535:デフォルトの名無しさん
07/09/29 10:57:58
            ∩_
           〈〈〈 ヽ
          〈⊃  }
   ∩___∩  |   |
   | ノ      ヽ !   !
  /  ●   ● |  /
  |    ( _●_)  ミ/ <こいつら最高だぜ!
 彡、   |∪|  /
/ __  ヽノ /
(___)   /

536:低学歴
07/09/29 14:08:52
よんだかー
技術で返せるなら付き合ってやるぞー
ちとヒマなんだ

537:Pustejovsky
07/09/30 20:40:30
Cで書かれたXMLパーサもしらねぇようなクズが、
自然言語そっちのけで低レベルな自作自演やってるなw

538:デフォルトの名無しさん
07/10/01 10:12:02
自然言語ってなに?

539:デフォルトの名無しさん
07/10/01 10:23:40
別に、Cじゃなくてもいいじゃん。

540:デフォルトの名無しさん
07/10/01 15:02:13
ソース見て思いましたが、自然言語処理って
必要なソース規模が意外に小さいですね

541:デフォルトの名無しさん
07/10/01 23:27:50
>>540
>必要なソース規模が意外に小さいですね
意味解析のソースのサイズはチェックした?

542:デフォルトの名無しさん
07/10/02 09:13:33
自然言語処理で、形態素解析とn-gramのことを指していました。
人工無脳用に自作可能か考えていました。

自然言語処理の意味解析はプログラミング言語(型や有効範囲)と比べて、
かなり複雑そうですね。

543:デフォルトの名無しさん
07/10/02 11:16:32
比べる対象があって小さいとか大きいと言えるんだと思うが

544:デフォルトの名無しさん
07/10/02 11:23:06
人間の経験則に基づく感覚だろう。
機械には真似が出来ない芸当だね!


545:デフォルトの名無しさん
07/10/02 11:24:44
形態素解析は1から作るとやる事が案外多いぞ。
基本的なことは簡単なんだが、前線で使われてるようなのは、かなり改良が加えられたり
新しい技術が入ってるから、それらを全て調べた上で、ベストなものを選んで取り入れるのは骨が折れる。

車輪の再開発以外の何物でもないから、自作はやめとけ。

546:デフォルトの名無しさん
07/10/02 11:41:58
>>545
対象を万葉集の短歌などに限定すれば、
形態素解析も良い課題だと思うが。

547:デフォルトの名無しさん
07/10/02 11:45:37
人口無能用っしょ?

548:デフォルトの名無しさん
07/10/02 17:32:03
人口無能って芸がないよな

万葉集って何?
とかすぐ聞く奴だろ?

549:デフォルトの名無しさん
07/10/02 17:55:09
それお前。

550:デフォルトの名無しさん
07/10/02 18:22:53
549ってアホ?

551:デフォルトの名無しさん
07/10/02 19:07:24
550は古今和歌集を知らないアホ

552:デフォルトの名無しさん
07/10/02 19:50:18
おーい551は人口無能だよー
ていうか無能だひょ

553:デフォルトの名無しさん
07/10/02 22:34:01
正解w

554:デフォルトの名無しさん
07/10/06 20:18:51
インサイダー情報で株式投資するか
極秘情報を横流しすれば小遣い稼ぎになるよ

555:デフォルトの名無しさん
07/10/07 17:32:17
犯罪

556:デフォルトの名無しさん
07/10/07 17:37:42
は?何でだよw

557:デフォルトの名無しさん
07/10/07 18:08:16
犯罪


558:デフォルトの名無しさん
07/10/07 18:09:24
は?何でだよw

559:デフォルトの名無しさん
07/10/07 18:36:33
クズめ

560:デフォルトの名無しさん
07/10/11 00:07:09
なんか糞スレ化してるなw
NAISTのヤツって変なヤツが多いんだな

561:デフォルトの名無しさん
07/10/11 01:03:33
全入だからしょうがない

562:デフォルトの名無しさん
07/10/11 20:04:03
学部ならともかく、大学院なんてどこも全入みたいなもんだろ


563:デフォルトの名無しさん
07/10/11 23:40:50
NAISTは「みたいなもの」じゃなくて本当の全入だから困る

564:デフォルトの名無しさん
07/10/14 18:07:54
そんなことないすと

565:デフォルトの名無しさん
07/10/14 22:52:57
NAISTって、妙にプライドだけ高い人増えたよね。
全入だし、人材はどんどんダメになって行ってるのに…。

Namazuの人やChasenの人の頃がピークだったが
所詮後が続かんよね。お得意のモジュール化も、出来る人材居なくて全然出てこないし。
目を付け出してそこそこ力入れだした国立大に、もはや勝ち目無い。

出来る人材は、こんな所より京大行くだろw

566:デフォルトの名無しさん
07/10/17 07:05:49
昔はChasenが業界標準だったけど
今はMeCabだよね~

JUMANなんか使ってる人いるの?

567:デフォルトの名無しさん
07/10/17 08:32:45
昔から使ってて変えられない(周辺ツール含めて)所はあるでしょ?

568:デフォルトの名無しさん
07/10/17 09:30:33
ねーよw

569:デフォルトの名無しさん
07/10/17 09:41:43
製品に組み込まれた、とかいう話を聞かないよね>>JUMAN

570:デフォルトの名無しさん
07/10/19 23:08:41
パーセプトロンエンジンってどう?

571:デフォルトの名無しさん
07/10/20 01:52:31
どうって?
何が聞きたいの

572:デフォルトの名無しさん
07/10/20 10:31:34
そこの人の論文出てないよね?

573:デフォルトの名無しさん
07/10/22 16:35:43
そもそもパーセプトロンとか言い出してるところが
なんかアレだなあ・・・

574:デフォルトの名無しさん
07/10/22 20:30:01
アレって何かね

575:デフォルトの名無しさん
07/10/22 21:54:40
ちくび

576:デフォルトの名無しさん
07/10/23 16:16:40
結局誰も知らないのかw

577:デフォルトの名無しさん
07/10/23 16:54:14
何を?

578:デフォルトの名無しさん
07/11/02 09:04:14
URLリンク(googlejapan.blogspot.com)

579:デフォルトの名無しさん
07/11/02 10:00:20
学部生の卒論にぴったり

580:デフォルトの名無しさん
07/11/02 12:57:42
> パ

あそこはさぁ、近年の研究成果無視で
ただ単に商売ッ気がたっぷりあるだけだろ。
元になったエンジンは、ちょっと使い物にならないレベルだった、
ってコアな人から聞いた。


581:デフォルトの名無しさん
07/11/02 13:16:39
コアな割には話が抽象的すぐる

582:デフォルトの名無しさん
07/11/02 13:52:28
え?なになに?
パーセプトロンエンジンのこと?

583:デフォルトの名無しさん
07/11/03 12:19:10
>>578
あれ?工藤さんって、googleに行ったんだっけ?
ずっとyahooに行ったと思ってたんだが・・・。

584:デフォルトの名無しさん
07/11/03 16:17:20
F2→やほおはたつを

585:デフォルトの名無しさん
07/11/06 00:43:32
>>578
グーグル太っ腹と思ったら、金取るんだよな。
やだやだ。オープンソースで、データーもみんなのWebなのに、
自分が作ったデーターは金取るんだぜ。

酷くない。

586:デフォルトの名無しさん
07/11/06 01:01:10
うん。
酷くない。

587:デフォルトの名無しさん
07/11/06 11:08:30
っていうか、勝手に人のサイトのデータ収集して売って良いの?
そこから生成された統計データなら灰色だとは思うけど、n-gramって事はガチで文字がそのまま入るんでしょ?
まずい単語が入ってたりしてそう

588:デフォルトの名無しさん
07/11/06 11:50:48
金とるから非難て…
こんなのタダみたいなもんだろ。

589:デフォルトの名無しさん
07/11/06 12:01:38
>>587
文字というか形態素n-grams (頻度20以上) だけど。
入ったらまずい単語って何?
イメージできんのだが。

590:デフォルトの名無しさん
07/11/06 13:17:00
>>589
おまんこ、でも検索結果が出た。ちょっちビックリ。

591:デフォルトの名無しさん
07/11/06 13:22:28
卑猥な言葉だろうが差別用語だろうがテレビじゃないんだから別に問題ねーだろ。
固有名詞はアレだがどうせアノニマイズくらいしてるだろ。

592:デフォルトの名無しさん
07/11/08 20:09:23
小泉潤一郎、とかもあるかな

593:デフォルトの名無しさん
07/11/09 18:18:15
肖像権?の問題か?

594:デフォルトの名無しさん
07/11/10 16:27:29
□が□に□した

こんな風に穴抜きパターンを考えたら
入れ替わりが多いだけでパターン数は
そう多くないと思った

595:デフォルトの名無しさん
07/11/10 19:44:46
構文解析と何が違うんだ?

596:デフォルトの名無しさん
07/11/14 00:09:15
>>587
>っていうか、勝手に人のサイトのデータ収集して売って良いの?
短くても、短歌や俳句は著作権上<1作品>と認められるから、
著作権の切れていない作品を著作権者に無断で配布するのは、
有料でも無料でも違法。Googleのn-gramは、多分、使用頻度
が極端に低いものを削除しているはずなので、短歌や俳句1作品
が入ってくる可能性は極めて低いはず。

597:デフォルトの名無しさん
07/11/22 05:41:28
日記やブログは著作物にはならんの?

まぁ、それ言い出したらイメージ検索なんて、完全にアウトな気がするが・・・w

598:デフォルトの名無しさん
07/11/24 12:19:54
著作権法の引用じゃないか?引用元のURLは乗せてるから

599:デフォルトの名無しさん
07/11/25 21:57:43
>>597
>日記やブログは著作物にはならんの?
「今日は本当に死ぬほど暑かった。」などという、
多くの人が使用するような表現には、著作権は
ない。Googleのn-gramsは他人のWebから無断で
このような使用頻度の高い表現を抜き出して、無
断で売っているのだが、元の表現に著作権がない
からOK。

600:デフォルトの名無しさん
07/12/02 03:57:18
そういえば俺が初めてプログラミングに触れたのは
自然言語処理がやりたいからって理由だったんだが
このスレ見てたら何だか悲しくなってきた...

601:デフォルトの名無しさん
07/12/02 04:14:15
同感

602:デフォルトの名無しさん
07/12/02 07:03:50
俺の自然言語処理の走りは、中学時代にハマった「えんいー」
('A`)
ごめんなさい。崇高な意志の方々。

今じゃそんな事も忘れて
何かに追われるように
毎日文字列処理してる。

意味処理?俺にはムーリ。
国語出来ません。英語読めません。
文法判りません。分類出来ません。
統計判りません。根気ありません。
プログラミングだけは出来ます。

\(^o^)/オタワー

603:デフォルトの名無しさん
07/12/02 08:12:55
工学出身のヤツはそんなもん。
プログラマが根気無いのは普通。だから賢くやるんだろ。

統計だけはがんばっとけ。って言うか統計が判らないってのがわからん。
対象を知れば、自ずと適用すべき統計モデルはわかってくるでしょ?
統計モデルを知らんって話だったら、類似した研究の論文を読めとしか・・・。
ああ、ここで根気は必要だな。。。

604:デフォルトの名無しさん
07/12/03 04:29:08
>>602
>俺の自然言語処理の走りは、中学時代にハマった「えんいー」
安心しろw
俺も同じだ。っていうか人工無能系にハマって始めたやつって結構居るぞ。
人間の小さい頃の発端なんて、みんなそんなもんでしょ。
むしろ、なんか判らんけどこの道に入っちゃった人の方が哀れと言うか、計画性ナス。

605:デフォルトの名無しさん
07/12/03 13:09:12
なんで哀れなの?
勝ち組じゃないの?

606:デフォルトの名無しさん
07/12/03 13:47:46
ジャストシステムに入るくらいしかないでしょ

607:デフォルトの名無しさん
07/12/03 13:55:25
NTTとかIBMは?
ヤフー、マイクロソフト、グーグルあたりとか。
ミクシィみたいなベンチャーとか。

608:デフォルトの名無しさん
07/12/03 14:28:27
なんか判らんけど入っちゃったって人にとって
その辺は大手過ぎてハードル高いっしょ。
手ごろな企業が無い。

609:デフォルトの名無しさん
07/12/03 18:33:18
自分で新しいことやってやろうって漢はいないの?

610:デフォルトの名無しさん
07/12/04 06:33:47
質問です。
SuffixTree⇔パトリシア Trie
SuffixArray⇔PAT Array
この違いが未だにわからないんですが
同じものなんですか?
資料によって書いてる事が違ってて、
すげぇ混乱してるんですけど。


611:デフォルトの名無しさん
07/12/04 08:44:49
>>610
お前去年も同じ事どっかに書いてなかったか?
その2つの違いは派閥だよ。
たまにSuffixTreeの圧縮したものがパトリシアとか書かれてるのがあるが
あれは、SuffixArrayの勘違い。
結論言うと、同じ。

612:デフォルトの名無しさん
07/12/04 14:34:47
ちげーよ

613:デフォルトの名無しさん
07/12/04 22:34:17
ググって見ると、サイトによって
パトリシアトライは、トライの分岐してないノードを消して
圧縮するものである。って主張と
SuffixTreeと同じものである。って主張の2つが存在するなw

多分原因は、長尾氏の
URLリンク(www.amazon.co.jp)
この本では前者が書いてあって
北・辻井両氏の
URLリンク(www.amazon.co.jp)
この本では、パトリシアTrieの説明で、SuffixTreeの
説明が図付きで書いてあるからだと思う。
どっちの教科書で勉強したかで、全然違う理解になってるはず。

614:デフォルトの名無しさん
07/12/05 08:37:37
>>613
ネットは嘘が多いからな。
本の内容も信用できない。
元論文読んで自分で理解しないとダメだな。

615:デフォルトの名無しさん
07/12/05 18:03:49
辻井がボケかましたってこと?

長尾タンを信じてればいいの?

616:デフォルトの名無しさん
07/12/05 23:57:28
北・辻井本のパトリシアTrieの説明って何ページ?
索引に出てないんだが。

617:デフォルトの名無しさん
07/12/06 01:40:38
p.179~
普通にあってる。
PATトライとSuffixArrayが同じものとして書かれてるところを
読んだ人が勘違いしてるだけのような・・・。


618:617
07/12/06 01:41:21
間違えた。
PATトライ→PATアレイ


619:デフォルトの名無しさん
07/12/06 07:45:07
じゃあゆとり乙ってこと?

620:デフォルトの名無しさん
07/12/06 09:40:53
元論文読まずに最初に教科書で勘違いしたヤツが出る
→教科書すら読まないやつが、そいつが書いた資料を見る
→その資料をry

どうせこんな感じの魔の連鎖が発生したと思われ。
しょぼい論文でも勘違いしてるのたまに見るしな。
そもそもトライとSuffixTreeのデータ構造そのものは同じで
登録の方法が違う程度だから、トライ関連の改良の紛らわしい
サーベイ論文読んで、勘違いする人が続出なんだろう。

621:デフォルトの名無しさん
07/12/06 09:55:38
このスレ以外で間違えてる人見たことないけどな。

622:デフォルトの名無しさん
07/12/06 10:04:49
個人ブログを挙げるのはアレなんだけど
たまに見るぞ。

623:デフォルトの名無しさん
07/12/06 18:06:42
トライは一個で派生があるだけって感じ?

624:デフォルトの名無しさん
07/12/06 21:44:04
1 名前: 諸君、帰ってきたで?φ ★ Mail: 投稿日: 2007/12/06(木) 21:28:02 ID: ???0
 米マイクロソフトがクリスマスシーズンの子供向けに、自動応答形式で行っていた
サンタクロースとのチャット・サービスをめぐり、「特定のメッセージを送ると、わいせつな
内容の応答が返ってくる」との指摘が寄せられ、同社は5日までに、このサービスを
停止した。

625:デフォルトの名無しさん
07/12/07 14:31:17
【特許】ワープロの仮名漢字変換技術は23万円?・・発明者が東芝に対価2億6千万円請求
スレリンク(newsplus板)l50

この人知らない

626:デフォルトの名無しさん
07/12/07 21:59:37
会った事は無いが先輩だな

627:デフォルトの名無しさん
07/12/17 13:40:18
>>112の「言語と計算 (4) 確率的言語モデル」読んでるんだけど、
9ページ10行目の「最小となるのはx1, ... , xnのうちの1つが…」ってのは
P(x1), ... P(xn)の間違いだよね?一応確認。

628:デフォルトの名無しさん
07/12/17 14:41:13
NAIST Japanese Dictionary
URLリンク(sourceforge.jp)
形態素解析用辞書 IPADIC の ICOT 条項をクリアするとともに表記ゆれ情報、複合語情報を付与した辞書の公開

629:デフォルトの名無しさん
07/12/31 15:20:04
>>624
自動応答システムってこんなんばっか・・・

630:デフォルトの名無しさん
08/01/04 02:27:01
自然言語処理、全く分からないんですが、日本語の誤字を自動検出するようなプログラムって作れないでしょうか?
また、自作でなくとも公開されている何かがあって、利用できると言うのならば構いません。

現在、フリーのWEBサーバーisweb上で動く、誤字自動検出CGI、もしくはAppletのようなものが作れないかと考えております。
どなたか、よい参考書、ないし、よいツールをご存知の方がいらっしゃいましたら教えてください。
よろしくお願いいたします。

631:デフォルトの名無しさん
08/01/04 02:46:39
誤字?
タイポの事?それとも紙に書いた字が間違ってる方?

字が間違ってるのを判別するのは無理だけど
より出現確率の高い候補を提示するようなのは出来る。

単語の確率を漠然と見るのではなく、単語の種類(例えば品詞)が
bi-gramで見たときに、より良い品詞の遷移があるものを選べばよい。

とりあえず、難しい事考えずに結果を出したいなら
適当なニューラルネットワークのプログラムを拾ってきて
学習させればいいんじゃないか?

632:デフォルトの名無しさん
08/01/04 02:52:31
>>630
お前には無理。
超えるべき壁が山ほどある。
っていうかそういうプログラムあるんだから拾ってこいよ。
それすらググれないようでは、話にならん。

633:デフォルトの名無しさん
08/01/04 07:41:50
>>632
お前には聞いてないからw
知らないなら素直に知らないって言えよ、お馬鹿さんwww

634:デフォルトの名無しさん
08/01/04 13:08:07
妥当な評価だと思うがな。
まぜっかえされるのが嫌なら2chなんかで質問しないだろうし。
何を書こうがあるいは書くまいが自由。

635:デフォルトの名無しさん
08/01/04 16:22:17
ちなみに>>631の前者は、大体学部の卒研レベルの話なので
素人でも頑張れば出来なくも無いが、即席を求めるなら後者をお勧め。
既に形態素解析が行える状態で、
common prefix searchとMarkovModelがわかるなら、問題ないが…。
前者を行うなら、まぁ勉強するこった。
どの道この程度の手法だと、どっちでやってもたいした結果が出ないので…。

636:デフォルトの名無しさん
08/01/05 02:56:37
>>631
全然話がわからない。
ちゃんとした方法はないの?

637:デフォルトの名無しさん
08/01/05 06:22:42
>>636
やっぱりお前には無理。

638:デフォルトの名無しさん
08/01/05 13:08:48
>>637
自分の能力を疑ってみることも大切だよ。

639:デフォルトの名無しさん
08/01/05 14:06:49
>>638
もうちょっと上手いことやらないと、釣れるものも釣れなくなっちゃうよ。
話題がないスレなんだしさじ加減を間違えなければそれなりに釣れてただろうに、惜しいことしたね。

640:デフォルトの名無しさん
08/01/05 14:56:42
>>639
保険かけるのかっこ悪いね

641:デフォルトの名無しさん
08/01/05 22:15:13
>>636
あほかw
それすらわからなくて、もっとちゃんとした方法をとろうとしてるのか?
今のお前には、知識的に無理、計算量的に無理、(開発)時間的に無理だと思われ。

普通に一般的な方法なんだが、お前がちゃんとした方法を自分で考えれるなら
勝手にすればいいじゃん。そんな奴がここで聞くとは思えないがな。

642:デフォルトの名無しさん
08/01/05 22:18:42
質問するときはトリップつけたほうがいいよね

643:デフォルトの名無しさん
08/01/05 23:26:55
ドコモの携帯にATRで開発した音声入力の翻訳機能がつくらしいんだけど、だれか使ったことある?

644:デフォルトの名無しさん
08/01/05 23:42:56
TOEIC600程度ってニュースで言ってた奴?
自分でしゃべったほうがマシそうなんだが

645:デフォルトの名無しさん
08/01/06 00:19:12
NECとの共同研究のだよな。
あれ使い物にならんぞ・・・。

何とか形にした感じだけど、おそらく製品になっても
玩具程度だと思われ。

そもそも、音声入力自体が、全然まともに出来上がってないw
次に、分かち書きが基本的に不可能に近い。理論的には文字での方法と同じだが
現実は遠くかけ離れてる。

あと、最近のATRって確実に質堕ちてるよな?

646:デフォルトの名無しさん
08/01/06 03:49:14
ATRはそりゃ落ちてるだろうな、最近なんか随分出来の悪い人材が行ってる気がする。
昔は東大・京大ばっかだったのにな。
京阪奈周辺の大学の教授が自分ん所の学生送り込んでたが、優秀な人材はみんな企業行っちまうから…

647:デフォルトの名無しさん
08/01/06 05:10:57
NAISTの馬鹿が行ってるくらいだからなぁ

648:デフォルトの名無しさん
08/01/06 06:33:26
完全に人材不足だからなぁ…。
加えて、マネージメントやってるNICTが国会で槍玉に挙がったもんだから、色々絶望的だよ。
NAISTの人間ですら今じゃGoogleやYahooやNTTに行くもん。あんな所誰が行くんだよw

649:デフォルトの名無しさん
08/01/06 08:21:15
なんでNAISTってこんなに馬鹿にされてんの?w
そりゃあ、東大・京大と比べられたらどうしようもないんだろうけど。

650:デフォルトの名無しさん
08/01/06 14:46:21
全入だからでしょ
やってることのレベルで馬鹿にされてるわけじゃないと思う

651:デフォルトの名無しさん
08/01/06 16:59:26
馬鹿にするならせめてより優れたものを作ってからにしようや

652:デフォルトの名無しさん
08/01/06 17:20:47
NAISTに優れたものなんてあったっけ?
売りの辞書も、構造が随分時代遅れで、東大・京大よりレベル低いし。
NAISTにEnjuのようなものが作れるとは思えん。

653:デフォルトの名無しさん
08/01/06 17:23:51
知らんくせに馬鹿にしてのか
最低だな

654:デフォルトの名無しさん
08/01/06 17:29:32
学生のレベルが低いからなあ

655:デフォルトの名無しさん
08/01/07 15:53:52
nlpに限っては
山下、工藤らが在籍していた前後がピークだよね

656:デフォルトの名無しさん
08/01/08 09:29:51
彼らは、既存の積み重ねの成果を実装しただけで
実際に偉いのは、彼らの先輩の構築したもの。
運と時期が良かっただけ。Googleの登場時期も良かった。
言っちゃあ悪いが、単なる実装屋さんだよ。そのくせ、その辺の専門卒プログラマより質は悪いし。

ま、工学の分野は作ったものが偉いってのも確かなんだがな。

657:デフォルトの名無しさん
08/01/08 18:00:29
NAIST批判が多いね

658:デフォルトの名無しさん
08/01/08 22:27:07
批判すればそれを超えたつもりになれる患者さん達

659:デフォルトの名無しさん
08/01/09 00:02:50
>>656はNAISTの蓄積は評価してるように見えるが…
あとは、それを実際に世に出した、k_takuとたつをも評価してるし
案外まっとうな意見じゃないかと。

660:デフォルトの名無しさん
08/01/10 10:12:31
今後も蓄積だけでやっていくつもりかな

661:デフォルトの名無しさん
08/01/12 19:13:01
工藤がただの実装屋って…
ここの連中は論文も読めんのか

662:デフォルトの名無しさん
08/01/13 00:24:44
サーベイばっかだろ。
元論文読んだ事無いってオチじゃないだろうな?

663:デフォルトの名無しさん
08/01/13 15:20:57
やっぱり研究者は批判されて一人前ってことか。
東大・京大がすごいと言われているようだけど、
(実際凄いとは思うが)個人名は出てこないもんな。

664:デフォルトの名無しさん
08/01/13 20:25:00
工藤山下あたりは単なるエンジニアじゃなくてサイエンティストだろ
高林はエンジニアよりだけど

665:デフォルトの名無しさん
08/01/13 20:43:12
奈良先は学生が足を引っ張ってるからな、残念だ

666:デフォルトの名無しさん
08/01/14 05:45:29
>>664
そんなに有名な理論系の論文出してるか?
基本的に既存の理論の実装を中心にやってると思うが…。
PATアレイやら、ダブル配列やら、CRFやら、形態素解析やら。

>>665
学生がって・・・。
学生以外居ないだろ。学校なんだから。
大学院大学だから、学部生が居るわけでもあるまいし。




667:デフォルトの名無しさん
08/01/14 10:00:05
論文読めよ

668:デフォルトの名無しさん
08/01/14 10:30:08
>>628 ってその後どうなったのかな
↓日記が見られないから経緯が良く分からんです

URLリンク(groups.google.com)

669:デフォルトの名無しさん
08/01/14 10:46:18
>>666
何もやってないってのがわからないのが今のNAISTの学生。
なんか、それっぽい事してるからだまされるだけで
基本的に彼らのやってるのは、既存の実装技術の欠陥を、あまり注目されてない理論で改良してるだけ。
他の研究者の着眼点が悪いのか、それともそもそも研究者がやるべきことじゃないから目を当てないのかは知らないけどな。

670:デフォルトの名無しさん
08/01/14 11:23:33
NAIST叩きスレになっててワロスw
別に、そんな叩くほどの価値があるわけでもなく
何らかの理論に対しての論争をするまでも無いレベルなのに
何やってるんだ。

理論が叩かれてるとかなら、有る意味「叩かれてこそ」って言えるけど
そういうレベルの議論でもなさそうだし。馬鹿だなぁ。お前らも。

671:デフォルトの名無しさん
08/01/14 14:41:20
理論も持ち出さずに叩くからただの妬み嫉みにしか見えない。
NAISTがろくな研究してないっていうなら会議なり論文なりで否定して見せろよ。

672:デフォルトの名無しさん
08/01/14 15:11:59
だから、そういう議論をするようなレベルの学校じゃないって事でしょ。
会議や論文で叩くにも、相手が何も理論を作ってなきゃやりようがない罠

まさにその話自体が本末転倒


次ページ
最新レス表示
レスジャンプ
類似スレ一覧
スレッドの検索
話題のニュース
おまかせリスト
オプション
しおりを挟む
スレッドに書込
スレッドの一覧
暇つぶし2ch