21/08/30 21:56:49.19 t9q3RQuP0.net
>>955
ビッグデータ処理してると数パーセントの精度の違いが大きく出てくるから
なるべく高精度のが欲しい
986:デフォルトの名無しさん
21/08/30 21:59:20.42 t9q3RQuP0.net
松尾研の要約システム、ひどいな
987:デフォルトの名無しさん
21/08/30 22:00:46.32 FcBMjYja0.net
精度が売上に直結するならいいけど
弱い相関ならシンプルなロジック選んでしまうな
988:デフォルトの名無しさん
21/08/30 22:13:34.30 IfLgW1Xz0.net
40年以上前から言われているけど
何文字以内、何行以下の要約というのは
あまり意味がない。必須な部分がかけてしまうかもしれないし
余分な部分が残ってしまうことがある
989:デフォルトの名無しさん
21/08/30 22:23:27.16 6Ldth3Lh0.net
愚痴みたいになるけど形態素解析とかIMEみたいな古典的な分野ばっかやりすぎて
統計的機械学習やディープラーニングへの対応が遅れて
世界に取り残されたのが日本の自然言語処理のアカデミアってイメージ
アテンションやトランスフォーマーみたいな仕組みが
日本から出てこなかったのは悲しい
990:デフォルトの名無しさん
21/08/30 23:06:53.06 DbDPNUf30.net
>>957
それなら古いからじゃなくて必要な精度を得られないからってことで
精度に関わる他の部分を変えることで目的を達成できるかも
何がその目的達成に影響するのかは判らない
991:デフォルトの名無しさん
21/08/31 04:15:10.73 D+Jl3XmV0.net
>>950
spaCyかな。利点はGPUを使えるので圧倒的に早いこと。欠点はPython依存。
992:デフォルトの名無しさん
21/08/31 04:39:38.87 D+Jl3XmV0.net
>>958
個人的にはあれはよくできてると思う。
まず、要約はextraction法とabstraction法の2種類がある。
extractionはbowを作って単語の頻出度で統計処理することでウェイトの高いセンテンスを抽出する。
一方、abstractionは要約済みの学習データをseq2seqで機械学習させることで、要約エンジンを作る。
松尾研のベンチャーが作ったのは、後者のabstractionの方で、日本語でabstractiono方式の要約エンジン
というのはほとんど見たことがない。
ただ、実際に売れるかどうかは別。
この種のシステムは、を企業向けに販売しようと思ってもクラウドでAPIで提供する方式の場合だと
企業は内部情報が外部に流出することになるのでまず100%導入はしない。
一般的なのは、企業が利用してるクラウドの中にシステム用のサーバーを立ち上げるか、
企業のイントラネットの中に専用サーバーを立ち上げることなんだが、
これをやるとSI業者には勝てない。
また、下手にこの領域に踏み込むとSI 業者が海外製の要約エンジンを日本語化して販売
を始めたりするので、敵を誘い込むことになる。
993:デフォルトの名無しさん
21/08/31 07:41:34.77 vHl4DeHq0.net
>この種のシステムは、を企業向けに販売しようと思ってもクラウドでAPIで提供する方式の場合だと
>企業は内部情報が外部に流出することになるのでまず100%導入はしない。
用途で言えば内部情報より外部の公開情報を要約してリサーチ等に使う方が多そうな気がするが。
そうでなくても、契約文書をチェックするサービスなんてのも商売になっているくらいだし。
994:デフォルトの名無しさん
21/08/31 14:21:53.09 Sht6cbMy0.net
optunaで指定するパラメータの範囲はどう決めれば良いの?
apiにパラメータの取りうる範囲が1 <= p < ∞とあるとき
995:デフォルトの名無しさん
21/08/31 15:50:48.02 j/ruVWceM.net
1と∞で二分探索
996:デフォルトの名無しさん
21/08/31 19:28:12.45 l6anRrPu0.net
無限の半分は・・・無限!!
997:デフォルトの名無しさん
21/08/31 19:30:49.23 IiAPjlBZ0.net
>>966
無限大に発散するような関数はまずないはずだけどどういう式?
998:id:ignore
21/08/31 20:06:05.81 Yj2FMtNrr.net
exp
999:デフォルトの名無しさん
21/08/31 20:07:05.73 TL2gsmuJ0.net
表からともったら裏、裏かとと思ったら表
1000:デフォルトの名無しさん
21/08/31 20:56:01.05 Sht6cbMy0.net
>>969
xgboostのパラメータ
reg_alphaとか
1001:デフォルトの名無しさん
21/09/04 02:49:35.61 9cArpdYt0.net
>>877
Rejected internal applicants twice as likely to quit
doi.org/10.5465/amj.2018.1015
1002:デフォルトの名無しさん
21/09/04 04:02:08.87 9cArpdYt0.net
>>965
いずれにしてもSeqモデルによる実装は簡単だから、要約済みの学習データさえ準備できれば
要約システムは簡単に構築可能。無料で出す分にはみんなは面白がって使うだろうけど、有料提供
となると、かなり困難に直面するんじゃないかと思っただけ。
Seqモデルは、かなり一般化してきてるので、NLP専攻の学卒者だったら、十分に構築は可能。
これが機械翻訳とかだと、かなり膨大な学習データが必要となるので、参入障壁になるが、
自動要約だと、元の学習量もしれてるので、NTTデータや富士通あたりだと多分、簡単に作れる。
また、要約の精度は学習データに依存するので、どこまで精度の高いデータを作れるかは、
最終的には開発元の資本力によって決まることになる。
1003:デフォルトの名無しさん
21/09/05 22:01:26.67 zykEaDwPr.net
松尾研で文章を3つの文にまとめるアプリができてましたが
これを任意の文の数にまとめられて更に
「動作を文章にするアプリ」と組み合わせることで作業手順書の自動作成ができて
ひいては行動計画に関する人工知能の開発が進むといいんですがねえ
1004:デフォルトの名無しさん
21/09/05 22:33:17.49 vgQPhGSA0.net
どうして文の「数」にこだわるの?
重要なことがその「数」以上あったらどうするの?
1005:デフォルトの名無しさん
21/09/06 01:15:14.50 otQfwK4Sr.net
3つにする、5つにする、など試して最も妥当な説明書になっているものを最終出力出来たらいいんですがねえ
1006:デフォルトの名無しさん
21/09/06 01:21:37.13 owoO2Yj90.net
妥当な説明を定式化せよ
1007:デフォルトの名無しさん
21/09/06 08:50:13.28 0zGOZ0ajM.net
>>975
できるんじゃない?
1008:デフォルトの名無しさん
21/09/06 09:29:44.52 fsHJbGHja.net
重要な項目が5つあって、3つの文にせよ
という場合は、一つの文に2つ盛り込むとか?
なんだか本末転倒だなあ
重要な項目がいくつあるか分からなくなるじゃないの
1009:デフォルトの名無しさん
21/09/06 10:59:46.00 fK8LC2SFr.net
重要な項目の数に合わせて文の数も調整できたらなあ
更にはそれぞれの文の構造化まで自動化
1010:デフォルトの名無しさん
21/09/06 11:36:22.35
1011:fsHJbGHja.net
1012:デフォルトの名無しさん
21/09/06 16:50:04.99 XuYnRkl0M.net
ほう、そうかい
1013:デフォルトの名無しさん
21/09/06 21:34:45.15 3OGE1cne0.net
マニュアルを要約して
手順を飛ばされてもやだな
1014:デフォルトの名無しさん
21/09/07 08:21:33.30 QjyEMXOy0.net
だが待って欲しい
その手順は本当に必要だったのだろうか
1015:デフォルトの名無しさん
21/09/07 09:23:15.96 IHJavDsS0.net
いやちょっと待って欲しい
そもそも三つの文に…
1016:デフォルトの名無しさん
21/09/07 12:15:41.45 X6g3xS9u0.net
富士通あたりがやり出しそう(笑)
1017:デフォルトの名無しさん
21/09/07 13:03:13.11 oZHnA/lFa.net
試しにここのテキスト入れてみたら
めちゃくちゃ的外れな要約が出てきた
どうやら掲示板は向いてないらしい
1018:デフォルトの名無しさん
21/09/07 20:01:11.19 Cp1uuQsT0.net
新聞記事も読み終わって何がなんだかわからない
という記事が多いから、要約しても無駄だな
1019:デフォルトの名無しさん
21/09/12 11:08:30.42 PNU8wIel0.net
> お前は毎朝起きるたびに俺に負けたことを思い出すよ^^
あー、ホンッとに思い出すなあ(笑)
キチガイの嘘つきの低レベルFランの、
朝鮮ゴキブリBot君は、
チョン独特の「なにもできないけど俺のほうがジャップより偉い!」的な
ことはよーくわかったよ。
ホントなにもできない朝鮮ゴキブリBot君!
クソチョンw
1020:デフォルトの名無しさん
21/09/22 19:51:03.76 pNoEEii80.net
リッジとラッソ回帰をうまく説明するためのデータセットて何かある?
勉強会の資料で探すてる
ボストンの住宅価格でやると効果わかりにくいからその他でいいのおすえて
1021:デフォルトの名無しさん
21/09/23 12:44:23.64 7tGJmFKPF.net
次スレここの再利用?
スレリンク(tech板)
1022:デフォルトの名無しさん
21/09/26 01:33:41.18 fnXwjiVa0.net
次スレ
【統計分析】機械学習・データマイニング31
スレリンク(tech板)
1023:デフォルトの名無しさん
21/09/26 01:34:31.80 fnXwjiVa0.net
スカラー倍
1024:デフォルトの名無しさん
21/09/26 01:36:40.35 fnXwjiVa0.net
みっつの数に意味はない
ただの経験則
1025:デフォルトの名無しさん
21/09/26 01:41:50.83 fnXwjiVa0.net
アルタナティブ
1026:デフォルトの名無しさん
21/09/26 01:42:53.67 fnXwjiVa0.net
🉑
1027:デフォルトの名無しさん
21/09/26 01:44:07.46 fnXwjiVa0.net
(*´∀`*)
1028:デフォルトの名無しさん
21/09/26 01:44:53.74 fnXwjiVa0.net
(*´∀`*)
1029:デフォルトの名無しさん
21/09/26 01:45:22.39 fnXwjiVa0.net
(*´∀`*)
1030:1001
Over 1000 Thread.net
このスレッドは1000を超えました。
新しいスレッドを立ててください。
life time: 267日 16時間 34分 27秒
1031:過去ログ ★
[過去ログ]
■ このスレッドは過去ログ倉庫に格納されています