せめてKincet SDK1.5のサンプルぐらいは動かしておこうと思ったら、嵌ったので、メモ。
嵌ったデモ名:
「Speech Basics」とかの音声認識系デモアプリ。
症状:
"could not find kinect speech recognizer"などと表示されて、recognizerが無いからインストールを確認しろと言われる(エラーの文言はD2DかWPFで微妙に違うけど言っている意味は同じ)。
原因と思われるもの:
SDK beta時代にインストールしたSpeech RecognitionのLanguage Pack(en-US)が残っていて、SDKインストール時に、新しいものがインストールされなかった。
Speech Recognition SDK本体はKinect SDKインストール時に消せと言ってくれたのに ><
対処:
Language Packだけ入れ直す方法が分からなかったので、古いLanguage PackとKincet SDKすべて一度アンインストールした後、SDKを入れ直した。無事新しいLanguage Pack(en-US)がインストールされていた。
デモアプリを起動したら、エラー文言が消えて、音声認識が出来るようになった。ForwardとBackがしょっちゅう間違えられるような、自分の英語力のひどさはまた別問題。
根本原因はSDK1.0を触っていなかった、なので、ここで嵌る人はほとんどいないのだろうと思われ。
SyntaxHighlighter
2012-05-27
2012-05-24
KinectのHuman Interface Guidelines
Kinect for Windows1.5がリリースされたみたいで、その中にHuman Interface Guidelinesというドキュメントが気になったので、開発文書読む前に、読んでみるという、また天の邪鬼な事をしてみた。
書いてある事は(開発、非開発問わず)Kinectを使ったことのある人なら大体受け入れられるような気がします。英語だけだと何言っているか分からなくても、絵が豊富なので何となく分かります。具体的な解決法や決まり事が事細かに書いてあるわけではなくて、あくまで作り方の指針が述べられている感じです。
構成として、
ぱらぱら見ていて気になった事をメモっておくと(ドキュメントに書いてある事はもっと多いです。あくまで自分が気になった事です)
この辺もGUIやマルチタッチインターフェイスのように具体的なインターフェイスの部品が揃ってくると、より広まるのだろうなあと思います。
それよりも早くSDK本体を触れ、ってかんじですけど。
書いてある事は(開発、非開発問わず)Kinectを使ったことのある人なら大体受け入れられるような気がします。英語だけだと何言っているか分からなくても、絵が豊富なので何となく分かります。具体的な解決法や決まり事が事細かに書いてあるわけではなくて、あくまで作り方の指針が述べられている感じです。
構成として、
- 原則
- NUIデザイン全般に言える考え方
- 個々の具体的なインターフェイスに対する指針
- その他話題(音声とジェスチャーの組み合わせとか、複数人の扱いとか)
ぱらぱら見ていて気になった事をメモっておくと(ドキュメントに書いてある事はもっと多いです。あくまで自分が気になった事です)
- インタラクションはシンプルに、簡単に学べるものにすべき。常にユーザに今何が起こっているかフィードバックを返す。
- ユーザテスト重要
- 設計→テスト→評価→再設計→。。。の繰り返しが必要
- KinectゲームUIとKincetアプリケーションUIは同じではない
- 異なる入力装置のためにデザインされたUI(キーボードとか)を直接適用してはだめ
- 他の入力装置と違って、ユーザの意図を計るのが難しい
- その動作は入力を意図した動作なのか??
- ユーザの意図した事が行われているかフィードバックをする
- 一言で動作と言っても人によってその動作は異なる
- ジェスチャーと音声を組み合わせると、複雑な動作が削減出来る
- 例:写真を送るタスク マウス等の場合、写真選択→送信コマンド選択。vs. ジェスチャーで写真選択するとともに音声で送信コマンド選択(こっちの方が動きは少ない)。
- 人が複数いる場合
- 誰か一人だけの動作を受け付ける
- 複数の人の動作を受け付ける。音声、ジェスチャーを正しく結びつけるのが難しい
この辺もGUIやマルチタッチインターフェイスのように具体的なインターフェイスの部品が揃ってくると、より広まるのだろうなあと思います。
それよりも早くSDK本体を触れ、ってかんじですけど。
2012-02-23
なんちゃって赤外線カメラで
Wiredで暗視ゴーグルを通して「Kinect」を見る、という記事を見て、自分がかつて工作した赤外線カメラ(LogicoolのWebCamにIRフィルタを張っただけ)を使っても見えるんじゃないかと、試した結果が下記の写真。電気を消した状態で、Kinectを起動させて壁側に向けて、工作した赤外線カメラをKinctとほぼ同位置から壁に向けて撮りました。
上記記事のようなきれいな斑点はさすがに見えない。でもなんか不思議なパターンが出てるんだなあというぐらいは分かります。それだけです。
すでにほかでもいろいろやられているので、いまさら珍しくもないのだけど。
まあ。思わぬところで昔の工作が生きた(?)と。。。
上記記事のようなきれいな斑点はさすがに見えない。でもなんか不思議なパターンが出てるんだなあというぐらいは分かります。それだけです。
すでにほかでもいろいろやられているので、いまさら珍しくもないのだけど。
まあ。思わぬところで昔の工作が生きた(?)と。。。
2012-01-21
Kinect & Violin
https://bitbucket.org/ffuyyo/violin_kinect/overview
なんてものを書いてみました。
KinectのSkeleton Trackingを使ったものは世の中的に結構あるのだけど、折角カメラセンサとマイクが一緒についているデバイスなので両方使うようなものを作ってみたかったのでした。
何故よりによってバイオリンか?というと、自分がバイオリンを習っているから。。。(教室に通い始めて早2年)
やってみて分かったのですが、音を扱うのは難しいです。Skeleton Trackingのように直感的でもないし、処理も原始的なことしかやっていないので(て言うか、音声処理の専門家の方に見られたら、使い方がなってないと怒られそう・・・)、あんまりランダムに色を変えたりするのとさほど変わらない気もしてます。やっぱり音声認識以外は使いどころが難しいのかしら。
Skeleton TrackingのHeadを使って、顔を隠してプライバシーにも配慮してますが、自分の部屋の汚さと、バイオリンの下手さ具合(特に弓の動き、酷過ぎ!!)は筒抜けなのです・・・。
世の中的に(個人で出来る範囲では)やり尽された感を感じなくもないし、Kinectだけ知ってても面白いのは作れないということを感じるので、そろそろKinect以外の別のことも遊ぼうかなあ、、、
なんてものを書いてみました。
動作には、Kinect SDK beta2とFFTするためにAForgeというライブラリを使用しています。
何故よりによってバイオリンか?というと、自分がバイオリンを習っているから。。。(教室に通い始めて早2年)
Kinectのカメラ上で左右逆に映っているだけで、決して左右逆に持っているわけではないのです
基本的な動作は右腕の肘と手首と肩の角度をみることで、弓の上下動作をトラッキングしている、ということにしています。上下運動が変化する時に、四角形やら丸の図形を表示させています。
また同時にマイクから音を拾って、FFTの値が一番大きい周波数の値に応じて図形の色を変化させています。周波数は変化もトラッキングして、変化すると5角形の図形が表示させているいるつもりですが、遠くから見ると四角形も円も5角形も似たような形なのでした。。。
やってみて分かったのですが、音を扱うのは難しいです。Skeleton Trackingのように直感的でもないし、処理も原始的なことしかやっていないので(て言うか、音声処理の専門家の方に見られたら、使い方がなってないと怒られそう・・・)、あんまりランダムに色を変えたりするのとさほど変わらない気もしてます。やっぱり音声認識以外は使いどころが難しいのかしら。
Skeleton TrackingのHeadを使って、顔を隠してプライバシーにも配慮してますが、自分の部屋の汚さと、バイオリンの下手さ具合(特に弓の動き、酷過ぎ!!)は筒抜けなのです・・・。
世の中的に(個人で出来る範囲では)やり尽された感を感じなくもないし、Kinectだけ知ってても面白いのは作れないということを感じるので、そろそろKinect以外の別のことも遊ぼうかなあ、、、
登録:
投稿 (Atom)
