Kanno Kouta

Speech Processing & Agentic Systems Engineer

音声強調・話者照合・対語まやかし検出(Voice Anti-spoofing)等の音声処理技術の研究開発をはじめ、 次世代エージェンティック音声インターフェースの開発、フルスタックWeb開発・ハードウェアプロトタイピングを行っています。

Featured Projects

未踏アドバンスト事業

エージェンティック音声入力システム

キーボード入力を代替する高精度かつコンテキスト指向の次世代音声インターフェースの開発。

Speech Processing Python Agentic AI
Hackathon Project

VoiceOS Infrastructure

音声認識・音響モデル基盤を活用したリアルタイム処理アプリケーション。

VoiceOS Web API JavaScript
Hardware / Embedded

Raspberry Pi Pico Display System

マイコンを用いたカスタム表示システムおよび電子工作ワークベンチの開発。

Raspberry Pi Pico C/C++ Hardware

Research & Achievements

Deepfake Voice & Voice Anti-spoofing Evaluation
マルチタスク学習およびデータセットバリエーションによる音声偽造検出モデルの構築
研究テーマ
学生優秀発表賞
日本音響学会 / 研究発表会
Award
多摩信用金庫賞
TMU EntreBloom コンテスト
Award

Skills & Technologies

Speech & AI / Machine Learning:
PyTorch AASIST RawNet2 ECAPA-TDNN pyannote Speech Enhancement
Web & Software Engineering:
PHP JavaScript MySQL Docker Web Components Git
Hardware & Others:
Raspberry Pi Pico Microcontroller Prototyping