Back to people
@Aratako_LM
A

Aratako

音声
@Aratako_LM

Research Engineer at @third_i_inc

3.5KFollowers513Following1.1KPostsView on X

Recent posts

Qwen-Audio-3.0-TTSはQwen3-TTSの後継じゃなくてCosyVoice3の後継なのか

最近DLMで割と性能良さげなモデルがちょくちょく出てきてるけど、これからTTSの方もこれを初期化に使うDLM-TTSとかが流行り出すのかな

家帰ったらマンションのインターネット回線が死んでいた😱

ChatGPT Proのペンが届いていた なんかかっこいい

Photo 1

YODAS3がもうすぐ出るのか 楽しみ

うーむ、もうちょい計算資源が欲しいな(個人開発の)

Claude Fable 5、だいぶ自律性上がっているけどその分複雑なコードベースだと変なところに勝手に向かいやすいのでちゃんと調整が必要そう

論文著者からのアドバイスをいただけたのでCALMの再現実装にもう一度トライしているが、論文記載の内容と実際の学習設定が割と違うみたいだった

@Aratako_LM
A
Aratako@Aratako_LM

上手くいかなかったTTSモデルの学習コードを供養した https://github.com/Aratako/CALM-DACVAE

GENIAC 第4期の基盤モデル開発で選ばれた企業 https://www.nedo.go.jp/content/800056193.pdf

Photo 1

Opus 4.8にしたらClaude Codeが壊れてClaude Courtになってしまった

MAIはPhiの開発の時の教訓を活かして開発された感じなんだろうか

Fitbit Airを買うかOura Ring 5を買うか

Even G2、この手のガジェットで結構久しぶりに割と本気で欲しくなってる 普段から眼鏡ユーザーなので常用できるならめちゃくちゃよさそう

Codex App Meetup Tokyo なう #aimeetup #CodexApp

色んな展示があって面白かった〜 人も増えたけど会場も広くなっていたので前回より楽に回れた気がする #生成AIなんでも展示会

sarashina2.2-ttsでwatermarkに採用されてるSilentCipher、かなり軽量で速くてコード的にも使いやすい感じで良さそう

Qwen3.5-Omni、マジでオープンソースにして欲しすぎる Qwen3-ASRが最初API限定で数ヶ月後モデルも公開されたのを見る感じしばらくしたら公開される可能性もあるのかな