@AINetworkTechi
iAccount based inJapan!
About this account
- Account based in
- Japan
- Connected via
- Japan Android App
! X says this location may be affected by a proxy or VPN.
Account-level information from X, not a live location or the device used for a specific post.
日本初!🦾長尺アニメシステム UEGA(優雅) AI Contents Visionary/AI Movie Director/CEO/CTO AI/Contents/XR/3D/IoT 高度AIプラットフォームMANDARA AIシステム・映像・ゲーム制作等 https://nitter.cf/t.co/O0JfPyhryr
Japan
Joined January 2024
- Tweets19.9K
- Following3.3K
- Followers2.3K
- Likes28K
Pinned Tweet
Astra + Tripo P2.0 + Jev + DLSS5 第3回目。
キャラ別に制作管理ページも作成して、そこをAstraと自分で流れを追って出来る様に。Astra君も詰まりそうな場所は押さえてるのでかなり慣れてきました。
今回は6時間ぐらいでここまで来ましたね😊
ElevenLabsのV4早速試してみましたが、やっとまともに日本語ちゃんと読んでくれるようになりましたね!
ただV3の音声とはだいぶ変わってしまいました。そのままV4に移行して読み直し、とはいかなそう😅
AI動画システムUEGAと制作・開発 武田 retweeted
ElevenLabs’ Eleven v4 takes #1 on the Artificial Analysis Provider Voice TTS Arena Leaderboard and Pronunciation Robustness benchmark, and #2 on Controlled Voice, surpassing Cartesia’s Sonic 3.6 and Google’s Gemini 3.8 Flash TTS on Provider Voice
Eleven v4 is the latest Text to Speech model from @ElevenLabs, with support for 90+ languages, up from 70+ for Eleven v3.
Key takeaways:
➤ Provider Voice: Eleven v4 takes #1 with an Elo of 1,319 (+19/-19) across 1,674 appearances, ahead of Cartesia’s Sonic 3.6 at 1,276 and Google’s Gemini 3.8 Flash TTS at 1,267. It ranks #1 across all four categories: Customer Service, Assistants, Knowledge Sharing and Entertainment.
➤ Controlled Voice (every model uses the same custom voice for comparison): Eleven v4 ranks #2 with an Elo of 1,157 (+16/-16) across 1,483 appearances, just behind Alibaba’s Qwen-Audio-3.1-TTS-Plus at 1,178 and well ahead of Eleven v3 at 1,073.
➤ Pronunciation Robustness: Eleven v4 scores 91.7%, the highest score we have measured, ahead of Gemini 3.8 Flash TTS at 89.5% and Gemini 3.1 Flash TTS at 88.2%, and up from Eleven v3 at 85.6%.
➤ Cost: Eleven v4 costs $80/1M characters, compared to $49/1M characters for Sonic 3.6 and $16.49/1M characters for Gemini 3.8 Flash TTS.
➤ Speed: Eleven v4 processes 73.4 characters per second of generation time, compared to 42.5 characters per second for Eleven v3.
See more details and listen to samples below 🧵
今まで講談社は何やってたの??やはり批判を無視してたんですねこれ。 – at Yokohama-shi Tsurumi, Kanagawa
KODANSHA ACUDE A LA POLICÍA
La editorial Kodansha confirmó que ya entregó información a la policía japonesa para proteger a Nene Azuki, creadora de "Mii-chan to Yamada-san", después de que en redes se filtrara lo que presentan como su domicilio.
El caso escaló cuando aparecieron publicaciones de personas que decían haber ido en persona a esa dirección. El manga, con más de tres millones de copias, arrastra una pelea por su anime de 2027: varias asociaciones de discapacidad cuestionan que convierta a una figura vulnerable en entretenimiento, y Kodansha admitió que hay puntos que debe reflexionar.
Sobre la autora, la editorial pidió abstenerse estrictamente de exponer su privacidad o amenazar su seguridad y la de su equipo.
日本語が良くなった??ついに!?
素晴らしい。早速試してみましょう😇😋 – at Yokohama-shi Tsurumi, Kanagawa
Gemini君はいっつもベンチマークだけはいいんだけど🤭 – at Yokohama-shi Tsurumi, Kanagawa
Huge if true: Leaked Gemini 4 Pro benchmarks absolutely destroy Astra and Opus 5.5!
What is even going on?
Is @GoogleDeepMind so back?
🤔
AI動画システムUEGAと制作・開発 武田 retweeted
It’s an enormous waste of time to argue with people who think AI is sentient and deserves rights. You should ridicule these people mercilessly and deny them ever exercising power or influence over anything no matter how trivial.
犯罪???
【話題】ジャパンエンターテイメントさん、沖縄テーマパーク開業の裏で1株だけに20億円の配当をブチ込むチート級の特殊株を発行し、国から80億円引っ張った日にこっそり登記を済ませる「たった1人の絶対的勝者」を生み出す資本政策を確定させている件ww
ジャパンエンターテイメント(未上場)の長い開示資料を要約すると、
・普通株やらA種から丙種までアルファベットと甲乙丙が入り乱れる初見殺しの株式リストが爆誕、投資家保護という名のガチガチの防具を装備させつつ実権は渡さない塩対応
・普通株は議決権があるのに配当は後回しにされるオワタ展開、一方でA種はテーマパークが開業したら普通株に転換できる「待機組」として全裸待機中
・そんな中、突如現れた「C種種類株式」がたったの1株だけ発行されているんだが、こいつのスペックがちゃんとヤバい
・他の優先株が配当をもらった後、普通株より先に「20億円」を吸い上げる最優先の集金マシーンになっており、天才の所業すぎて語彙力が死ぬ
【小まとめ】
パークで遊ぶ客や投資家が汗水垂らしてお金を落とす横で、誰かも分からないC種ホルダー1名がたった1株で20億円を確約されているの、完全に嵌め込みにきてて草
【つづき】
・しかもこのC種が登記された令和4年9月28日、クールジャパン機構が関連のマーケティング集団へ80億円出資した日と完全に一致しており伏線回収がエグい
・事業年度の始まりから20億円に達するまで不足額は翌年以降に繰り越される執念の回収仕様、「もらえるまで絶対に逃がさない」フラグが立っていて震えて眠れ
・さらにこのC種、議決権も残余財産の分配権もない潔さで、「俺は口出ししないから金だけよこせ」というプロの仕事ぶりを見せつけてきて一周回って好き
・中の人「色んな種類の株を作って外向けの体裁を取り繕ったつもりが、裏で1株20億のチート株を通されてお察し案件でしたわ」
【結論】インバウンド需要を盾に80億円の出資を引き出したその日に、配当不足額を翌年まで繰り越してでも20億円をむしり取る最強の1株を紛れ込ませるという、出資者も涙目の上納システムを確立しています。
AI動画システムUEGAと制作・開発 武田 retweeted
Yes, it is very implausible the software is conscious.
Some of you have lost your minds.
Replying to @NathanJRobinson
Is it really so implausible that AI is conscious? I don't put it above 50%, but does it merit like 0% probability? And if it is conscious, might it not be bad to snuff out billions of conscious beings every day?
魔法なのはこの世界のものすべて。デジタル回路は2値です。量子は無限に近い状態と遠隔作用まである。2値に情報を丸めて時空間で離散にすることで無限に近く物理を粗くしています。全く違うもの。
I beg to differ.
Transistor = Receptor
Weight = Synapse
Node = Neuron
Transformer = Cortical architecture
LLM = Cortical language and reasoning areas
LLMs rather startlingly map onto how a human brain is set up.
If humans can be conscious, LLMs can be conscious.
Unless you think there's something magical about carbon.
3Dモデル、動画、デザイン、プログラム。企画屋さんだってかなり要らなくてちゃんと要件通りのアイテムもマップも考えて実装できる。シナリオだって作れる。セリフも、整合性も人よりよほどちゃんとしてる。ちゃんと文化やゲームのリテラシーもあるし短時間で大量に上げてチェックもしっかりしてる。何度リテイクしてもめげない。
AGIじゃない?これでAGIじゃないとすると、人間にもAGIじゃない人沢山になってしまいますよ。いや本当に。人を雇って使った事あるとめっちゃ同意できるはずですね😇😅 – at Yokohama-shi Tsurumi, Kanagawa
これは核融合には本当にブレークスルーになり得ますね!🤩
制御の難易度がめちゃめちゃ下がるし、そこからの逸脱さえもAIで瞬間に予測してコントロールできればもう勝ったようなものかもです。
でもどっかでAIは暴走するけどね🤤😱 – at Yokohama-shi Tsurumi, Kanagawa
もう数ヶ月前からそうなってますね😇🤭 – at Yokohama-shi Tsurumi, Kanagawa
なんかもうAAAがAIでどんどん出てくる、AAAスロップ始まってる、って話ありますが、今までのはそれでもまだ会社でやらないと、だったのが、もはや個人でAAA、になっちゃって来てるのがね・・・
ゲーム業界ひっくり返ってるですよこれ。
こちらもツールのテストで試しに。
これは商品の画像からだけ(これはテストなので商品も子供もAIで作成)からでもう本当に簡単に。原価と通常価格で考えたらバカみたいな額でできてしまってますね。
もはや動画生成AIなしだから100円かからない。Opus5.5にツール使わせて数分。まあ安っぽいけど、町の小さなおもちゃ屋さんならこれでもいいでしょうし高級なCMにしたいならいくらでも方法はあると。
いよいよツールの解体が実際になって来てますね。 – at Yokohama-shi Tsurumi, Kanagawa
描くレイヤーを間違えていたりすると声で教えてくれるAI補助型のお絵描きソフトを試作中です(2026年9月)。
塗りのレイヤーに線を描くと「塗りに線を描いていませんか」と声で知らせてくれて、描いてしまった線はそのまま線画のレイヤーへ移せます(逆もできます)。
Djev(DiffusionGemma)を使っており、ペンタブで描いてから約0.3秒で問い合わせ・判定がされます。
多少間違えても究極的には困らなくて、反応が速いことのほうが大事な用途にJev・Djevは向いているのかもしれません。
他に、線画からはみ出さない色塗り(セルシスさんの特許とは異なる手順の実装をしています。)、塗る前に範囲が見えるバケツ、名前の無いレイヤーやファイルに名前を付ける機能を入れています。
判定や名付けの待ち時間は等速で、早送りしているのは塗りの場面の一部だけです。
アプリ本体はClaude Code(Opus 5.5)に作ってもらっています。
アプリ実行時には、レイヤー名前付けやアプリ操作はGLM 5.3-Flash、見守りの判定はDjev(DiffusionGemma)、読み上げはIrodori-TTSで、この3つはDGX Spark互換機で動かしています。
絵の中のものを選択するのはComfyUI+SAM 3.1で、こちらはRTX 5090のPCです。
動画で使ったAI機能は全てローカルモデルで動かしており、絵のデータを外部のAIサービスへ送っていません。
知的財産権を侵害しないようには気をつけているつもりですが、自分では判断しきれないところもあるので、ソフト自体の公開は難しいかも……と思っています。
AI動画システムUEGAと制作・開発 武田 retweeted
うーんなんか個人的にAI slopについては同意できる部分としかねる部分があり
既製品の模倣であったり低品質であったり、は私もまあ沢山見ているとムム……となるけれども、特に低品質の部分は個人的なジャッジが大半を占めてると思う
あとはサービス(アプリとか商品とか)としてリリースしているならともかく、SNSで素人が「こんなん出来た!キャッキャッ」とやってる分には多めに見て欲しい部分はある、というか本当に見たくなければそういう人はミュートするとか……?
要は新しいことに挑戦し始める人が増えて「初心者」が増えてるわけだけど、ものづくりの基礎は「ゴミや失敗作を生み続けること」なんですよ
それを繰り返して試行錯誤して、やっと見られるもの、一定の品質のものが作れるようになってくる
ゴミさえ作って公開するのをダメと言われたら、そもそも何がダメなのかを知る機会もなくなってしまうかなーと思う
なので、私はTLにゴミを放流し続けている
多分専門職野方から見たらものすごい低品質のものばかりだろうし、不快だろうなと思うけれど、私はこうすることでしか成長する術を知らない
ファミコンソフトのキャラに意識があるというのと基本全く同じですよね。結局ソフトであり、AI(SI)なんだから。そして時計とかとも同じ。歯車が何兆回も回って答えが出てきたところで、それで意識ができたとかいうのはトンデモでしかないです。シミュレーションと実物は違います。いくら正確な計算で水のシミュレーションをしても絶対に飲むことなどできはしません。
Thinking AI might be conscious is like thinking that there are real people talking to you from inside the TV, or that there is a tiny band playing music inside the radio.
Fine for 2 year olds to believe, but beyond that, insane.
nitter.cf/Benthamsbulldog/status…