Veo(プロダクト)に関するニュース一覧
- GoogleがAIでペレの幻のゴールを映像再現2026-07-14
- Google DeepMindがペレ幻のゴールをAIで再現2026-06-23
- Alibaba動画AIが世界2位、SoraとSeedance撤退2026-06-22
- Tribecaが示すAI映画、人間主導の専用ツールが鍵2026-06-13
- Google、YouTube楽曲でAI訓練か 独立系音楽家が提訴2026-06-10
- Gemini Omni、自撮りから本人も見抜けない偽動画を生成2026-05-23
- Runway、動画生成から世界モデルへ大転換2026-05-15
- GoogleとSFMOMA、AIでマティス作品を動画化2026-05-13
- Google Ads、AI広告制作のブランド管理指針を公開2026-05-06
- Google TVにGemini搭載の画像・動画生成機能が追加2026-04-29
- Google動画生成Flow、多分野の創作事例を公開2026-04-23
- Google Maps、企業向け生成AI機能を発表2026-04-22
- Google、Mac版Gemini公式アプリを提供開始2026-04-15
- SynthID透かし解析の主張、Google側は否定2026-04-14
- Google Vids、Veo 3.1搭載で動画生成を無料開放2026-04-02
- Google、低価格動画生成モデル「Veo 3.1 Lite」を提供開始2026-03-31
- OpenAI、動画生成アプリSoraを廃止しDisney契約も解消2026-03-28
- Google Workspace全体にGemini統合、実務で使える機能を総まとめ2026-03-18
- Google、Gemini APIに月額上限設定と利用階層の自動昇格機能を導入2026-03-16
- Replitが動画生成機能を正式公開、数分で製品紹介映像を作成可能に2026-03-06
- Luma AIがマルチモーダル統合モデルで創作エージェント公開2026-03-05
- Google NotebookLMが映画風AI動画生成機能を公開2026-03-04
- Google、MWCでAndroid AI新機能を多数披露2026-03-02
- Vercel GatewayにGrok・Veo追加2026-02-19
- 元Snap幹部設立のAI動画スタートアップHiggsfield が評価額1300億円を達成2026-01-15
- GoogleがVeo 3.1を発表、縦向き動画生成と参照画像からの動画変換に対応2026-01-13
- Googleの2025年、訴訟乗り越え最高益2025-12-17
- AIが人間の言語分析能力に初めて到達2025-12-14
- ディズニー、GoogleのAI著作権侵害を告発2025-12-11
- 動画生成AI「Veo」の品質を高めるメタプロンプト術2025-12-08
- GoogleがGemini 3発表も画像生成の安全性に重大な懸念2025-11-21
- Google、NYを生成AI美術館に 市民の夢描く2025-11-14
- Google Gemini、動画・スライド・TVへ機能拡張2025-10-24
- Google、誰でも数分でAIアプリ開発2025-10-21
- Google、AI動画Veo 3.1公開 編集機能で差別化2025-10-15
- Google、欧州など大学生にGeminiを1年間無償提供2025-10-13
- テイラー・スウィフト氏のプロモ動画、AI利用疑惑で炎上2025-10-06
- トップYouTuberがAI動画に警鐘「クリエイターの生計を脅かす存在」2025-10-06
- AI動画は物理法則を理解したか?Google論文の検証2025-10-01
- Google、賞金100万ドルのAI映画賞を発表2025-10-01
- OpenAI、動画AI「Sora 2」でTikTok風アプリ投入へ2025-09-29
- GoogleのAI「Veo」、福田美術館の絵画を動画に2025-09-24
- Google、月額5ドルのAIプランを新興国40カ国超に拡大2025-09-24
- Google、AI Plusプランを40カ国に追加、新興国市場へ展開加速2025-09-23
- YouTube、AI新機能でクリエイターの制作・収益化を大幅強化2025-09-20
- YouTube、生成AIで動画制作を革新 創造性の拡張目指す2025-09-19
- YouTube、クリエイター向けAIを全面強化 Veo 3 Fastやリップシンク導入2025-09-16
Veo(プロダクト)に関するニュース一覧
詳細を見る
米Googleは6月23日、傘下のGoogle DeepMindがサッカー界の伝説ペレの幻のゴールをAIで再現したと発表しました。映像が残されていなかった1959年8月2日の「Gol da Rua Javari」を、最先端の生成AIモデルで動く映像へとよみがえらせる試みです。広告祭カンヌライオンズでその舞台裏を公開しました。
再現されたのは、ボールを地面に落とさず3度連続で相手をかわす「ソンブレロ」の妙技です。フィルムに残らなかったこの瞬間を、歴史家やスポーツ記者、サッカー界のレジェンド、そしてペレの家族と協力して復元しました。プロジェクトはペレの肖像権を管理するペレ・ブランドとの完全な提携のもとで進められています。
技術面ではGoogle DeepMindのチームが、最新モデルのGemini OmniとVeo 3を用いて歴史的な断片を動く映像へ変換しました。撮影は当時と同じ競技場で行い、本物のユニフォームやビンテージのボールを使うことで、史実への忠実さを追求しています。
この取り組みは教育と文化保存を軸に据えており、完成した映像は年内にペレ博物館へ展示される予定です。Googleは、失われた記憶を再びアクセス可能にすることで、ペレ不在で迎える初のワールドカップにおいて新世代のファンを鼓舞する貢献になるとしています。
経営者やリーダーにとって示唆的なのは、生成AIが単なる業務効率化の道具にとどまらず、文化遺産の保存という新たな価値創出の領域へ広がっている点です。映像が残らない過去の出来事を史実に基づいて復元する手法は、ブランド体験やアーカイブ事業への応用も期待されます。
詳細を見る
Alibaba Cloudは6月21日、AI動画生成モデル「HappyHorse 1.1」を公開しました。企業向けにAPIを全面開放し、最初の2週間は全機能で40%割引を提供します。OpenAIのSoraが採算難で終了し、ByteDanceのSeedance 2.0も著作権問題で国際展開を凍結するなか、世界2位の実力を武器に企業市場の主役を狙う動きです。
同モデルは4月に匿名でベンチマークに登場し、独立評価サイト「Artificial Analysis Video Arena」で即座に首位を獲得しました。現在は3つのリーダーボード全てで2位につけ、テキスト動画ではGoogleのVeo-3.1を69点上回ります。人間の評価者による比較に基づくEloスコアでの差であり、一時的なぶれではない品質差を示しています。
技術面の強みは、テキスト・画像・動画・音声を単一の150億パラメータTransformerで処理する統合設計です。動画と音声を別々のモデルでつなぐ競合と異なり、一度の生成ですべてを扱うため、外部の吹き替えや後処理が不要になります。導入箇所や依存ベンダーが減り、企業にとって総保有コストの削減につながります。
1.1版では商用制作の課題を狙って改良しました。複数の参照画像で人物の一貫性を保つR2V機能を新搭載し、広告やシリーズ動画で問題となる被写体のブレを抑えます。動作の滑らかさや、機械生成と分かる「肌のテカリ」「過剰な先鋭化」といった不自然な質感も改善されました。
競争環境はAlibabaに有利です。Soraは1日約100万ドルの運用費に対し総収益が約210万ドルにとどまり、4月26日に終了しました。Seedance 2.0はNetflixやDisneyなど大手スタジオの法的警告を受け、国際展開を無期限延期しています。残るはGoogle Veoのみですが、Arenaの評価ではHappyHorseが上回ります。
一方で地政学リスクも残ります。米国防総省は6月8日、AlibabaをBYDやBaiduとともに中国軍企業リストに加えました。即座の制裁ではないものの、企業の調達判断には複雑さを加えます。欧州ではフランスなど現地データセンターを開設し、主権対応のインフラで信頼を得られるかが今後の鍵となります。
詳細を見る
米国で6月13日に開催中のトライベッカ映画祭2026で、生成AIを活用した実験的な短編が相次いで上映され、映画制作の新たな可能性を示しました。なかでも注目を集めたのが、Google DeepMindの『Dear Upstairs Neighbors』です。汎用モデルにプロンプトを与えるだけの手法ではなく、人間のアーティストが主導する専用ツールとしてAIを使う流れが鮮明になりました。
同作はPixarのベテラン、Connie Qin He監督がDeepMindの研究者と共同で制作しました。Pixar出身のデザイナーがPhotoshopやアクリル絵の具で描いた表現主義的なコンセプトアートを学習させ、その画風を一貫して再現できるようVeoとImagenのカスタム版を開発した点が特徴です。
制作チームは生成AIだけに頼らず、業界標準の3DソフトAutodesk Mayaで粗いアニメーションを先に作り込みました。その下絵をVeoに入力して映像を仕上げる工程をとることで、物語として破綻のない一貫したシーンを実現しています。これは生成AIが芸術家の創作を補助するあつらえの道具として機能した好例だと言えます。
一方でOpenAIが持ち込んだ作品は評価が分かれました。Palisades火災を再現した『Smoked』や写実的な映像の『Mauvais Soleil』はSoraなどを用いましたが、広角シーンが漫画的に見えるなど生成AI特有の限界が露呈しました。同社がSoraを完全に終了させた直後の出展でもあり、動画分野からの撤退をうかがわせます。
低予算での個人制作も注目されました。監督のAsh Koosha氏は計算コストわずか2千ドルで、イランの抗議デモを題材にした『Dreams of Violets』を一人で数週間で完成させました。Kling AI、Claude、Gemini、Nano Bananaを組み合わせた手法で、視覚面では平凡ながら力強い物語が支えとなっています。
記事は、プロンプトを与えるだけで商業的に通用する作品を量産する未来は来ないと結論づけています。むしろGoogleのような大手AI企業がスタジオと提携し、特定の制作工程に合わせた専用モデルを構築する方向が現実的だとみています。そうしたワークフローは、明確な創作ビジョンを持つ人間の芸術家が導いて初めて機能するのです。
詳細を見る
独立系音楽家のグループが、GoogleがYouTubeにアップロードされた楽曲を無断で音楽生成AI「Lyria 3」の訓練に使用したとして提訴しました。Googleは棄却申し立てを行い、原告が具体的な使用を証明できていないと反論するとともに、仮に使用していたとしてもYouTubeの利用規約が許可していると主張しています。
Googleの対応には、過去の公式発言との整合性が問われています。2024年4月にはYouTube CEOのニール・モハン氏がBloombergの取材で、YouTube動画の「一部」がGeminiなどのモデル訓練に内部的に使われている可能性があると発言しました。さらにGoogleはCNBCに対し、YouTube投稿がGeminiやVeoの訓練に使われていることを公式に認めています。
しかし、Lyria音楽モデルについてはGoogleは確認を拒否しています。棄却申し立ての中では、アップロードによりユーザーが「複製、配布、二次的著作物の作成」を許諾する利用規約に同意していると主張しており、事実上の使用を示唆しつつも明言を避ける姿勢を貫いています。
The Vergeは、Googleが明白な事実を認めない理由について、訴訟係争中において「もっともらしい否認可能性」を維持する計算された戦略だと分析しています。AIによる創作物の著作権問題が各所で争われる中、YouTube上の膨大なコンテンツをAI訓練に利用する是非は、クリエイターと大手テック企業の関係を左右する重要な先例となる可能性があります。
詳細を見る
Googleが新たにリリースしたGemini Omniは、写真・動画・テキストなどあらゆる入力から動画を生成できる「anything-to-anything」モデルです。動画生成・編集プラットフォームFlow上で利用可能で、従来のVeoモデルの後継として位置づけられています。The Vergeの記者が実際にハンズオンレビューを行い、その実力と課題を検証しました。
レビューでは、ぬいぐるみの鹿を主人公にした冒険動画を生成するテストが行われました。キャラクターの一貫性はVeoから明確に改善され、プロンプトに忠実な映像が生成される場面も増えています。一方で、スカイダイビング中にぬいぐるみの向きが突然変わるなど、不自然な「AIジャンプスケア」も依然として残っています。蜂蜜の瓶が場面ごとに形状を変えるといった、オブジェクトの一貫性の問題も確認されました。
最も衝撃的だったのはディープフェイクの精度です。記者が無表情の自撮り動画を入力し、パスタを食べる映像やエッフェル塔前でバゲットをかじる映像を生成させたところ、10年間毎日顔を見ている夫でさえ本物と区別できないレベルの結果が得られました。AIの痕跡はフォークの不自然な音や背景人物の重複など細部に残るものの、SNS上では十分に通用する品質です。
動画生成にはクレジット制が採用されており、1本あたり15〜40クレジットを消費します。月額20ドルのAI Proプランで1,000クレジットが付与されますが、記者は約20本の生成と数回の編集で残り145クレジットまで減少しました。特定のビジョンに近づけるための試行錯誤を考えると、コストは決して安くありません。
テキストによる編集指示機能もVeoから改善されていますが、完璧とは言えません。鹿のぬいぐるみから角を除去するよう指示すると、該当シーンでは除去されたものの他のシーンに角が追加されるという矛盾が生じました。記者は「不気味の谷に深く入り込んでいる」と評しつつ、Googleアカウントとクレジットカードがあれば自宅の動画をハワイ旅行に変えられる時代になったと結んでいます。
詳細を見る
AI動画生成スタートアップのRunwayが、動画生成ツールの提供から「世界モデル」の構築へと事業の軸足を移しつつあります。世界モデルとは物理環境をシミュレーションし、現実世界の振る舞いを予測するAIシステムです。共同創業者のGermanidis氏は、言語モデルが人間の記述したテキストから学習するのに対し、世界モデルは観測データから直接学習することで、より偏りのない知能を実現できると主張しています。
Runwayは2018年にNYU芸術学部出身のチリ人2名とギリシャ人1名が創業し、映画制作者向けAIツールで名を上げました。最新モデルGen-4.5やLionsgate・AMCとの提携を通じ、評価額53億ドル、2026年第2四半期だけでARRを4000万ドル積み増すなど商業面でも成長しています。2025年12月には初の世界モデルをリリースし、ロボティクス部門では実環境でのテスト・導入も始まっています。
同社の究極の目標は、動画・音声・センサーなど複数のモダリティを統合した単一モデルで「宇宙のデジタルツイン」を構築することです。Germanidis氏は、科学実験の待ち時間を圧縮できれば科学の進歩そのものを加速できると語り、生物学的世界モデルによる抗老化研究を個人的なムーンショットに掲げています。
しかし競争環境は厳しく、GoogleのVeoとGenieが動画生成・世界モデルの双方でRunwayと直接競合しています。Yann LeCunのAMI Labs(10.3億ドル調達)やフェイフェイ・リーのWorld Labs(12.9億ドル調達)も同じ領域を狙っています。Runwayの累計調達額は8.6億ドルで、OpenAIの約1750億ドルやAlphabetの時価総額4.86兆ドルとは桁違いの差があります。
一方、OpenAIが動画プラットフォームSoraを1日100万ドルの計算コストに耐えきれず3月に閉鎖した事例は、資金力だけでは生き残れないことを示しています。スタンフォード講師のKatanforoosh氏は、ElevenLabsがリソースで劣りながらOpenAIやGoogleを凌駕した例を挙げ、Runwayにも同様の可能性があると指摘します。シリコンバレー外から出発した独自の文化と早期収益化の姿勢が、この競争における同社の武器です。
詳細を見る
サンフランシスコ近代美術館(SFMOMA)とGoogle Arts & Cultureは、Googleの動画生成AI「Veo」を活用し、アンリ・マティスの初期作品4点をアニメーション化するプロジェクトを発表しました。対象にはフォーヴィスム(野獣派)の原点とされる「帽子の女」も含まれています。
本プロジェクトは、SFMOMAで開催中の展覧会「Matisse's Femme au chapeau: A Modern Scandal」に合わせたものです。1905年のパリ・サロンで非写実的な色使いと奔放な筆致で観客を驚かせたマティスの精神を、AI技術で現代に再解釈する試みとなっています。
制作にあたっては、SFMOMAの学芸員・教育チームと緊密に連携し、映像の美的パラメータや使用するアーカイブ資料を慎重に選定しました。技術的な新しさだけでなく、美術史的な正確性を両立させることが重視されています。鑑賞者がキャンバスの枠を超えてマティスの世界に入り込む没入型体験を目指しています。
今回の取り組みは、美術館がAIをどう活用すべきかを示す一つのモデルケースといえます。革新と制度的責任のバランスを保ちながら、来館者が芸術を新たな視点で捉えるきっかけを提供することを目指しており、AI時代のアート鑑賞の方向性を示唆しています。
詳細を見る
Googleは2026年5月6日、公式ポッドキャスト「Ads Decoded」の最新エピソードで、AIを活用した広告クリエイティブ制作におけるブランド管理の指針を公開しました。広告クリエイティブ担当のグループプロダクトマネージャーCharles Boyd氏とDemand Gen担当ディレクターSarah Hathiramani氏が、AIの速度を活かしつつブランドの独自性を守る方法について語っています。
広告キャンペーンにおいてクリエイティブ制作は最も時間がかかる工程のひとつです。AIの登場により素材の高速生成が可能になりましたが、スピードが正確性やブランドへの忠誠を犠牲にしてはならないと両氏は強調しています。広告効果を左右するクリエイティブの質を維持しながら、いかに効率化するかが課題となっています。
エピソードでは具体的なツールとして、動画生成AI「Veo」を活用したブランドロイヤルティの大規模構築手法が紹介されました。また、広告の品質指標であるAd Strengthの正しい解釈方法についても解説されています。
さらに、広告主からの要望に応えた新機能についても言及されました。GoogleがAI広告ツールの拡充を進めるなか、ブランドの声を保ちながらAIを活用する実践的なガイダンスを提供する姿勢が示されています。
詳細を見る
Googleは2026年4月29日、Google TV向けにGeminiを活用した新機能群を発表しました。目玉は画像生成モデルNano Bananaと動画生成AIVeoのテレビ上での利用で、Geminiタブの「Create」ボタンから音声プロンプトで写真の加工や動画の生成が可能になります。まず米国のGemini対応TCLテレビから提供が開始されます。
Nano Bananaでは「父に変な服を着せて」といった音声指示で写真を変換でき、背景の差し替えや新しいシーンの生成にも対応します。Veoでは静止画にモーションを加えたり、テキスト指示だけでクリップを一から作成できます。Googleはこれらをリビングでの共有体験として位置づけています。
Google Photosにも複数の強化が加わります。Geminiによる音声検索で旅行や誕生日パーティーなどの写真を素早く呼び出せるほか、「リミックス」機能で水彩画や油絵風のスタイルを適用できます。さらにダイナミックスライドショーでは、アルバムをコラージュやアニメーション付きのスクリーンセーバーとして表示できます。
AI機能に加え、ホーム画面にはYouTube Shortsのパーソナライズフィード「Short videos for you」が今夏から米国で追加されます。YouTubeがモバイルでShortsの非表示オプションを導入した直後の動きですが、Googleはテレビでのショート動画需要を見込んでおり、将来的にはShorts以外のプラットフォームへの拡張も示唆しています。
詳細を見る
Googleは動画生成ツールFlowのアーティスト共創プログラム「Flow Sessions」第3期の終了を発表しました。2025年9月に開始されたこのプログラムは、6週間にわたりアーティストがFlowを使って作品を制作する取り組みです。第3期では従来の映像制作者に限らず、ジャーナリズム、広告、ファッションなど多様な分野のクリエイターを初めて募集しました。
参加アーティストの一人であるJulie Wielandは、Flowを「終わりのない遊び場」として活用し、石のゴーレムがタンポポの命を見守る循環的な物語を制作しました。AI Studioでフレームレートを下げるアプリを作成し、手作りのストップモーション風の表現を実現するなど、複数のツールを組み合わせた実験的な手法が注目されます。
Calvin Herbstは幼少期の16mmフィルム映像をスタイル変換に活用し、愛犬との別れを描いた作品を制作しました。Stephane BeniniはVeoの視覚的なドリフトをストーリーテリングの技法として意図的に使い、記憶の断片をたどる父娘の物語を表現しました。いずれも個人的な経験を出発点とする創作の重要性を示しています。
映像制作以外の分野では、ファッションデザイナーのCharline Pratがフランスのスタジオ COMBOと協力し、実際に刺繍したガーメントを起点に、縫製では実現できない質感の世界をFlowで表現しました。視覚的一貫性を保つため、Flowに参照ライブラリを提供する手法を開発しています。
クリエイティブディレクターのChloe Desaullesは、ドキュメンタリーの手法を用いてニューヨークの架空の街を驚くほどリアルに描写しました。AI生成メディアにおけるリアリズムの意味を問う作品です。Googleは共創を通じてツールを改善する方針を掲げており、多様な分野のクリエイターとの協働がFlowの進化を加速させています。
詳細を見る
GoogleはCloud Next 2026にて、Google Mapsおよび地理空間アプリケーション向けの新たな生成AI機能を発表しました。今回のアップデートはエンタープライズユーザーを主な対象としており、マッピングプラットフォームに高度なビジュアル分析とデータ分析能力を追加するものです。
目玉機能の一つ「Maps Imagery Grounding」は、Gemini Enterprise Agent Platformにプロンプトを入力するだけで、Google Street View上にリアルなシーンを生成できる機能です。映画のロケ地や建設予定地のイメージを数秒で可視化でき、Veoを使ったアニメーション化にも対応しています。
もう一つの新機能「Aerial and Satellite Insights」は、Google Cloud BigQueryに保存された衛星画像をAIで分析する機能です。Googleによれば、従来数週間かかっていた画像分析作業を数分に短縮できるとしています。
さらに、橋梁・道路・送電線など特定のオブジェクトを画像から識別する2つのEarth AIモデルも新たに提供されます。これにより、企業が独自にAIモデルを構築・学習させる必要がなくなり、数カ月の開発期間を省略できます。
これらの発表は、Googleがエンタープライズ向け地理空間AIへの注力を強化する動きの一環です。すでにAirbusやボストン小児病院が環境モニタリングや災害対応にEarth AIプラットフォームを活用しており、都市計画やデータ分析分野での応用拡大が見込まれています。
詳細を見る
Googleは2026年4月15日、AIアシスタント「Gemini」のMac向けネイティブデスクトップアプリを全世界で無料提供開始しました。macOS 15以上に対応し、Option+Spaceのショートカットキーで作業中のどの画面からでもGeminiを呼び出せるフローティングウィンドウ型のインターフェースを採用しています。
最大の特徴は、表示中のウィンドウやローカルファイルをGeminiと共有し、画面の文脈に沿った質問ができる点です。複雑なグラフの要約やスプレッドシートの数式確認など、タブを切り替えることなくAIの支援を受けられます。画像生成のNano Banana、動画生成のVeo、Deep Research、Canvasなど、Web版Geminiのほぼ全機能がデスクトップで利用可能です。
アプリはSwiftで開発され、GoogleのAntigravityを活用して100日未満で100以上の機能を実装したとCEOのスンダー・ピチャイ氏が述べています。一方、App Storeではなく公式サイトからのDMGダウンロード方式を採用しており、配布方法に懸念を示す声もあります。
競合面では、OpenAIのChatGPTやAnthropicのClaudeが先行してMacアプリを提供しており、Googleは後発となります。ただし、ChatGPTやClaudeがPC操作の自動化機能を備えているのに対し、Geminiアプリは現時点ではそうした機能を持っていません。Googleはこれを「最初のリリースに過ぎない」とし、今後数か月でさらなる機能拡充を予告しています。
また、Googleは前日にWindows向けの検索アプリも正式リリースしています。Alt+Spaceでウェブ検索やローカルファイル検索が可能で、AIオーバービューやLensによる画面内検索にも対応しています。MacではAI、WindowsではSearchと、プラットフォームごとに異なるアプローチでデスクトップ市場への本格参入を進めています。
詳細を見る
ソフトウェア開発者のAloshdenny氏が、Google DeepMindのSynthID電子透かしシステムをリバースエンジニアリングしたと主張し、その手法をGitHubでオープンソース公開しました。Geminiで生成した200枚の純黒画像のコントラストと彩度を強調してノイズ除去することで、透かしパターンを可視化できたといいます。ニューラルネットワークやGoogleへの特別なアクセスは一切使用していません。
SynthIDは、GoogleのAI生成コンテンツに埋め込まれるほぼ不可視の電子透かしシステムです。画像生成の段階でピクセルに直接組み込まれる設計で、画質を劣化させずに除去することが困難になっています。Gemini、Nano Banana、Veo 3などGoogleのAI製品全般で使用されており、YouTubeのAI生成アバターにも適用されています。
ただし、Aloshdenny氏自身も完全な除去には成功していません。実現できたのはSynthIDのデコーダを混乱させるレベルにとどまり、透かし自体の削除ではありませんでした。同氏は「デコーダを諦めさせることしかできなかった事実が、設計の優秀さを物語っている」と述べ、SynthIDが完璧ではないものの悪用のコストを十分に引き上げていると評価しています。
Google広報のMyriam Khan氏はThe Vergeに対し、「このツールがSynthIDの透かしを体系的に除去できるという主張は誤りである」と明確に否定しました。現時点では、誰でもダウンロードして透かしを除去・追加できるツールには至っておらず、AI検知システムを欺く実用的な脅威にはなっていないと見られます。
詳細を見る
Googleは2026年4月2日、動画編集ツール「Google Vids」に最新の動画生成モデル「Veo 3.1」を統合し、すべてのGoogleアカウントユーザーに無料で動画生成機能を開放しました。
無料アカウントでは月10回の動画生成が可能で、AI Proでは50回、AI Ultraでは月1,000回まで利用できます。生成される動画は8秒・720p解像度で、テキストプロンプトや写真から高品質なクリップを作成できます。
音楽生成モデル「Lyria 3」および「Lyria 3 Pro」もVidsに統合され、30秒から3分のオリジナル楽曲をAIで自動生成できるようになりました。歌詞入力は不要で、雰囲気を指示するだけで楽曲が完成します。
AIアバター機能も大幅に強化され、テキストプロンプトでアバターの動作を演出できるようになりました。商品やプロップとの対話シーンを指示でき、外見・衣装・背景もプロンプトで自在に変更しながら、声やアイデンティティの一貫性を維持します。
完成した動画をYouTubeに直接エクスポートする機能や、ブラウザ上で画面録画ができるChrome拡張機能も追加されました。競合にはSynthesiaやHeyGenなどがあり、AI動画編集市場の競争が一段と激化しています。
詳細を見る
Googleは2026年3月31日、動画生成AIモデルファミリーの新モデル「Veo 3.1 Lite」の提供を開始しました。開発者が大量の動画を低コストで生成できることを目的とした、同社で最もコスト効率の高い動画モデルです。
Veo 3.1 Liteの最大の特徴は、上位モデル「Veo 3.1 Fast」と同等の生成速度を維持しながら、コストを50%以下に抑えた点です。大量の動画を扱うアプリケーション開発において、大幅なコスト削減が期待できます。
機能面では、テキストから動画を生成する「Text-to-Video」と、画像から動画を生成する「Image-to-Video」の両方に対応しています。解像度は720pと1080pを選択でき、動画の長さも4秒・6秒・8秒から指定可能です。
アスペクト比は横型の16:9と縦型の9:16に対応しており、SNS向けの短尺動画からビジネス用途まで幅広い活用が見込まれます。利用はGemini APIおよびGoogle AI Studioの有料プランから可能です。
さらにGoogleは4月7日からVeo 3.1 Fastの価格も引き下げる予定です。動画生成モデル全体のコスト低減を進めることで、より多くの開発者がプロダクトに動画生成機能を組み込めるよう環境を整備しています。
詳細を見る
OpenAIは2026年3月、動画生成アプリSoraの廃止とAPI提供の終了を発表しました。同時にDisneyとの10億ドル規模の提携契約も解消し、経営幹部の役割変更や追加100億ドルの資金調達も明らかにしています。
Sora廃止の最大の要因は、膨大な計算資源を消費しながら十分な収益を生み出せなかったことです。Render Network Foundation関係者によると、Google DeepMindのVeoやKlingなど競合モデルに品質面で後れを取り、明確な優位性を失っていました。市場調査会社Sensor Towerのデータでは、ダウンロード数が昨年10月の約480万件から今年3月には110万件へと大幅に減少しています。
OpenAIのAGI展開担当CEOFidji Simo氏は社内で「サイドクエストに気を取られてこの瞬間を逃すわけにはいかない」と発言し、生産性とビジネス面への集中を訴えました。ChatGPTへの広告導入や新たなサブスクリプション階層の検討など、収益化の取り組みが加速しています。
Disneyとの提携解消は特に注目を集めました。3年間のライセンス契約がわずか3カ月で終了し、Disney側はSora関連プロジェクトの作業中に廃止を知らされたと報じられています。ただしDisney側はGoogle、Runway、Lumaなど他社とのキャラクターライセンス契約に前向きな姿勢を示しています。
今後OpenAIは計算資源をAIエージェント開発やコーディングツール、企業向けサービスに集中させる方針です。これによりAnthropicとの直接競争が一層激化する見通しです。NPO団体Witnessの代表は、Soraが半年間で「ハイパーリアルなAI生成コンテンツ」を常態化させた影響は、アプリが消えても長く残ると警鐘を鳴らしています。
詳細を見る
GoogleはGeminiをGoogle Workspace全体に統合し、Docs、Gmail、Sheets、Slides、Drive、Meet、Calendar、Chat、Vids、Formsの各サービスでAI機能を本格展開しています。日常業務での要約・下書き・データ整理・会議管理を効率化する実用的な機能群が揃いました。
Google Docsでは長文レポートの自動要約に加え、「Help me create」機能でDriveやGmailの文脈を取り込んだ初稿の自動生成が可能になりました。文体の統一や他文書のフォーマット適用など、複数人での共同編集を支援するベータ機能も提供されています。
Gmailでは「AI Inbox」が重要メールを自動選別し、長いスレッドを要約カードで表示します。さらに「AI Overview」機能で過去のメール全体を横断検索でき、文脈に応じた返信文の自動生成やトーン調整も可能です。受信トレイの管理負担が大幅に軽減されます。
Google Meetでは自動ノートテイク機能が注目されており、会議中の要点・決定事項・アクションアイテムを自動で記録・整理します。途中参加者向けの要約機能やリアルタイム翻訳字幕、音声ノイズ低減など、会議体験を向上させる機能も追加されています。
Google Calendarでは「Help me schedule」機能が参加者全員のカレンダーを分析し、最適な会議時間をAIが提案します。早朝を避けるなどの個人設定にも対応し、Gmailと連携して空き時間を検出するため、手動でのスケジュール調整が不要になります。
Google Vidsではトピックやアウトラインからラフカットを自動生成し、AIアバターやVeo 3による画像の動画変換にも対応しています。Formsではアンケートの自動生成に加え、回答結果のトレンド分析をリアルタイムで提供し、データ収集から分析までを一元化しています。
コスト管理の新機能
利用階層の刷新
可観測性の強化
詳細を見る
Googleは、Gemini APIのコスト管理を強化するため、Google AI Studioにプロジェクト単位の月額支出上限(Project Spend Caps)機能を導入しました。開発者はプロジェクトごとにドル建ての上限を設定でき、変更するまで継続的に適用されます。
あわせて利用階層(Usage Tiers)も全面刷新されました。従来は手動申請が必要だった上位階層への昇格が自動化され、利用量と支払い実績に応じてリアルタイムでレート制限が引き上げられます。上位階層に必要な累計支出額も引き下げられ、より早く高いAPI容量を確保できるようになりました。
新たに各利用階層には請求アカウント全体での月額上限が設定されます。この上限は階層の昇格に伴い自動で引き上げられ、ユーザーが個別に設定するプロジェクト上限とは独立して機能します。業界の他プラットフォームと同様の仕組みで、公平なアクセスを確保する狙いがあります。
請求設定もAI Studio内で完結するよう改善されました。従来は複数のウィンドウを行き来する必要がありましたが、設定画面から直接プロファイルの構成とプロジェクトへの紐付けが可能になります。レート制限ダッシュボードでは、RPM・TPM・RPDの3指標をプロジェクトごとに可視化できます。
さらに日別コスト内訳グラフやモデル別フィルター機能も追加され、7日間から月全体まで柔軟に支出を追跡できます。ImagenやVeoのリクエスト数、Grounding with Google Searchなどツール別の使用状況も確認可能になり、開発者の予算管理と運用の透明性が大幅に向上しました。
詳細を見る
Replitは、開発環境内でモーションスタイルの製品紹介動画を自然言語の指示だけで生成できる新機能「Replit Animation」を正式に公開しました。従来は専門のモーショングラフィックス制作会社に依頼していた作業を、開発者自身が数分で完了できるようになります。
この機能はプロダクトデザイナーのSamuel氏による社内実験から生まれました。Replit Design上でサイトやスライドを生成する仕組みをアニメーションに応用できないかと試したところ、わずか30分でスタジオ品質の動画が完成したといいます。
その直後、Fast Modeのローンチ動画が急遽必要になり、Samuel氏が実験的に作成した動画をそのまま公開したところ、オーガニックで100万インプレッションを超える反響を得ました。モーションデザイナーでない同氏がわずか数ドルのコストで制作した動画がこの成果を上げたことで、社内での活用が本格化しました。
Replit AnimationはVeoやSoraのようなAI動画生成とは異なり、モーショングラフィックススタジオを開発環境に組み込んだような位置づけです。ユーザーはローンチ対象や想定顧客、雰囲気を自然言語で伝えるだけで、絵コンテやコードを書く必要がありません。従来は数千ドルと数週間を要していた工程を大幅に短縮できます。
実践的なワークフローとしては、ビルドタイプをanimationに設定し、プロンプト最適化機能でシーン構成を自動生成した後、複数タブで並行生成して最良の要素を組み合わせる手法が推奨されています。特定シーンの修正も「イントロを変更」「トランジションを強く」といった対話的な指示で調整でき、ゼロからやり直す必要はありません。
詳細を見る
Luma AIは2026年3月、テキスト・画像・動画・音声を横断して創作業務を一気通貫で担うLuma Agentsを公開しました。同社独自の統合知能モデル「Uni-1」を基盤とし、広告代理店やマーケティングチーム、デザインスタジオ向けに提供されます。
Uni-1モデルは音声・動画・画像・言語・空間推論を単一のマルチモーダル推論システムで学習しています。CEOのAmit Jain氏は「言語で思考し、ピクセルで想像・描画する」と表現し、この能力をピクセルの知能と呼んでいます。今後のリリースで音声・動画の出力にも対応予定です。
Luma Agentsの最大の強みは、アセットや協力者、クリエイティブの反復にわたって持続的なコンテキストを維持できる点です。自己批評による反復改善ループを備え、コーディングエージェントと同様に自らの成果物を評価・修正する能力を持ちます。
実際の導入事例では、あるブランドの1500万ドル規模・1年がかりの広告キャンペーンを、複数国向けのローカライズ広告として40時間・2万ドル未満で制作し、社内品質管理を通過しました。200語のブリーフと製品画像1枚から、ロケーション・モデル・配色の多様なアイデアを自動生成するデモも披露されています。
Luma AgentsはAPI経由で一般公開されていますが、ワークフローの安定性を確保するため段階的にアクセスを拡大する方針です。Google Veo 3やElevenLabsの音声モデルなど外部AIモデルとも連携し、エンドツーエンドの創作ワークフローを実現します。
詳細を見る
Googleは、AIノートツール「NotebookLM」に映画風の動画生成機能「Cinematic Video Overviews」を追加したと発表しました。ユーザーのリサーチやノートを基に、完全にアニメーション化された没入型の動画を自動生成します。
従来のVideo Overviews機能はナレーション付きスライドショーの生成に限られていましたが、新機能ではGemini 3、Nano Banana Pro、Veo 3など複数のAIモデルを組み合わせることで、滑らかなアニメーションと豊かな視覚表現を実現しています。
Geminiは「クリエイティブディレクター」として機能し、最適なナラティブ構成、ビジュアルスタイル、フォーマットの決定から、一貫性を確保するための自己修正まで、数百に及ぶ構造的・様式的判断を自動的に行います。
本機能は現在、Google AI Ultraサブスクリプション契約者(18歳以上)に限定して英語版のみ提供されています。1日あたりの生成上限は20本に設定されており、Web版とモバイル版の両方で利用可能です。
Googleは近月、Veo AIモデルのアップグレードや動画生成ツールFlowのアクセス拡大、ゲーム風映像を生成する「Project Genie」のデモなど、AI動画分野への投資を加速させており、今回の機能追加もその一環に位置づけられます。
詳細を見る
Googleは2026年2月末のMWCバルセロナにおいて、Androidエコシステム全体にわたるAI活用の最新成果を発表しました。来場者向けにハンズオンデモを多数用意し、AI技術の実用性を訴求しています。
注目の体験として、Nano Bananaを使い80年代雑誌の表紙風に自分を再現できる画像生成デモや、Veoによる音声付き没入型動画の生成機能が紹介されました。生成AIの創造的な活用例として注目を集めています。
XRヘッドセットとプロトタイプグラスを用いた都市のバーチャル探索も出展されました。周囲の環境に合わせた音楽再生機能も搭載され、空間コンピューティング分野への本格参入を示しています。
Circle to Searchには新機能が追加され、見つけた服装から直接衣類を検索しバーチャル試着できるようになりました。視覚的な検索体験がショッピング領域へ大きく拡張されています。
さらにPixel 10aをはじめとする最新デバイスでGeminiの新機能を体験できるブースも設置されました。会場のAndroid Avenueでは20社のパートナー企業も出展し、エコシステムの広がりを印象づけています。
詳細を見る
詳細を見る
詳細を見る
Googleは動画生成AIモデルVeo 3.1の強化版を発表しました。最大の新機能は縦向き(ポートレート)動画の生成対応で、TikTokやInstagram Reelsなどモバイル向けコンテンツ制作に直接対応しています。また参照画像からAI動画を生成できる機能も追加され、ブランドの視覚的一貫性を保ちながらコンテンツ制作できます。
Veo 3.1はGemini APIを通じて開発者が利用でき、食材の写真から料理手順動画を自動生成するデモも公開されました。より高い一貫性とクリエイティブコントロールが実現され、商業的なコンテンツ制作パイプラインへの組み込みが容易になっています。
OpenAIのSoraやRunwayとの競争が激化する動画生成AI市場において、縦型フォーマット対応はGoogleが実用的なユースケースで差別化を図る戦略的判断です。SNSコンテンツ制作の現場では縦型動画が主流となっており、この対応は多くのクリエイターやマーケターにとって直接的な価値を持ちます。
詳細を見る
2025年初頭、GoogleはChrome売却命令、広告技術の分割、Epicとのアプリストア訴訟、そしてAI競争という4つの大きな脅威に直面していましたが、1年を経て業績・法的地位ともに良好な状態で年を締めくくっています。
最大の脅威だったChrome売却については、判事がこれを「非常に混乱を招き、リスクが高い」と退けました。代わりに競合他社への検索データ販売という比較的軽微な是正措置が命じられました。これはOpenAIやPerplexityなどとの競争激化がGoogleに有利な状況を生み出したためでもあります。
広告技術の独占訴訟でも、判事がAd ExchangeとAd Managerの売却より行動変更の方が望ましいと示唆しており、解体を免れる可能性が高まっています。Epicとの和解も手数料引き下げとAndroidの部分的な開放という形で決着する見通しです。
AI競争では、Googleが明確な勝者の一角を占めるようになりました。Gemini 3 Proの登場はOpenAIに「コードレッド」状態をもたらし、Veo 3はSoraより先に動画生成SNSを席巻。Nano Banana Proは市場で最も説得力のある画像生成モデルと評価されています。
財務面では10月に四半期として初めて売上高1000億ドルを突破し、利益は310億ドルに達しました。Google Cloudの150億ドルという売上高はAIの商業的成果の証明であり、自社設計のTPUチップ「Ironwood」を初めて外部企業(Anthropic、Meta他)に販売することでNVIDIAへの挑戦も始まっています。
Google Playは年末に向けてホリデー向けの100以上のブランドギフトカード販売や、アプリ・ゲームの最大90%オフセール、Google Play Books 15周年記念特典などを展開しています。
言語理解の壁を越えたAI
詳細を見る
2025年12月、AIが人間の専門家と同レベルで言語を分析できることが初めて実証され、同時期に画像生成AIが意図的な劣化表現でリアリティを高めるという新潮流が注目を集めた。誰が、何を、いつ、どこで、なぜ示したのか——UCバークレーの研究チームがOpenAIのo1モデルを対象に行った実験と、GoogleのNano Bananaをはじめとする画像生成モデルの進化を通じて、AIの能力が新たな段階へ入りつつあることが明らかになりました。
UCバークレーの言語学者Gašper Beguš氏らは、既存の知識を流用できないよう独自設計した構文・音韻のテストをo1に課しました。その結果、o1は複雑な再帰構文の解析、文の曖昧性の識別、さらには30種の人工言語の音韻規則の推定まで、言語学の大学院生と同等以上の精度で実施できることが確認されました。
最も注目されたのは『メタ言語能力』——言語を使うだけでなく言語そのものについて考える力——をo1が示した点です。ノーム・チョムスキーらが主張してきた『大量データの学習だけでは正しい言語分析は不可能』という見解に対し、今回の研究は強い反証を突きつけました。
一方、画像生成の分野ではGoogleのNano Banana Proが逆説的なアプローチで現実感を追求しています。スマートフォンカメラ特有のコントラスト不足や過剰なシャープネス処理をあえて再現することで、人間が日常的に見慣れた'スマホ写真らしさ'を演出し、不気味の谷を回避する手法が注目されています。
Adobe FireflyやMetaのAI生成ツールも同様に、過度に滑らかな'AI的な美しさ'を抑制するスタイル調整機能を搭載しています。OpenAIのSora 2やGoogleのVeo 3では、監視カメラ風の低解像度映像を意図的に生成してリアリティを演出する動きも見られます。
AI生成画像の急速な進化に対応するため、C2PAのコンテンツ証明規格の普及が急務となっています。GoogleのPixel 10シリーズでは全撮影画像に暗号署名が付与されるようになり、Google Photosもコンテンツ証明の表示に対応しました。ただし、ハードウェアメーカーやプラットフォーム全体への普及にはまだ時間を要する状況です。
AIが人間の言語能力を分析・解析する段階に達したことは、自然言語処理の研究や教育分野に大きな変革をもたらす可能性があります。同時に、リアルと生成物の境界が曖昧になる画像・動画領域においては、技術の進化と真偽確認の仕組みの整備が並行して求められています。
詳細を見る
ディズニーは水曜日、Googleに停止通告書を送付し、同社のAIモデルが「大規模な」著作権侵害を行っていると主張しました。フローズン、デッドプール、スター・ウォーズなど主要フランチャイズのキャラクターに酷似したコンテンツがGoogleのAIで生成されていると指摘しています。
特にYouTubeに統合されたVeo AIビデオモデルが問題視されています。GoogleがYouTubeにAI動画生成機能を追加する中で、ディズニーのIPが無断で利用されている可能性が浮上しました。エンタメ企業とテック企業の間でIP保護を巡る緊張が高まっています。
注目すべきはそのタイミングです。ディズニーはGoogleへの法的措置と同日にOpenAIとの10億ドル提携を発表しました。この二面戦略は、選択的にAIプラットフォームと協力しつつ、無断使用には厳しく対処するという明確な戦略を示しています。
詳細を見る
GoogleのUXエンジニアが、動画生成AI「Veo」の出力を劇的に向上させる手法「メタプロンプティング」を公開しました。これはGeminiなどの言語モデルに、AI向けの指示文(プロンプト)自体を作成させるテクニックです。
具体的には、Geminiに対し「LLMが理解できる詳細なプロンプトを書いて」と依頼します。その際、ストップモーションといったスタイルや、光沢紙などの素材を具体的に指定することで、人間では記述が難しい緻密な指示書が生成されます。
さらに、「見ていて満足感がある」といった感情的な要素を条件に加えるのも効果的です。AIが出力したプロンプトをVeoに入力すれば、紙の質感や環境音までリアルに再現された、高品質な映像を生成できます。
この手法は専門知識が不要で、誰でもすぐに実践可能です。まずは自分の好きなテーマを選び、AIと対話しながら実験を繰り返すことが、クリエイティブな成果物を生み出す近道となるでしょう。
詳細を見る
Googleは11月21日、推論能力を強化した最新AIモデル「Gemini 3」や、高機能な画像生成ツール「Nano Banana Pro」を発表しました。生産性を高める新機能が多数追加された一方で、画像生成における安全対策の不備が指摘されており、ビジネス利用にはコンプライアンス面での注意が必要です。
Gemini 3では「Vibe Coding」と呼ばれるコーディング支援機能が飛躍的に向上したほか、カレンダー管理や手配業務を代行するGemini Agentが登場しました。音声対話機能Gemini Liveも進化し、話す速度やトーンの指示、特定のキャラクターになりきった対話が可能になるなど、ユーザー体験が洗練されています。
クリエイティブ領域では、新ツール「Nano Banana Pro」が画像のブレンドやポスター作成を容易にし、動画生成モデル「Veo 3.1」はキャラクターやスタイルの一貫性を保つ機能が強化されました。しかし米The Vergeの検証によると、Nano Banana Proでは歴史的な陰謀論や著作権侵害を含む画像が容易に生成可能であり、偽情報拡散のリスクが懸念されています。
詳細を見る
Googleは2025年11月14日、ニューヨーク市で市民参加型の生成AIアートプロジェクト「Imagine If…」を開始しました。これは、市民から寄せられた「もしもニューヨークが…」という空想を、地元のアーティストがGoogleの最新AIモデルを使って映像化し、市内の交通機関にあるデジタルスクリーンで展示するものです。テクノロジーとアートを融合させ、都市全体の創造性を刺激する新たな試みとして注目されます。
プロジェクトへの参加方法はシンプルです。市民は地下鉄駅などに設置されたスクリーンのQRコードをスキャンし、自身のアイデアを投稿します。投稿されたアイデアの中から、ニューヨーク市全5区を代表する5人のアーティストがインスピレーション源となるものを選び、動画生成AI「Veo」などを用いて、ユニークな映像アート作品を制作します。
制作されたアート作品は、11月から4週間にわたり、ニューヨーク市交通局(MTA)の地下鉄駅など、数千に及ぶデジタルスクリーンで公開されます。これにより、日常の通勤・通学路が、市民の想像力が生んだアートを鑑賞できる「動くギャラリー」へと変貌します。プロジェクトの集大成として、12月14日にはタイムズスクエアでフィナーレが開催され、選りすぐりの作品が象徴的な巨大スクリーンに映し出される予定です。
この取り組みは、単なるアートイベントにとどまりません。一般市民が`生成AI技術に触れる機会`を創出し、その可能性と楽しさを伝えるショーケースとしての役割を担っています。また、企業が地域社会やアーティストと連携し、テクノロジーを活用して新たな文化的価値を共創する`先進的なモデルケース`であり、AI時代のブランディングや社会貢献活動のあり方について、多くの示唆を与えています。
詳細を見る
Googleは2025年10月24日、AIアシスタント「Gemini」の月次アップデートを発表しました。今回の「October Gemini Drop」では、動画生成AI「Veo 3.1」や、プレゼンテーション資料を自動生成する「Canvas」機能が追加されました。さらにGoogle TVとの連携も実現し、クリエイティブ制作から家庭での利用まで、活用の幅を大きく広げます。生産性向上を目指すビジネスパーソンにとって注目の内容です。
中でも注目されるのが、動画生成AIの最新版「Veo 3.1」です。実写に近いリアルな質感の映像を生成できるほか、カメラワークの制御もより簡単になりました。さらに、効果音付きの対話を含む動画の作成も可能となり、マーケティングやコンテンツ制作の現場で、時間とコストを大幅に削減する可能性を秘めています。
プレゼン資料作成の常識を覆すのが新機能「Canvas」です。トピックや参考資料をアップロードするだけで、AIがテーマや関連画像を含むスライド一式を自動で生成します。完成した資料はGoogleスライドで微調整でき、企画書作成を劇的に効率化します。この機能はまずProユーザー向けに提供が開始されます。
Geminiの活用シーンは家庭にも広がります。「Gemini for Google TV」により、視聴したい番組を対話形式で探せるようになります。さらに、一般的な質問に対して、関連するYouTube動画を提示しながら回答する機能も搭載。単なる検索アシスタントにとどまらない、新しいテレビ視聴体験を提供します。
このほか、複雑なトピックを段階的に解説する能力が向上したGemini 2.5 Flashのアップデートや、Web版での数式(LaTeX)の扱いやすさ向上など、専門的な作業を支援する改善も含まれています。今回のアップデートは、Geminiが多機能で実用的なAIアシスタントへと進化したことを示しています。
詳細を見る
Googleは2025年10月21日、同社のAI開発プラットフォーム「Google AI Studio」に、プログラミング初心者でも数分でAIアプリケーションを開発・公開できる新機能「vibe coding」を追加したと発表しました。このアップデートにより、アイデアを持つ誰もが、専門知識なしで自身のアプリを具現化し、市場投入までの時間を劇的に短縮することが可能になります。
新機能の核心は、刷新された「Build」タブにあります。利用者はGemini 2.5 Proをはじめ、動画理解AIの「Veo」や画像生成AI「Imagine」など、Googleの多様なAIモデルを自由に組み合わせられます。「作りたいアプリ」を文章で説明するだけで、システムが必要なコンポーネントを自動で組み立て、アプリの雛形を生成します。
生成されたアプリは、インタラクティブなエディタですぐに編集できます。画面左側ではAIとの対話を通じてコードの修正や提案を受けられ、右側のエディタではソースコードを直接編集可能です。このハイブリッドな開発環境は、初心者から熟練の開発者まで、あらゆるスキルレベルのユーザーに対応します。
アイデアが浮かばないユーザーを支援する「I'm Feeling Lucky」ボタンもユニークな機能です。ボタンを押すたびに、AIがランダムなアプリのコンセプトと必要な設定を提案。これにより、偶発的な着想から新たなサービスが生まれる可能性を秘めています。
その実力は確かです。海外メディアVentureBeatの記者が「サイコロを振るアプリ」と指示したところ、わずか65秒でアニメーション付きの多機能なウェブアプリが完成しました。完成したアプリはGitHubへの保存や、Googleのインフラを使ったデプロイも数クリックで完了します。
この新機能は無料で利用を開始でき、高度な機能を利用する場合のみ有料APIキーが必要となります。Googleは、AI開発のハードルを劇的に下げることで、開発者コミュニティの裾野を広げ、AIエコシステムのさらなる活性化を狙っていると考えられます。今回の発表は、今後予定されている一連のアップデートの第一弾とされています。
詳細を見る
Googleは2025年10月15日、最新のAI動画生成モデル「Veo 3.1」を発表しました。AI映像制作ツール「Flow」に統合され、音声生成や動画内のオブジェクトを操作する高度な編集機能を搭載しています。これにより、クリエイターはより直感的に高品質な動画を制作可能になります。激化するAI動画市場で、競合のOpenAI「Sora 2」に対し、編集機能の優位性で差別化を図る狙いです。
Veo 3.1の大きな特徴は、音声生成機能の統合です。従来は手動で追加する必要があった音声が、静止画から動画を生成する機能や、動画を延長する機能にネイティブで対応しました。これにより、映像と音声が同期したコンテンツをワンストップで制作でき、制作工程を大幅に効率化します。
編集機能も大幅に強化されました。動画内の任意の場所にオブジェクトを自然に追加する「挿入」機能や、不要な要素を消去する「削除」機能が実装されます。さらに、照明や影を調整し、シーン全体のリアリティを高めることも可能です。作り手の意図をより精密に反映した映像表現が実現します。
新モデルは、動画編集ツール「Flow」に加え、開発者向けの「Gemini API」や企業向けの「Vertex AI」でも提供されます。これにより、個人のクリエイターから企業のコンテンツ制作まで、幅広い用途での活用が期待されます。GUIとAPIの両方を提供することで、多様なワークフローに対応する構えです。
一方で、市場の反応は賛否両論です。特に競合の「Sora 2」と比較し、動画自体の品質や価格面でSora 2が優位だとの指摘も出ています。Veo 3.1の強みである高度な編集ツールが高く評価される一方、生成品質のさらなる向上が今後の課題となりそうです。
技術面では、最大1080pの解像度と、SNSなどで需要の高い縦型動画の出力に対応しました。また、生成された動画には電子透かし技術「SynthID」が埋め込まれ、AIによる生成物であることを明示します。これにより、コンテンツの透明性を確保し、責任あるAI利用を促すとしています。
詳細を見る
Googleは2025年10月13日、欧州・中東・アフリカ(EMEA)域内の大学生向けに、自社の最先端AIツール群「Google AI Proプラン」を1年間無償提供すると発表しました。18歳以上の学生が対象で、同年12月9日までの申込みが必要です。この取り組みは、次世代のAI人材育成と将来の労働力準備を目的としています。
無償提供されるのは、Gemini 2.5 Proへの拡張アクセスや、大規模な調査レポートを自動生成する「Deep Research」など、高度なAI機能を含むプランです。学生はこれらのツールを活用し、学業や創造的活動における生産性を大きく向上させることが可能になります。
さらに、音声や動画の概要作成機能が強化された思考支援ツール「NotebookLM」や、テキスト・画像から高品質な動画を生成する「Veo 3」も利用可能です。これにより、学生は研究からプレゼンテーション準備まで、多岐にわたるタスクをAIサポートで進められます。
Googleは単なる答えの提供ではなく、理解を深め批判的思考を育むことを重視しています。そのため、質問やステップバイステップの支援で学習を導く「Guided Learning」モードも導入。複雑な数学の問題解決や論文構築などをサポートします。
学生は、最新の画像生成・編集モデル「Nano Banana」を使い、寮のデザインやクラブのロゴなど、アイデアを視覚的に具体化することもできます。創造性を刺激し、プロジェクトの初期段階を迅速に進めるツールとして活用が期待されます。
この施策は、教育者向けの「Gemini for Education」の拡充とも連動しています。Googleは世界中の大学と協力し、AIリテラシーの向上と個別化された学習支援の実現を目指していて、未来の担い手への投資を強化しています。
詳細を見る
著名アーティストであるテイラー・スウィフト氏が、Googleと共同で実施した最新アルバムのプロモーション用動画について、ファンから「AI生成ではないか」との疑惑が浮上し、物議を醸しています。これは、AI技術の商業利用やクリエイターの著作権問題が議論される中で、著名人のAI活用に対する敏感さを浮き彫りにしています。
スウィフト氏は新アルバム『The Life of a Showgirl』のリリースに際し、Google検索から始まる大規模なオンライン・スカベンジャーハントを実施しました。ファンが手に入れた12本の謎解き動画について、一部のシーンがコンピューター生成特有の不自然さを示しているとして、「AIを利用している」との指摘が集中しています。
この疑惑は、Google側の思惑と密接に関係していると見られています。GoogleはOpenAIのSora 2に対抗するAI動画生成モデル「Veo 3」を開発しており、数百万人のファンにリーチできるスウィフト氏とのコラボレーションは、自社技術を宣伝する絶好の機会だと考えられます。ただし、Googleは動画の制作方法についてコメントを拒否しています。
AI利用が特に問題となるのは、スウィフト氏自身が過去にAI生成画像による偽情報の拡散(大統領選関連の偽支持画像)に対して強い懸念を示していた経緯があるからです。豊富なリソースを持つ彼女が、コスト削減のためにAI生成に頼った場合、クリエイティブ業界における倫理的な批判を増幅させることになります。
AI技術は、クリエイターの作品制作を助ける一方で、無断で学習データに利用され、職を奪う技術に転用されることへの強い懸念があります。世界的スターのAI使用疑惑は、著作権や生計の脅威といった、クリエイティブ業界が抱える敏感なテーマを改めて浮き彫りにしています。
詳細を見る
世界で最も影響力のあるYouTuberであるMrBeast(ジミー・ドナルドソン氏)がこのほど、AIによる動画生成技術がプロのクリエイターの生計を脅かす「実存的な脅威」となると強く警鐘を鳴らしました。フォロワー数6億人を超える業界の巨星によるこの発言は、AI技術の急進展に直面するコンテンツ経済全体に大きな波紋を広げています。
同氏はSNS上で、AI生成動画が「生計を立てている数百万人のクリエイター」にどのような影響を与えるのか疑問を呈し、「業界にとって恐ろしい時代」だと述べています。その懸念は、コンテンツが大量生産され、プロの付加価値が急速に低下する可能性に焦点が当たっています。
この危機感の背景にあるのは、OpenAIが最近発表した最新モデル「Sora 2」とその専用モバイルアプリの存在です。特にアプリはユーザーが手軽にAI動画を作成し、TikTokのような縦型フィードで共有できるため、リリース後すぐに米国App Storeで1位を獲得するなど、爆発的に普及しています。
動画プラットフォームであるYouTube自体も、AI技術の導入を加速させています。YouTubeはAI編集ツールや、独自の動画生成モデルVeoを活用した機能を提供し、クリエイターの作業効率化を支援しています。一方で、プラットフォームによるAI推進の動きは、MrBeastのようなトップクリエイターの不安を増幅させている側面もあります。
MrBeast自身、過去にAI技術と関わり、ファンからの批判を受けた経験があります。この夏、彼はAIを利用したサムネイル作成ツールを自身の分析プラットフォームで公開しましたが、すぐにクリエイターやファンから反発を受け、ツールを撤回し、人間のアーティストを推奨する形に変更しました。
AI生成動画が「slop(質の低いコンテンツ)」として敬遠される傾向もあり、その品質や創造性についても議論が続いています。今後AIが完全に人間に匹敵する動画を作れるようになったとしても、AI利用を開示しないクリエイターは、ファンからの信頼を失い、長期的に評判を損なうリスクがあります。
詳細を見る
Google DeepMindが、最新のAI動画モデル「Veo 3」が物理世界をどの程度理解できるかを探る研究論文を発表しました。論文では、Veo 3が訓練データにないタスクもこなす「世界モデル」への道を歩んでいると主張しますが、その結果は一貫性に欠け、真の物理世界のシミュレーション能力には依然として大きな課題があることを示唆しています。
研究者らは、Veo 3が明示的に学習していない多様なタスクを解決できる「ゼロショット学習者」であると主張します。これは、AIが未知の状況に対しても柔軟に対応できる能力を持つことを意味し、将来的に汎用的な視覚基盤モデルへと進化する可能性を示唆するものです。
確かに、一部のタスクでは目覚ましい成果を上げています。例えば、ロボットの手が瓶を開けたり、ボールを投げたり捕ったりする動作は、試行を通じて安定して説得力のある動画を生成できました。画像のノイズ除去や物体検出といった領域でも、ほぼ完璧に近い結果を示しています。
しかし、その評価には注意が必要です。外部の専門家は、研究者たちが現在のモデルの能力をやや楽観的に評価していると指摘します。多くのタスクにおいて結果は一貫性を欠いており、現在のAI動画モデルが、現実世界の複雑な物理法則を完全に理解していると結論付けるのは時期尚早と言えるでしょう。
経営者やエンジニアにとって重要なのは、この技術の現状と限界を冷静に見極めることです。AI動画生成は強力なツールとなり得ますが、物理的な正確性が求められるシミュレーションやロボット工学への応用には、まだ慎重な検証が必要です。
詳細を見る
Googleは2025年10月1日、世界最大級のクリエイターイベント「1 Billion Followers Summit」と共同で、優勝賞金100万ドル(約1.5億円)の「Global AI Film Award」を創設したと発表しました。このコンテストは、同社の生成AIモデル「Gemini」などを活用して制作された短編映画を世界中から募集し、AIによる創造性の新たな地平を切り拓くことを目指します。
今回のAI映画賞は、AIがクリエイターの強力なパートナーとなりつつある現状を象徴するものです。Googleは、AI技術がコンテンツ制作のハードルを下げ、誰もが映像作家になれる未来を見据えています。100万ドルという破格の賞金は、同社がAIクリエイティブ分野に寄せる大きな期待の表れと言えるでしょう。
応募作品には、いくつかの重要な条件があります。まず、作品の70%以上をGoogleのAIツールで生成する必要があります。上映時間は7分から10分。テーマは「未来の再創造」または「知られざる物語」のいずれかを選択します。言語は不問ですが、英語字幕は必須です。締切は2025年11月20日となっています。
制作には、最新の動画生成モデル「Veo 3」や、より高度な制御が可能な映画制作ツール「Flow」、画像モデル「Nano Banana」など、GeminiファミリーのAIツールが活用できます。これらのツールは、キャラクターやシーン、スタイルを精緻にコントロールし、クリエイターのビジョンを忠実に映像化することを支援します。
このAI映画賞は、AIが単なる効率化ツールではなく、人間の創造性を拡張する新たな表現媒体であることを示す試金石となるでしょう。授賞式は2026年1月にドバイで開催されるサミットで行われます。今後、AIネイティブなクリエイターがどのような作品を生み出すのか、世界中から注目が集まります。
詳細を見る
OpenAIが、次世代動画生成AIモデル「Sora 2」を搭載したソーシャルアプリのローンチを準備していることが明らかになりました。同アプリはTikTokに酷似したインターフェースを持ち、ユーザーはAIが生成した動画のみを共有できます。ChatGPTでテキストAIの利用を大衆化させた同社が、動画分野でも同様の体験革命を目指します。
アプリの最大の特徴は、TikTokのようなユーザー体験です。縦型の動画が並ぶフィードをスワイプして視聴し、「おすすめ」ページではアルゴリズムがユーザーの好みに合わせたコンテンツを提示。動画に対して「いいね」やコメント、さらにはそれを元に新たな動画を作る「リミックス」機能も備え、AI生成コンテンツを軸にした新たなコミュニティ形成を狙います。
ユーザーはプロンプト(指示文)を入力することで、最大10秒間の動画クリップを生成できます。スマートフォンのカメラロールなどから写真や動画をアップロードする機能はなく、全てがアプリ内でAIによって作られる点がユニークです。また、本人確認機能を通じて自分の肖像を登録し、動画に登場させることも可能になります。
OpenAIの狙いは、AI生成動画の体験を根本から変えることにあります。ChatGPTがテキスト生成AIの可能性を一般に知らしめたように、このアプリで動画AIの普及を一気に加速させる構えです。また、TikTokの米国事業売却を巡る混乱が、中国と繋がりのないショート動画プラットフォームの立ち上げにとって好機になるとの思惑もあるようです。
AI動画生成の分野では、巨大テック企業間の競争が激化しています。Metaは自社のAIアプリ内に「Vibes」というAI動画専用フィードを導入。Googleも最新モデル「Veo 3」をYouTubeに統合するなど、各社がプラットフォームへの実装を急いでいます。OpenAIのスタンドアロンアプリ戦略がどう差別化されるか注目されます。
一方で課題も山積しています。OpenAIはニューヨーク・タイムズ紙などから著作権侵害で提訴されており、アプリには厳しい著作権フィルターが搭載される見込みです。また、未成年者の安全確保も大きな課題であり、年齢制限などの対策がどのように盛り込まれるかが今後の焦点となります。
詳細を見る
Googleは2025年9月24日、最新の動画生成AI「Veo」を活用し、日本の福田美術館と協力して絵画を動画化する「動く絵画」プロジェクトを発表しました。Veoが静止画から動きを推測し、高精細な動画を生成します。これにより、鑑賞者に新たな芸術体験を提供し、デジタルアーカイブの可能性を広げることを目指します。 この技術の中核は、Veoが静止画からあり得る動きを推測し、時間的に一貫性のある動画を生成する能力にあります。一枚の絵という限られた情報から、数百フレームにわたる連続した映像を創り出すことで、静止画と動画の間のギャップを埋める画期的な試みと言えるでしょう。このアプローチは、どうすれば芸術を新たな方法で探求できるかという問いに答えるものです。 プロジェクトでは2つの動作モードが開発されました。一つは「アニメーションモード」です。学芸員が絵画に描かれた雨の動きや旅人の歩みといった要素を指定し、Veoがそれらを基に物語性のある動画を生成します。これにより、絵に込められた物語がより明確に視覚化され、鑑賞者は新たな視点を得ることができます。 もう一つの「フォトリアリスティックモード」は、絵画の元になったであろう現実の風景を再現することに焦点を当てます。Veoは静止画を元に、写真のようにリアルな世界の動画を生成します。これは、芸術家が目にしたであろう風景をデジタルで追体験させる試みであり、芸術的解釈の源泉を探る新しい手法です。 このプロジェクトは、単なる芸術鑑賞の拡張に留まりません。静的なデジタルアーカイブを、分析や物語表現に活用できる動的な資産へと変える道筋を示しています。文化財の保存と活用において、AIが果たす役割の大きさを示唆する先進的な事例ではないでしょうか。
詳細を見る
Googleは9月24日、月額約5ドルの安価なAIサブスクリプションプラン「AI Plus」を、インドネシアやメキシコなど40カ国以上で提供開始しました。標準プランが高価な新興国市場で有料ユーザーを獲得し、先行するOpenAIに対抗する狙いです。この動きは、世界のAIサービス市場の勢力図に影響を与える可能性があります。 このプランでは、最新AIモデル「Gemini 2.5 Pro」へのアクセスが可能です。加えて、画像生成ツール「Flow」や動画生成ツール「Veo 3 Fast」など、クリエイティブな作業を支援する機能も含まれます。GmailやDocsといったGoogleの各種アプリ内でもAI機能が使えるようになり、業務効率の向上が期待できます。 さらに、AIリサーチアシスタント「NotebookLM」の拡張機能や、200GBのクラウドストレージも提供されます。専門的な情報収集や資料作成、データ保管といったビジネスシーンでの実用性を高めており、コストパフォーマンスに優れたサービス内容となっています。 この動きの背景には、OpenAIとの激しい顧客獲得競争があります。OpenAIもインドネシアなどで月額5ドル未満の「ChatGPT Go」を展開済みです。月額20ドルの標準プランが浸透しにくい市場で、両社は低価格戦略を加速させ、次なる巨大市場の主導権を争っています。 月額料金は多くの国で約5ドルに設定されていますが、ネパールやメキシコなど一部地域では、最初の6ヶ月間は50%割引が適用されます。巨大IT企業による価格競争は、今後さらに多くの地域で高機能なAIツールの普及を後押しすることになるでしょう。
詳細を見る
Googleは9月23日、AIサブスクリプションプラン「AI Plus」の提供国を新たに40カ国拡大したと発表しました。インドネシアでの先行導入が好評だったことを受け、より手頃な価格で高度なAIツールを世界中に提供する狙いです。対象はアジア、アフリカ、中南米の新興国が中心で、グローバルな利用者層の拡大を目指します。 「AI Plus」プランでは、Geminiアプリでの画像生成・編集や動画生成モデル「Veo 3 Fast」の利用上限が引き上げられます。さらに、Gmail、Docs、Sheetsといった主要な生産性ツールにGeminiが統合され、業務効率の大幅な向上が期待できるでしょう。ビジネスの現場でAIをどう活用できるか、試金石となりそうです。 このプランには、AI搭載のデジタルノート「NotebookLM」の利用上限拡大や、Googleフォト、ドライブ、Gmailで使える200GBのストレージも含まれます。また、これらの特典は最大5人の家族と共有可能で、個人利用だけでなく小規模なチームでの活用も視野に入ります。 新たに追加されたのは、ベトナム、フィリピン、ナイジェリア、メキシコ、ウクライナなど40カ国です。Googleは、価格を各国の市場に合わせて設定することで、新興国市場でのAIサービスの普及を加速させる戦略です。手頃な価格設定が、新たなビジネスチャンスを生むかもしれません。
詳細を見る
YouTubeが年次イベント「Made on YouTube」で、クリエイターのコンテンツ制作と収益化を支援する多数の新機能を発表しました。生成AIを活用した動画制作ツールや新たな収益化プログラムの導入により、プラットフォーム全体の活性化を目指します。特に、動画管理ツール「YouTube Studio」やショート動画制作機能が大幅に強化されます。 動画管理ツール「Studio」には、AIがアカウントに関する質問に答えるアシスタント「Ask Studio」が導入されます。また、本人の顔が無断で使用された動画を検知・管理する機能もベータ版として公開。クリエイターは自身のブランド保護とチャンネル管理をより効率的に行えるようになります。これにより、どのような効果が期待できるのでしょうか。 ショート動画向けには、Googleのテキストtoビデオ生成AIモデル「Veo 3 Fast」のカスタム版が導入されます。簡単なテキスト指示で動画内にオブジェクトを追加したり、スタイルを変更したりすることが可能に。AIの活用でコンテンツ制作のハードルを下げ、クリエイターの表現の幅を広げます。 ライブ配信機能「YouTube Live」もアップデートされます。AIが配信中の盛り上がった場面を自動で選び、共有しやすいショート動画としてハイライトを作成する機能が追加されます。また、配信を中断しない新しい広告フォーマットも導入され、視聴体験と収益性の両立を図ります。 収益化の選択肢も広がります。クリエイターが動画内で紹介した商品をタグ付けできるショッピングプログラムを強化。AIが商品に言及した最適なタイミングを特定し、自動で商品タグを表示する機能も追加され、ブランドとの提携や物販による収益機会を拡大します。 ポッドキャスト制作者向けにもAIツールが提供されます。米国では、AIが動画からクリップ作成を提案する機能が利用可能になります。来年には、音声ポッドキャストを動画形式に変換する機能も展開予定で、コンテンツの多角的な活用を支援します。
詳細を見る
YouTubeは、動画制作に生成AIツールを本格導入する新機能を発表しました。テキストから動画を生成するGoogleの技術などを活用し、誰でも簡単に動画を作れる環境を目指します。ニール・モハンCEOはこれを「創造の民主化」を加速させる一手と位置づけ、プラットフォームの次なる飛躍に繋げたい考えです。 新機能を使えば「月面で踊る100人のダンサー」といったテキストから即座に動画を生成できます。また、ポッドキャストの音声から関連映像を自動で作り出すことも可能です。これにより、誰もが簡単に質の高い動画コンテンツを制作できるようになります。 モハンCEOはAI導入を、創業以来の「テクノロジーで人々の声を届ける」という理念の延長線上にあると説明します。彼はAIをデジタル音楽のシンセサイザーに例え、ツールは人間の独創性や創造性を引き出す新たな機会になるとの考えを示しました。 一方で、AIによるコンテンツ制作の容易さは、プラットフォームの強みである「真正性」を損なうリスクも指摘されます。人間の創造性がどこまで介在するのかという根本的な問いと共に、AI生成物と人間による制作物の境界が曖昧になることへの懸念が浮上しています。 YouTubeは対策として、AI生成動画にはラベルを表示する方針です。しかし、視聴者がAIコンテンツを除外するフィルター機能は提供されません。モハンCEOは今後AIツールの影響はさらに拡大すると予測しており、YouTubeが常に最先端であり続けることが重要だと強調します。
詳細を見る
YouTubeは「Made on YouTube 2025」にて、クリエイターの生産性向上と収益拡大を目的とした大規模なAIツール群を発表しました。Shorts制作効率化のほか、チャンネル運営分析、著作権保護、そして多言語展開を支援する機能が焦点です。これにより、クリエイターはコンテンツ制作における高い生産性とグローバルな収益機会を得られると期待されます。
特に注目すべきは、ショート動画(Shorts)向けにGoogleの動画生成モデル「Veo 3 Fast」が統合された点です。これは低遅延の480p動画をテキストプロンプトから生成でき、静止画に動画の動きを適用する機能も搭載されます。クリエイターはアイデアを即座に映像化でき、トレンドへの対応速度が飛躍的に向上します。
編集作業の負担も大幅に軽減されます。「Edit with AI」は、カメラロールの生素材から最適な場面を抽出し、音楽やトランジション、ボイスオーバーを自動で付与し、初稿を生成します。また、会話の内容をキャッチーな楽曲に変換する「Speech to Song」も導入され、より手軽なリミックス文化を推進します。
チャンネル運営の効率化のため、YouTube StudioにはAIチャットボット「Ask Studio」が導入されます。これはチャンネルのパフォーマンス分析や視聴者の反応に関する実用的なインサイトを提供し、収益化戦略を支援します。タイトルやサムネイルのA/Bテストも最大3パターンまで比較可能となり、最適化を促進します。
グローバル展開とブランド保護も重要なテーマです。自動吹き替え機能はさらに進化し、翻訳された音声に合わせたリップシンク技術(口の動きの同期)をテストすることで、翻訳動画のリアリティを大幅に高めます。視聴者が違和感なく視聴できる環境を提供します。
さらに、YouTubeパートナープログラム(YPP)参加者向けには、自身の顔の無断利用を検知し、削除を管理できる「肖像検出」機能がオープンベータ展開されます。これはクリエイターが自身のイメージや評判を守り、デジタル著作権を管理する上で重要なリスク管理ツールとなります。
ポッドキャスト領域への注力も見逃せません。AIは既存のビデオポッドキャストからプロモーション用のShortsやクリップを自動で提案・生成します。また、音声のみのポッドキャストに対しても、カスタマイズ可能な映像を自動で生成可能となり、オーディオクリエイターの新規開拓と視聴時間増に貢献します。