Google EarthがNano Banana 2を統合、テキストから地形や街並みを生成可能に
Google Earthのウェブ版に画像生成モデル「Nano Banana 2」が統合されました。ユーザーはテキストプロンプトを用いて、特定の場所の過去の景観や新しい施設を3D映像として視覚化できます。
都市計画や不動産開発、観光プロモーションにおいて、場所の変遷や将来のイメージを直感的に共有するための強力なツールとなる可能性があります。
国内外の主要な生成AIニュースを、日本語で短く整理。日本の中小企業や店舗が押さえるべき変化と事業への影響を、約5分で確認できます。
SoranoruGoogle Earthのウェブ版に画像生成モデル「Nano Banana 2」が統合されました。ユーザーはテキストプロンプトを用いて、特定の場所の過去の景観や新しい施設を3D映像として視覚化できます。
都市計画や不動産開発、観光プロモーションにおいて、場所の変遷や将来のイメージを直感的に共有するための強力なツールとなる可能性があります。
Thinking Machinesは、従来モデルの4分の1の規模となる276Bパラメータの「Inkling-Small」を公開しました。アクティブパラメータは12Bで、フルウェイトがオープンソースとして提供されます。
推論コストを抑えつつ高性能なモデルを利用できる可能性があり、自社環境でのAI導入や微調整を検討する事業者にとって選択肢の一つとなります。
OpenAIがGPT-5.6のLunaおよびTerraモデルの価格を改定しました。OpenRouterでは独自の割引を適用し、LunaやTerraをより安価に利用できる環境を提供しています。
AIモデルのコスト効率が向上することで、企業が大規模なAIワークフローを導入する際のハードルが下がります。
GitHub Copilotアプリで、タスクを分割して連続的に作業できるスタックセッション機能が利用可能になりました。各セッションの成果に基づき、自動的にプルリクエストを作成することで開発効率を高めます。
AIによるタスク管理とコード生成が統合されることで、開発プロジェクトのスコープ管理が容易になり、開発者の生産性向上が期待できます。
Perplexity Computerに、永続的なメモリやファイル管理、セッション共有を可能にするProjects機能が追加されました。これにより、同プラットフォームはマルチエージェントが協調する作業用OSへと進化します。
AIが単なる検索ツールから、文脈を保持して継続的に業務を遂行するエージェント型OSへと変化しており、業務フローの自動化に新たな選択肢を提供します。
Seedance 2.5は一度の生成で最大30秒の動画作成が可能になり、画像や動画、音声などの多種多様な参照素材を用いた高度な編集をサポートします。即夢AIや豆包などのプラットフォームで順次提供され、今後はAPI経由での利用も予定されています。
動画生成の長尺化と参照素材の柔軟な活用により、広告やコンテンツ制作の効率が大幅に向上する可能性があります。日本国内でのAPI提供開始時には、業務フローへの組み込みを検討すべき技術です。
RadixArkはGoogle Cloudと協力し、推論フレームワークSGLangをGoogle TPUで利用可能にしました。これにより、GemmaやDeepSeekなどのモデルを最新のTPU環境で柔軟に実行できるようになります。
特定のハードウェアに依存しないAI推論環境の選択肢が広がることで、コスト最適化やインフラ構築の柔軟性が向上する可能性があります。
Simon Willison氏が公開した「llm-chat-completions-server」は、ローカル環境でOpenAIのChat Completions APIと互換性のあるサーバーを構築します。これにより、インストール済みのLLMをAPI経由で容易に呼び出せます。
既存のAIツールやアプリケーションを、外部APIを使わずにローカル環境のモデルへ接続できるため、機密情報を扱う業務でのAI活用において重要な技術基盤となります。
動画理解やタスクの自動編成、複数ロボット間の連携能力を強化したロボット用基盤モデルです。現実世界での複雑な推論や協調作業の実行を可能にします。
AIがデジタル空間を超えて物理的な作業を自律的にこなす技術が進化しており、製造や物流現場における自動化の高度化が期待されます。
米連邦通信委員会(FCC)は、データ窃取やサイバー攻撃のリスクを懸念し、中国製の新型ロボットおよびネットワーク接続型電力インバーターの輸入を7月28日より禁止しました。対象は無線接続と感知機能を備えたソフトウェア制御の地上ロボットで、既存モデルは対象外となります。
AIインフラのサプライチェーンにおける地政学的リスクが高まっており、日本企業にとっても海外製ハードウェアの調達戦略やセキュリティ基準の見直しが必要になる可能性があります。
Chromiumベースのオープンソースブラウザ「ego lite」は、人間とAIエージェントが独立したスペースで同時に作業できる環境を提供する。Chromeのログイン状態の引き継ぎにも対応している。
AIエージェントによるブラウザ操作の効率化は、業務自動化の現場において作業スピードを劇的に改善する可能性があり、実務への導入検討に値します。
OpenAIはGPT-5.6のLunaおよびTerraモデルの価格を改定し、企業が大規模なAIワークフローをより効率的に展開できるよう支援します。
モデルの価格性能比の向上は、AI導入を検討する企業にとって運用コストの最適化に直結する重要な指標となります。
「Token Saver」は、Claude Desktop向けのMCP拡張機能で、ローカル環境でのハイブリッドRAGによりPDFを解析します。ファイルをアップロードせずに処理を行うため、トークン消費を大幅に抑えつつデータプライバシーを保護します。
大量のPDFを扱う業務において、トークンコストの劇的な削減と機密情報のローカル保持を両立できるため、コスト最適化とセキュリティ対策の両面で導入を検討する価値があります。
WorkBuddyはドキュメント編集ツールとの連携を深め、AIが生成したファイルを直接編集・共有できるワークフローを構築しました。人、AI、エージェントが共有環境で協働する新しいオフィス体験を提供します。
AIエージェントが単なるチャット相手ではなく、実務ツールと直接連携して業務を完結させる「次世代のオフィス協働」の先行事例として注目されます。
OpenAIのグレッグ・ブロックマン氏は、デスクトップ版ChatGPTのUIが現状では複雑であることを認めました。2026年末までに「Work」タブを廃止し、機能をChatGPT本体へ完全に統合する方針です。
業務効率化ツールとしてChatGPTを導入している企業にとって、UIの変更や機能統合はワークフローに影響を与える可能性があるため、今後のアップデート動向を注視する必要があります。
テンセントの混元(Hunyuan)チームは、研究用AIエージェント「Hyra」とモデル「Hy3」を活用し、1969年以来未解決だった整数論の極値問題を解明しました。この成果は論文として公開されています。
AIが単なるデータ処理を超え、高度な数学的推論や科学的発見を支援するツールとして実用段階に入っていることを示しており、研究開発のあり方を大きく変える可能性があります。
大規模言語モデルが入力内の無関係な情報に惑わされ、常識的な前提を無視してしまう「顕著性バイアス」が明らかになりました。12の主要モデルを対象とした検証では、多くのモデルが意図的な誘導に屈し、正しく推論できないケースが多発しています。
AIを活用した業務自動化において、プロンプト内の不要な情報が回答精度を低下させるリスクを示唆しています。AIの出力結果を鵜呑みにせず、論理的な整合性を人間が検証するプロセスの重要性が浮き彫りになりました。
PhiZeroは、動画から物理的な状態変化を離散的な「物理言語」として学習し、未来の挙動を推論する世界モデルです。推論後に拡散モデルで映像化する手法により、物理的に整合性の高い動画生成や動作シミュレーションを実現しました。
物理法則に基づいた高精度な動画生成技術は、製造業のシミュレーションやクリエイティブ制作における映像生成の品質を飛躍的に高める可能性を秘めています。
大規模言語モデルはコード編集時に不要なコードを削除せず残す傾向があり、検証では最大約3割が適切に削除できていないことが判明しました。削除に特化した学習データを用いることで、この回避傾向を大幅に改善できることが示されました。
AIによるコード生成や自動修正を導入する際、不要なコードが残ることでバグや技術的負債が生じるリスクがあります。開発現場ではAIの提案をそのまま適用せず、削除の正確性を人間が検証するプロセスが依然として重要です。
大規模な語料を用いたRAG(検索拡張生成)の比較研究により、データ規模が拡大するにつれ従来のBM25アルゴリズムがLLMベースの手法を上回る性能を示すことが判明しました。特に1000万トークンを超える環境では、低コストかつ高精度な検索手法としてBM25が優位性を維持しています。
RAGシステム構築において、最新のAI手法に頼るだけでなく、データ規模に応じたアルゴリズムの選定がコストと精度の最適化に直結することを示唆しています。大規模な社内ナレッジ検索を構築する際の技術選定の重要な指標となります。