SoranoruNEWS
TOPIC

AIエージェントの最新情報

自律実行、ツール連携、業務自動化の最新情報

Soranoru
NEWS FEED

全293件 · 4ページ目

IT之家(RSS)元記事へのリンクあり
注目

中国のAIモデル市場が急成長、日次トークン呼び出し数が500兆を突破

2026年6月時点で、中国におけるAIモデルの1日あたりのトークン呼び出し数が500兆を超えました。競争の焦点はモデルの更新からAIエージェントの実装とエコシステム構築へと移行しています。

なぜ注目?

中国市場でのAI利用が爆発的に拡大しており、推論用計算リソースの需要が急増しています。日本企業にとっても、中国市場におけるAI活用環境の変化を注視する必要があります。

TechCrunch:AI(RSS)元記事へのリンクあり
注目

AmazonがNVIDIA製GPUの注文を3倍に拡大、2027年から200万基を導入へ

AmazonはAWSデータセンター向けに、Blackwell UltraやRubinを含むNVIDIA製GPUを新たに200万基導入する契約を締結しました。需要の急増を受け、わずか5ヶ月前に追加した100万基の計画を大幅に上回る規模となります。

なぜ注目?

クラウドインフラの増強は、将来的なAIサービスの処理能力向上とコスト最適化に直結するため、AWSを利用する日本企業にとって今後のAI活用環境の動向を占う重要な指標となります。

LMSYS:Blog(Chatbot Arena 团队)元記事へのリンクあり
参考

動画生成モデルMiniMax-H3がNVIDIA H200環境で最大6倍以上の高速化を実現

SGLang DiffusionチームがNVIDIA H200環境でMiniMax-H3のベンチマークを実施し、無損失で最大1.95倍、近似処理を含めると最大6.24倍の高速化を達成しました。既存のDiffusersと比較して、生成品質を維持したまま大幅な効率化が可能です。

なぜ注目?

動画生成AIの推論コスト削減と高速化は、実務での導入障壁を下げる重要な要素です。今後の商用AIサービスにおける動画生成機能のレスポンス向上に寄与する技術として注目されます。

公众号:卡尔的AI沃茨元記事へのリンクあり
参考

飛書と豆包が連携した企業向けAIエージェントの活用術

飛書(Lark)と豆包(Doubao)を組み合わせた企業向けAIエージェントの活用法が注目されています。リモート操作や自動タスク実行など、業務効率化に役立つ8つのテクニックが紹介されました。

なぜ注目?

既存のビジネスツールとAIエージェントを統合する手法は、業務フローの自動化を検討する企業にとって実用的な参考事例となります。

公众号:腾讯混元元記事へのリンクあり
参考

テンセント混元が翻訳モデルを440MBまで軽量化、ライブ配信のリアルタイム翻訳に導入

テンセントは翻訳モデル「Hy-MT2-1.8B」を量子化技術により440MBまで圧縮し、翻訳精度を維持したまま実用化しました。動画配信プラットフォームのライブチャットにおけるリアルタイム翻訳として導入されています。

なぜ注目?

エッジデバイスや低スペック環境でも高度な翻訳機能が動作する可能性を示しており、グローバル展開するサービスでのコスト削減やUX向上に寄与する技術として注目されます。

Tomer Tunguz 博客(VC 分析)元記事へのリンクあり
参考

NVIDIAの四半期売上高が1000億ドルを突破、半導体業界で初の快挙

NVIDIAの直近四半期の売上高は前年同期比106%増の960億ドルに達し、次四半期の売上高見通しは1080億ドルとなりました。データセンター向け売上ではハイパースケーラー以外の顧客層が拡大しており、支払い条件の緩和など柔軟な販売戦略も進めています。

なぜ注目?

AIインフラの需要が依然として極めて高いことを示しており、AI導入を検討する企業にとって、GPU供給状況や関連コストの動向を占う重要な指標となります。

参考

Andrew Ng氏のOpenWorkerがアップデート、セキュリティ特化のAIエージェントを搭載

DeepLearning.AIが提供するオープンソースのAIエージェント「OpenWorker」が更新され、コードの脆弱性スキャンやサプライチェーン攻撃の検知を行うセキュリティ機能が追加されました。ローカル環境で動作するため、機密性の高いコードを外部に漏らさず安全に運用可能です。

なぜ注目?

開発現場におけるAI活用において、セキュリティとプライバシーを両立させるローカル実行型エージェントの重要性が高まっています。

Claude:Blog(网页)元記事へのリンクあり
注目

ブラウザ操作を自動化する「Claude in Chrome」が全有料プランで正式利用可能に

Anthropicは、ブラウザ上でClaudeが自律的に操作を実行する機能を全有料ユーザー向けに公開しました。安全分類器による検証とプロンプトインジェクション対策を強化し、高い安全性を確保しています。

なぜ注目?

ブラウザ上の定型業務をAIが直接代行できるようになるため、事務作業の効率化や自動化ツールとしての活用が期待されます。

Claude:Blog(网页)元記事へのリンクあり
参考

WarpがClaudeを活用して構築したAIエージェントの自己改善サイクルとは

WarpはClaude上で、人間のフィードバックをAIの継続的な最適化に変換する「Agent Skills」の仕組みを構築しました。この手法はオープンソース開発の現場で数百人の貢献者によるコードレビューに活用されています。

なぜ注目?

AIエージェントを実務で運用する際、フィードバックを効率的に学習へ反映させるための実践的なフレームワークとして参考になります。

Google Research:Blog(网页)元記事へのリンクあり
参考

Googleが連続血糖測定(CGM)向け基盤モデル「GlucoFM」を発表

GlucoFMは、血糖値の緩やかなトレンドと短期的な変動を個別に解析するデュアルストリーム設計の軽量モデルです。臨床予測タスクにおいて既存モデルを上回る精度を達成し、少量のデータでも高い適応能力を示しました。

なぜ注目?

ヘルスケア分野におけるAI活用において、特定の生体データに特化した基盤モデルが実用的な精度向上を実現した事例として注目されます。

Apple:Newsroom(RSS)元記事へのリンクあり
参考

AppleがM5 MaxとM5 Ultra搭載の新型Mac Studioを発表、AI性能が最大4.3倍に向上

新型Mac StudioはAI性能が最大4.3倍、グラフィック性能が1.8倍に向上し、M5 Ultraモデルでは最大512GBのユニファイドメモリをサポートします。大規模言語モデルのローカル実行や、複数台による分散推論にも対応しました。

なぜ注目?

オンデバイスでの大規模AI処理が現実的になることで、機密データを外部に出さずに高度なAI活用を行う企業にとって、強力なワークステーションの選択肢となります。

公众号:数字生命卡兹克元記事へのリンクあり
参考

バイトダンスが業務効率化AIエージェント「豆包工作」をリリース

バイトダンスは、飛書(Lark)と豆包(Doubao)のチーム統合後初となる業務特化型AIエージェント「豆包工作」を発表しました。文書作成やメール、PC操作の自動化など、飛書の既存機能と深く連携します。

なぜ注目?

業務ツールとAIエージェントの統合が進む中、特定のワークフローを自動化する「スキル」の構築が、企業の生産性向上の鍵となることを示唆しています。

OpenRouter:Announcements(RSS)元記事へのリンクあり
参考

エディタ上で最適なAIモデルをリアルタイム選定する手法をOpenRouterが公開

OpenRouterは、タスク定義からコスト・遅延の比較、実機テストまでを行うモデル選定フレームワークを提案しました。MCPサーバーを活用し、Cursor等のエディタ上でモデルのランキングや価格を直接参照可能です。

なぜ注目?

トークン単価ではなく「タスク完了あたりのコスト」を重視する考え方は、AI導入の費用対効果を最適化したい事業者にとって重要な指標となります。

Meta Engineering Blog(RSS)元記事へのリンクあり
参考

MetaがAI大規模通信向けRDMAプロトコルMetaRoCEを公開

MetaはAIワークロードに最適化した新しいRDMA転送プロトコルMetaRoCEをオープンソース化しました。既存のRDMAソフトウェアスタックと互換性を保ちつつ、大規模なGPU環境での高スループットと低遅延を実現します。

なぜ注目?

AIインフラの構築において、汎用イーサネット環境で効率的な通信を実現する技術として、今後のネットワーク設計の標準化に影響を与える可能性があります。

Claude:Blog(网页)元記事へのリンクあり
参考

Claudeのメモリ機能が全環境で統合、ユーザーによる情報の閲覧・編集が可能に

ClaudeのチャットとClaude Cowork間で記憶が共有され、過去の文脈を跨いだ対話が可能になりました。ユーザーは設定画面から記憶内容を個別に確認・編集・削除でき、機密情報の取り扱いも制御可能です。

なぜ注目?

AIが過去の対話内容を保持することで、業務ごとの説明コストが削減され、よりパーソナライズされた効率的なAI活用が期待できます。

NVIDIA Blog(RSS)元記事へのリンクあり
参考

NVIDIAの次世代アーキテクチャVera Rubin NVL72がAIエージェントの電力効率を最大30倍に向上

NVIDIAの測定データによると、Vera Rubin NVL72はAIエージェントのワークロードにおいて、GB300 NVL72と比較してメガワットあたりのスループットが最大30倍に向上しました。また、100万トークンあたりのコストを最大35倍削減できる見込みです。

なぜ注目?

AIエージェントの運用コストと電力消費を劇的に改善する可能性があり、大規模なAIシステムを導入する企業のインフラ選定において重要な指標となるでしょう。

TechCrunch:AI(RSS)元記事へのリンクあり
参考

OpenAIが全業務対応のAIエージェントChatGPT Workを展開、非エンジニアの自律作業を支援

OpenAIは非エンジニア向けにCodexを刷新した「ChatGPT Work」を月額20ドルから提供開始しました。LLMを活用して多段階の業務を自律的に完結させることを目指し、組織内での普及拡大を図っています。

なぜ注目?

ホワイトカラーの業務プロセスがAIエージェントによって自動化される転換点となる可能性があり、自社の業務フローにどう組み込むべきか検討が必要です。

参考

開発者向けAIエージェントKiroにGPT-5.6モデルが導入されコスト効率が向上

ソフトウェア開発用AIエージェントKiroにGPT-5.6モデル(Sol、Terra、Luna)が搭載されました。AWSとの連携により、開発タスクにおけるコストを最大82%削減しつつ、コード品質の向上が期待できます。

なぜ注目?

AIを活用した開発環境において、モデルの性能向上とコスト削減が同時に進むことで、開発業務の自動化や効率化がより現実的な選択肢となります。

Tomer Tunguz 博客(VC 分析)元記事へのリンクあり
参考

AIエージェントの適切な稼働期間とは?長期運用に伴うリスクと設計のヒント

AIエージェントを長時間稼働させると、文脈の蓄積による精度低下や不要な指示の残留、セキュリティリスクが生じます。日常的なタスクは24時間でセッションをリセットし、特定の処理は短命なサブエージェントに委任する設計が推奨されます。

なぜ注目?

AIエージェントを業務に導入する際、安定した運用とセキュリティを両立させるための設計指針として役立ちます。長期的な自律動作を前提とするシステム構築において、リセット戦略を検討する際の重要な判断材料となります。

IT之家(RSS)元記事へのリンクあり
参考

OpenAI幹部が警告:AIによるサイバー攻撃への備えを企業に要請

OpenAIのグローバル担当責任者は、AIモデルが複雑なサイバー攻撃を計画・実行する能力を持ち始めていると指摘しました。同社は安全性を優先するため一部のモデル開発を一時停止し、政府に対して強制的な安全基準の策定を求めています。

なぜ注目?

AIが攻撃の高度化に利用されるリスクが現実味を帯びており、企業はセキュリティ対策の再評価と、AI導入時の安全基準の策定が急務となります。