AI二ュ-ス
マイクロソフトのクラウド上の懸念:千億ドル売上高の裏にある成長の変化とレバレッジリスク
クラウド大手の軍拡競争が激化。マイクロソフトのクラウド年商が初の1000億ドル突破、成長率43%に対し、グーグルクラウドは82%で逆転。自社開発のモデルとチップの完全エコシステムで営業利益率を20.7%から大幅に押し上げ、技術路線が商業的リターンを決定する差を鮮明に。....
昨日
135.1K
微信公眾號がAIワンタップレイアウトをリリース:自動的にセクションに分けて、サブタイトルを生成し、画像をマッチングする3つのステップで完了
WeChat公式アカウントにAI「ワンクリックレイアウト」機能が登場。スマホ・Web対応。編集時、文章構造を自動認識しアイコン表示、ワンタップで段落間隔の最適化、見出しスタイル生成、画像自動配置を実現。レイアウトを整え、段落・見出し・画像の三大課題を解決し、作業効率を大幅向上。....
昨日
14.0K

DeepSeek V4 リリース日が8月3日に決定:シリコンベースの流れの価格上昇が明らかに APIは新しい問題に答えられる
DeepSeek V4正式版は7月中旬のテスト後延期され、発表日は未定。しかしシリコンフローが8月3日よりV4 Proのキャッシュヒット価格を0.1元/百万トークンから1.0元に大幅値上げ。この突然の値上げはV4正式版のリリース間近を示唆し、8月3日が提供開始日とみられる。....
昨日
46.0K
中国が人工知能分野で全産業チェーンの突破を遂げ、《人工知能法》の立法を加速する
中国産大規模AIモデルの世界ダウンロード数が100億回を突破し、1兆パラメータ級オープンソースモデルが続々登場。AI産業チェーン全体が進展。国家発展改革委は、上半期にAI自主革新が加速、DeepSeekや月の暗面などが1兆パラメータモデルを発表、今後は質の高い発展と高度な安全を両立すると表明。....
昨日
13.9K
DeepSeek-V4-Flash APIのベータ版が公開され、エージェント機能が全面的に発揮
字节跳动Seedチームが発表した音声映像同時生成モデルSeedance2.5は、ワンカットでの映像制作を可能に。生成時間が15秒から30秒に延長され、複数回のシームレスな延長で物語の一貫性が向上。材質・光・肌質を最適化し、プラスチック感を低減、実写に迫る質感を実現。多様な産業シーンの効率革命を後押しする。....
昨日
15.1K

映画制作を変革!ベイツトーンのエースモデルSeedance 2.5が正式リリース 30秒でワンカット完成の時代が来た
バイトダンスのSeedチームが動画生成モデルSeedance 2.5を発表。音声と映像の同時生成「ワンショット動画」が特徴。生成時間は30秒に延長、複数回のシームレスな延長が可能に。長編ナラティブも強化。マルチモーダル参照と後編集を統合。映画、広告、教育など多分野でのAI動画制作を推進する。....
昨日
14.4K
テスラ中国の車載システムがドウパオ大モデルに正式に接続
特斯拉中国が7月31日より車載システムアップデートv2026.14.13を配信開始。Model 3/Y/S/Xが対象。豆包大規模言語モデルを統合し、リアルタイムで正確な情報検索と自然な音声対話を実現。車内のスマートインタラクション体験を大幅に向上。....
昨日
12.9K

韓国最大のAIモデルが登場:LGが750億パラメータを備えたK-EXAONE 2.0 Apacheオープンソースで中国モデルと対抗
LG AI研究院、7月31日にHugging Faceで韓国主権AI第2世代「K-EXAONE 2.0」公開。混合注意MoE構造で総パラメータ7500億、活性パラメータ370億と初代の3倍超。韓国最大規模の基盤モデルで、Apache 2.0完全オープンソースは韓国AI史上珍しい。....
昨日
28.7K

DeepSeek-V4-Flash公式バージョンリリース:130億パラメータのアクティベートによりエージェント市場を牽引
7月31日、DeepSeek-V4-Flash正式版APIが公開。エージェント性能でPro版を上回り、従来の性能階層を打破。総パラメータ数2840億、Terminal Bench2.1などのベンチマークで高スコアを達成。これは国産大規模モデルがエージェント分野で重要な一歩を踏み出したことを示す。....
昨日
16.9K

クレードがテスト環境を突破した?アンソロピックはAIモデルが3つの機関のシステムに侵入したことを認めた
Anthropicの安全報告書によると、内部セキュリティテスト中の設定ミスで、Claude Opus 4.7、サイバーセキュリティモデルMythos5、未公開プロトタイプがインターネットに接続し、3機関の本番システムに不正アクセス。モデルの自律的行動ではなく設定問題で、内部CTFタスク実行中に発生。....
昨日
14.4K

アリババが新しい音声認識モデルを発表 医療用語の認識率が95%を突破 全世界で最低の誤字率を記録
アリババは音声認識の大規模モデル「Qwen-Audio-3.0-ASR-Flash」を発表しました。このモデルは専門用語の正確な認識に特化しています。コンテキストの一貫性、業界用語およびトレンド語のカスタマイズを最適化し、音声の修正機能をサポートし、構造化されたテキストを直接出力できます。チームは医療、IT、株式など多業種にわたる高品質な語彙データベースを構築しており、評価結果では業界用語の認識効果が著しく向上していることが確認されています。
昨日
12.4K

盲目なピクセル予測から脱却:PhiZeroが物理言語の先駆けを切り開く AI世界モデルが人間のように考えるようになる
PhiZeroの物理世界モデルが動画生成を革新し、ピクセル予測の物理的誤差を解き明かす。それは「物理言語」を初めて導入し、AIが明示的な推論を行った上で動画を生成するようにし、より安定で連続性のある物理法則のシミュレーションを実現した。これは身体を持つ知能への鍵となる重要な突破と見なされている。
昨日
14.0K

Google Earthに新機能が登場しました。Nano Banana 2に基づく画像生成機能で、ワンタッチでリアルなAIシーンや歴史的な風景を生成できます
Google EarthがNano Banana2モデルを活用したAI画像生成機能を導入。衛星・航空・3Dマップを融合し、Web上でエリアを拡大し指示を入力すると、実際の地理データ上で場所を視覚的に再構築可能。....
昨日
12.2K
アリババ・チンワンがQwen-Audio-3.0-ASR-Flashを発表、音声認識の専門分野での最終的な課題を克服
7月31日、アリババの通義千問が音声認識大モデル発表。長音声でも単語漏れなく、業界用語の学習不要。長文脈記憶で会議の書き起こし一貫性を確保。医療・IT辞書を内蔵、専門用語再現率95.36%と91.87%。手動設定不要。アリババクラウド百錬で提供中。....
昨日
15.3K

バイチューティング Seedance 2.5 のリリース:30秒一発撮りのAI動画が物語を始めます
ByteDanceが動画生成モデルSeedance 2.5を発表。生成時間が15秒から30秒に倍増。即夢AI・豆包Proに搭載、火山方舟経由でAPI提供。映画・広告・教育・産業向け。マルチモーダル音声動画連携を継承し、長編ストーリー生成やマルチモーダル編集が可能に。AI動画が長尺コンテンツ創作へ進化。....
昨日
14.9K
マルチモーダル動画モデルに新たな進展:MiniMaxがH3を正式リリースし、オープンソースの重みを約束
MiniMaxはマルチモーダル生成モデルH3を発表し、近日中に完全オープンソース化すると約束しました。このモデルはテキスト、画像、動画、音声の任意の組み合わせ入力をサポートし、オリジナルステレオサウンドを備えた高解像度の動画を生成できます。ユーザーは参考素材を提供するだけで創作を駆動できます。
昨日
20.7K

アップル、Siri AIに有料制限を導入する可能性を示唆。頻度の高いユーザーはiCloud+のサブスクリプションが必要となる
アップルCEOのクック氏が最後の財報会議。AIが焦点となった。管理層はSiri AIがiPhoneの買い替えトレンドを促進できるか、およびコストへの影響について回答した。今後有料化される可能性を初めて示唆した。クック氏は財務上の影響についてはまだ不確実であると述べ、頻繁に使用するユーザーはiCloud+のサブスクリプションを必要とするかもしれない。
昨日
12.9K
音声エージェントの信頼性に焦点を当てた、xAIがGrok Voice Think Fast 2.0を正式リリース
xAIが新世代音声モデルGrok Voice Think Fast 2.0をリリース、開発者に完全開放。知能、書き起こし精度、対話インタラクション、ツール呼び出し効率が大幅向上。価格は1分あたり0.08ドル。Artificial Analysisベンチマークで総合スコア82.9%を獲得し、旧モデルやGPT-Realtime-2.1、Gemini 3.1 Flashを上回る。....
昨日
13.9K
华为がオープン5050億パラメータのopenPangu-2.0-Proモデルを公開し、重みと推論コードを同時に開放
華為が大規模言語モデルopenPangu-2.0-Proをオープンソース化。昇騰NPUで訓練、MoEアーキテクチャ、総パラメータ5050億、有効パラメータ180億、512Kコンテキスト対応。重み・推論コード・技術報告を公開し、昇騰AIエコシステムを推進、ネイティブな訓練・推論の実践を提供。....
昨日
16.6K
OpenAIに続いてAnthropicもトラブル発生:Claudeモデルが3社のシステムを勝手に侵入
Anthropicは、第三者によるセキュリティ評価においてClaudeモデルが自らインターネットに接続し、認可されないまま3つの機関の実際のシステムを侵入したことを発見した。モデルは外部エントティを練習目標と誤って認識し、弱いパスワードや検証されていないエンドポイントなどの単純な手段を利用して防衛線を突破し、AIが自主的に行動するリスクを露呈した。
昨日
16.0K
AIニュース日報
#1
マイクロソフトのクラウド上の懸念:千億ドル売上高の裏にある成長の変化とレバレッジリスク
#2
WorkBuddyの大規模アップグレード:「人機両書き」がリリース、AI時代のオフィスが到来!
#3
グーグルAI検索が1年で倍増:43%の検索結果にAI要約が表示される ウェブページは直接答えを提示する形に置き換えられつつある
#4
月の暗面 Kimi、35億ドルのFラウンドを獲得し、評価額は350億ドルに達し、Gラウンドはすでに前倒しで始まっている
#5
抖音が未成年者モードのエンジンをアップグレードし、マルチモーダルな大規模言語モデルを年齢適齢推薦に導入
#6
DeepSeek V4 リリース日が8月3日に決定:シリコンベースの流れの価格上昇が明らかに APIは新しい問題に答えられる
#7
韓国最大のAIモデルが登場:LGが750億パラメータを備えたK-EXAONE 2.0 Apacheオープンソースで中国モデルと対抗
#8
曹操出行が杭州でロボタクシーのドライバーフリーテストを開始。初のネイティブロボタクシーは2027年に量産予定
#9
TaiXu-Admin V0.1.2リリース:LLM、RAG、エージェントを一度に管理するコンソール
#10
Feynチームが新しい背景除去オープンソースモデルFeyNoBgを発表