OpenAIが最新リリースした画像生成モデルDALL-E 3は、ChatGPTと深く統合され、複雑な言語指示の理解能力が大幅に向上しました。DALL-E 3は、指示に従って一貫性のある詳細な画像を生成する能力において、以前のバージョンや他の競合製品を明らかに凌駕しています。DALL-E 3は、10月にChatGPT PlusおよびEnterpriseユーザー向けに公開される予定です。OpenAIはDALL-E 3を活用する一方で、安全面と著作権保護にも多くの取り組みを行っています。
関連推奨
有名な学者が純音声によるAIの指揮に体験した没入型の1週間
テクノロジー評論家アジーム・アズハーはロンドン出張中、ノートPCをアムステルダムの自宅に忘れ、1週間の「音声のみの仕事」を実験。SlackやWord、Excelなど画面とキーボード前提の業務が一変し、人とコンピュータの未来への認識を覆すとともに、音声作業の可能性を考えさせた。....
OpenAIが175ページの4次元証明原稿を公開し、数学の百年の難問に挑む
OpenAIは最近、722編の先端的な数学原稿を公開しました。そのうち2篇の核心論文は、数学の世紀的難問であるKakutani予想に焦点を当てています。一つは3次元のKakutani最大関数予想を対象とし、もう一つは4次元一般のKakutani集合の次元を完全に証明しています。この進展により、多次元数学の認識境界が刷新され、AIが先端基礎科学研究においてどのような役割を果たすのかという深い議論が世界中の学術界で巻き起こっています。
Cloudflare がオープンソースの重み決定モデルである Clef-omni をリリース。音声および映像のマルチモーダル入力をサポート
Cloudflareは10月9日、オープンウェイト意思決定モデル「Clef-omni」を発表。従来のテキスト・画像処理に加え、音声と完全な動画を新規サポートし、単一API呼び出しでマルチモーダル内容を同時処理可能。従来Clefはテキスト・画像・一定間隔で抽出した静止画のみ対応だったが、Clef-omniはwavやmp3等の音声形式をネイティブ対応し、マルチモーダル強化とアーキテクチャ解析を扱う。....
OpenAIが数学関連の大規模な研究成果を公表し学界を揺るがす。学者らが学術協力の伝統を脅かすことを懸念
OpenAIは700以上の内部で開発された先端的なAIモデルによって生成された数学研究論文を公開し、数学界において広範な注目と激しい議論を引き起こした。一部の学者はAIが数学分野での突破に感動しているが、専門家の中にはその影響が学術環境や若手研究者に与える恐れを懸念している。若手研究者の成果が圧迫され、データのセキュリティが疑問視されている。ニューヨーク大学の数学科教授であるバッカマスター氏は、OpenAIがこのような膨大な研究成果を一度に公開したことに批判を述べた。
評価額140億ドル!OpenAIの年間収入は500億ドルに急増し、新たな大規模資金調達を検討
FTやAxiosなど外媒によると、OpenAIの9月末時点の年換算売上高は約500億ドル。以前の約700億ドルは主に会計基準の違いによる。Anthropicはクラウドパートナー経由の販売で顧客支払額全額を計上し分配金を費用計上。OpenAIは一部取引で自社取り分のみを売上計上。両社とも米国GAAPに準拠。基準差が原因。....
VIP会員