相关推荐
IBM 和联合国推出免费使用的先进 AI 能源预测工具
IBM与联合国开发计划署(UNDP)近日宣布推出两个突破性的免费AI交互模型,旨在预测全球能源获取情况并模拟能源公平性。这一合作标志着人工智能技术在应对全球能源挑战方面迈出了重要一步。新推出的电力接入预测模型利用AI技术分析人口、城市化、基础设施和卫星数据,为102个国家提供至2030年的电力接入预测。与此同时,清洁能源公平指数作为同类指数中的首创,使用AI统计地理空间模型,基于环境、社会和经济因素为53个非洲国家生成能源公平性评分。图源备注:图片由AI生成,图
YouTube引入DeepMind Veo模型 为创作者想象插上翅膀
YouTube正式宣布将Google DeepMind的Veo模型整合到其短视频平台YouTube Shorts中,这一举措标志着短视频创作进入了一个全新的AI驱动时代。此次技术升级不仅为创作者提供了前所未有的创意工具,更将彻底改变用户与平台的互动方式。核心的技术创新集中体现在名为"Dream Screen"的全新功能上。这项功能巧妙结合了Imagen3和Veo两大先进AI模型,为创作者打造了一个高度智能化的创作环境。具体而言,Dream Screen首先通过Imagen3生成四种风格各异的图像,供创作者根据个人偏好选择。随后,Veo模型接棒,将
AI生成媒体平台Fal.ai获2300万美元融资 a16z等知名投资方加持
专注于AI生成音频、视频和图像开发的平台Fal.ai近日宣布完成总额2300万美元的融资。这笔资金来自两轮融资:由Kindred Ventures领投的1400万美元A轮融资,以及此前未公开的由Andreessen Horowitz (a16z)领投的900万美元种子轮融资。其他投资者还包括Black Forest Labs联合创始人Robin Rombach和Perplexity CEO Aravind Srinivas。Fal.ai由前亚马逊软件开发人员Gorkem Yurtseven和前Coinbase机器学习开发负责人Burkay Gur于2021年共同创立。两位创始人在疫情期间合作开发业余项目时,意识到对AI云基础设施,尤其是运行生成式AI模
腾讯出品!AI音频模型 EzAudio AI,让文本秒变逼真声音
近日,约翰霍普金斯大学与腾讯 AI 实验室联合推出了一款名为 EzAudio 的新型文本到音频生成模型。这项技术承诺以空前的效率和高品质文本转换为声音,标志着人工智能和音频技术的重大飞跃。EzAudio 的工作原理是利用音频波形的潜在空间,而不是传统的声谱图,这一创新让它能够在高时间分辨率下工作,且无需额外的神经声码器。EzAudio 的架构被称为 EzAudio-DiT(扩散变换器),采用了多项技术创新来提高性能和效率。其中包括一种新的自适应层归一化技术 AdaLN-SOLA、长跳连接,以及先进的
ChatGPT 高级语音模式或将于9月24日全面上线
据科技媒体 testingcatalog 最新消息,ChatGPT 的高级语音模式可能将于9月24日正式发布,这一功能的全面推出无疑将为用户带来前所未有的交互体验。早在今年7月,OpenAI 已向部分 ChatGPT Plus 用户开放了高级语音模式的测试权限。据悉,该功能能够生成极为逼真的音频响应,使用户仿佛与真人对话,大大提升了人机交互的自然度和沉浸感。此次更新信息的可靠性得到了进一步佐证。有开发者在高级语音模式的常见问题页面中发现了一段颇具玄机的代码:"hasSeenAdvancedVoice/2024-09-24"。这一字符串似乎
