强!ChatGPT 月访问量突破31亿,首次超越必应搜索引擎!,🔥 Pika1.5版本新增四种新特效,包括粉碎、溶解、瘪掉和“ta-da”特效,让视频内容炫目多彩。💰 Pika Labs吸引巨额投资,用户数量迅速增长,显示其受欢迎程度和市场潜力。🎨 提供多样的订阅计划,满足用户不同的创作需求和经济实力。,6、炸了!OpenAI人事大震荡,CTO、首席研究官纷纷宣布离职!,6、OpenAI、谷歌等100多家公司支持欧盟人工智能法案,7、200万用户量!Hugging Face旗下Gradio5发布:用自然语言轻松构建AI应用
1、豆包推出Ola Friend智能体耳机:售价1199元,5、比FLUX快100倍!英伟达联手MIT、清华推出超快AI图像生成模型Sana,笔记本也能秒速出图!,Cove是一家由前Google Maps核心团队成员创立的AI初创公司,致力于开发新一代智能工作空间,解决AI对话工具在复杂项目协作中的限制。他们推出的可视化工作空间结合AI协作,提供更自然的工作方式,已获得600万美元种子轮融资。
9、12亿美元出售Drift后,前HubSpot高管再创业,让AI替你管理客户!,PMRF(后验均值修正流)算法是图像处理领域的一项创新技术,解决了图像恢复中失真与感知质量之间的矛盾,开辟了高质量图像重建的新可能。其独特之处在于在多种图像恢复任务中展现卓越性能,取得了令人瞩目的成绩,平衡了失真和感知质量。,英伟达Blackwell GPU需求暴涨,未来12个月供应量完全售罄
12、OpenAI在版权诉讼中将披露训练数据,但仅限律师查看,研究人员开发的AI模型DIAMOND能够模拟《反恐精英:全球攻势》游戏,运行在Nvidia RTX3090显卡上,每秒10帧的速度。尽管存在一些缺陷,但未来有望通过增加数据和计算能力来改善模型性能。,在日常生活中,我们经常拍摄有趣的照片和视频,但缺乏合适的音乐。Suno推出的新功能“Suno Scenes”解决了这一难题,用户可以上传照片或视频生成匹配氛围的歌曲,让照片和视频更生动有趣。,📌 创新框架DreamWaltz-G能根据文本描述生成生动的3D可动画头像。🎨 结合骨骼引导的得分蒸馏和混合3D高斯表示,提升头像生成的一致性和动画表现力。🎥 支持形状控制、视频重演和多主体场景构建,拓展了数字内容创作的可能性。🔍 深圳市睿域科技有限公司确认音频为嫌疑人使用其自主研发的AI配音大模型平台克隆而成,已加强安全管控。👮♂️ 警方抓获伪造音频传播谣言的嫌疑人王某,已采取刑事强制措施,案件正在进一步侦办中。🔗 公司已启动内部审核机制,强化用户身份认证和音频生成的安全管控,确保技术合法合规应用。
🌟 GPT-4在性别识别测试中达到了100%的完美准确率,超越了DeepFace模型。📊 GPT-4的年龄估算准确率为74.25%,但对年长者的估算可能较宽泛。🔒 研究发现可绕过GPT-4的安全机制,需加强对大型语言模型安全性的研究。,8、OpenAI 申请法庭驳回马斯克诉讼,称其为 “骚扰” 行为,9、惊艳!AI模型DIAMOND可模拟《反恐精英》,单张RTX3090就能运行,🌟 马斯克对 OpenAI 的多项诉讼被 OpenAI 称为 “骚扰”,并申请驳回📉 OpenAI 强调马斯克的指控缺乏证据,称其为不切实际的主张。⚖️ 马斯克声称 OpenAI 未遵循创始协议的承诺,但法律上被质疑无权提出此类指控。,Zoom计划推出数字分身功能引发了人们对于深度伪造技术的担忧。虽然这项功能能提高视频创作效率,但也可能带来虚假信息传播的风险。
🚀 Elias Torres从17岁移民美国到创立Agency,展现现实版美国梦的传奇故事。💡 Agency利用AI技术深度学习客户数据,自动化处理客户需求预测、日程安排等任务,填补CRM系统空白。💼 Agency获得1200万美元种子轮融资,得到Sequoia合伙人和HubSpot联合创始人的支持,展望广阔的发展前景。,✨ Zoom计划推出数字分身功能,将用户视频转化为AI驱动的逼真数字化身,提高异步交流效率。💡 深度伪造技术的普及使得区分真相和虚假信息变得困难,可能导致虚假视频的滥用。🔒 Zoom对安全措施描述模糊,仍需加强保护措施以防止恶意虚假视频的生成。,OpenAI正着手升级其视频AI Sora,旨在生成更长、更高质量的视频片段。初始版本存在生成时间过长和风格、物理错误问题。视频AI市场竞争激烈,Sora需加快步伐以保持竞争力。,📹 Firefly AI视频模型让用户通过文本创建和修改视频内容,为创作者们提供全新创作空间。🖼️ Photoshop新增多项AI工具,如移除工具和生成填充,帮助用户更轻松地编辑图像。🔍 Adobe承诺只使用授权内容训练模型,并推出内容凭证增加透明度。
OpenAI在最新的版权诉讼中达成协议,同意向原告律师披露用于训练生成性AI模型的数据。这一举措旨在满足版权诉讼的需求,但数据查看过程受到严格控制,确保安全性。未来可能面临更多法规要求,推动AI数据透明度的要求。,💡 CogView3性能惊人,比SDXL高出77%,推理速度仅为SDXL的十分之一。,在2024年9月,OpenAI的ChatGPT取得了里程碑式成就,其访问量首次超越微软必应搜索引擎。ChatGPT在全球和移动应用上的使用量显著增长,展现出稳定的增长趋势。OpenAI扩大了ChatGPT的免费服务,可能影响其未来盈利能力。
🌟 o1模型被称为能显著减少 AI 偏见,但测试结果显示其表现不如预期💡 o1在隐性歧视方面表现优于 GPT-4o,但在显性歧视上却更糟糕。💰 推理模型 o1成本高,运行缓慢,未来仍需在多个方面改进。,🎵 用户上传照片或视频即可生成匹配氛围的歌曲,提升作品趣味性。📸 不仅适用于搞笑梗图和自拍视频,甚至随手拍的菜单照片也能生成适配音乐🎶 根据图片色调和文字信息匹配音乐风格,让用户产生特定旋律的感觉。,🌟 GPT-4在性别识别测试中达到了100%的完美准确率,超越了DeepFace模型。📊 GPT-4的年龄估算准确率为74.25%,但对年长者的估算可能较宽泛。🔒 研究发现可绕过GPT-4的安全机制,需加强对大型语言模型安全性的研究。
英伟达与麻省理工学院、清华大学合作开发的Sana框架能高效生成高达4096×4096分辨率的图像,且在笔记本电脑GPU上运行。Sana-0.6B速度快、规模小,生成1024×1024分辨率图像不到1秒。虽存在局限性,但Sana在4K图像生成方面性能优异,未来将构建高效视频生成流程。,特斯拉计划在10月10日举办活动展示备受期待的Robotaxi无人驾驶出租车,马斯克表示这一天对特斯拉意义重大。特斯拉CEO马斯克回应电动公交车供暖问题,表示特斯拉电动汽车在寒冷地区表现良好,预示传统公交车可能被淘汰。网友拍到特斯拉Robotaxi伪装车,外形独特,可能采用Cybertruck设计。,英伟达Blackwell GPU需求暴涨,未来12个月供应量完全售罄,Midjourney最近公布了一系列令人兴奋的更新和即将推出的新功能,展示了公司在AI图像生成领域的快速发展和创新。团队正积极推进多个项目,注重提升质量和开发核心功能,而不是急于发布新产品。
最近德勤发布的报告揭示了数据隐私在生成性人工智能中的重要性,专业人士对此担忧上升。安全和保障被78%的商业领袖列为伦理技术原则之一,欧盟AI法案的实施对公司产生深远影响。,🚀 Westlake-Omni是全球首个开源的中文情感端到端语音交互大模型,注重实时性和零延迟体验。💡 模型具备出色的情感理解与表达能力,能生成清晰、自然、富有表现力的中文语音。🌱 西湖心辰期望通过开源Westlake-Omni模型,促进更多开发者参与中文情感语音交互技术的发展,3、小红书下一个爆火玩法?Suno新功能Suno Scenes给你的“梗图”加分!
谷歌NotebookLM推出新功能,通过分析视频转录文本提炼关键信息,让用户轻松获取YouTube视频精华内容,提高学习效率。用户可点击主题获取详细信息,提出问题并获得建议,支持音频录音功能,帮助用户搜索转录内容和创建学习指南。,OpenAI全新多模态内容审核模型上线:基于 GPT-4o,可检测文本和图像数字时代对内容安全问题的重视日益增强,OpenAI推出了名为“omni-moderation-latest”的多模态内容审核模型,基于最新的GPT-4o技术,能准确识别有害文本和图像。这一更新为开发者提供强大工具,构建更强大的审核系统。新模型支持对文本和图像输入进行审核,尤其在处理非英语内容时表现出色,提高了准确性和检测能力,确保用户在更安全的空间中交流。,欧盟最新推出的人工智能倡议吸引了100多家公司的支持,其中包括OpenAI、谷歌等科技巨头。虽然苹果和Meta选择观望,但行业对人工智能发展的重视和责任感仍然显著。该倡议旨在推动企业自律,为未来人工智能发展奠定基础。,🌟 技术浪潮中的泡沫现象:少数企业将脱颖而出创造社会价值。🚀 AI模型准确性提升:Chatbot能提供可靠答案。💡 技术革命将替代辛苦工作:创造更舒适新工作。,美图公司宣布其开发的AI短片创作工具MOKI正式对所有用户开放,为用户提供一站式成片能力,结合AI驱动的脚本、分镜、视频生成、配音、配乐能力,使普通用户能轻松上手,快速创作个性化短片。MOKI在中文语意理解准确性和东方视觉风格上表现出色,未来计划提供更多专业功能。
Adobe推出Firefly AI视频模型,Photoshop新增多个AI功能,Cove是一家由前Google Maps核心团队成员创立的AI初创公司,致力于开发新一代智能工作空间,解决AI对话工具在复杂项目协作中的限制。他们推出的可视化工作空间结合AI协作,提供更自然的工作方式,已获得600万美元种子轮融资。,🎵 用户上传照片或视频即可生成匹配氛围的歌曲,提升作品趣味性。📸 不仅适用于搞笑梗图和自拍视频,甚至随手拍的菜单照片也能生成适配音乐🎶 根据图片色调和文字信息匹配音乐风格,让用户产生特定旋律的感觉。,13、开源多模态模型Molmo 能够识别图像中的物体并生成准确描述,🎮 DIAMOND模型能模拟CS:GO游戏,运行速度达每秒10帧。📊 仅使用87小时游戏数据训练,仍能模拟复杂游戏场景。🐛 存在缺陷,如无限跳跃和路径偏离导致模拟崩溃,但未来有改善潜力。