英伟达Blackwell GPU需求暴涨,未来12个月供应量完全售罄,在日常生活中,我们经常拍摄有趣的照片和视频,但缺乏合适的音乐。Suno推出的新功能“Suno Scenes”解决了这一难题,用户可以上传照片或视频生成匹配氛围的歌曲,让照片和视频更生动有趣。,最近,微软正致力于开发一种能实时观察用户行为的 AI 伴侣,旨在建立深厚的互动关系。这反映出人类对于倾诉、理解和陪伴的基本需求。同时,Windows 的新功能 Recall 可深入挖掘用户的数字历史,重现过去的点滴经历。Zoom 推出 AI 克隆功能,让用户派遣数字版自己参加会议,提高工作效率。,6、OpenAI、谷歌等100多家公司支持欧盟人工智能法案,研究人员开发的AI模型DIAMOND能够模拟《反恐精英:全球攻势》游戏,运行在Nvidia RTX3090显卡上,每秒10帧的速度。尽管存在一些缺陷,但未来有望通过增加数据和计算能力来改善模型性能。
🌟 Mira Murati离职,标志着OpenAI高层人事大变动。📈 Mark Chen晋升为新任高级副总裁,负责研究部门领导。🤔 首席研究官Bob McGrew和研究副总裁Barret Zoph也宣布离职。,13、开源多模态模型Molmo 能够识别图像中的物体并生成准确描述
🚀 Nvidia股价创下138.07美元新高,年内涨幅近180%。📊 公司在AI芯片市场占有率高达70%至95%,市值达3.4万亿美元。💡 CEO黄仁勋表示新一代Blackwell芯片需求“疯狂”,已售罄至明年。,🌟 台积电Q3净利润达101亿美元,同比增长54%。💻 人工智能推动高性能芯片需求,助力业绩增长。🚀 台积电持续扩大生产能力,以满足市场日益增长的需求。,✨ Zoom计划推出数字分身功能,将用户视频转化为AI驱动的逼真数字化身,提高异步交流效率。💡 深度伪造技术的普及使得区分真相和虚假信息变得困难,可能导致虚假视频的滥用。🔒 Zoom对安全措施描述模糊,仍需加强保护措施以防止恶意虚假视频的生成。,9、惊艳!AI模型DIAMOND可模拟《反恐精英》,单张RTX3090就能运行
美国联邦贸易委员会(FTC)针对五家涉嫌虚假宣传和欺诈行为的人工智能公司展开执法行动,强调保护消费者和市场公平。部分公司已达成和解,但仍有公司选择对抗指控。专家对监管措施存在担忧,称可能抑制创新。,猛了!Meta震撼发布Llama3.2视觉方面吊打所有闭源模型?Meta在其年度Meta Connect2024大会上发布了Llama3.2,旨在提升边缘AI和视觉任务的能力。新推出的Llama3.2模型包括11亿和90亿参数的中型视觉模型,以及1亿和3亿参数的小型模型,特别优化了在移动设备上的使用。,🤖 Toy Box Flux是专注于生成3D玩具设计的人工智能模型,改变了玩具设计方式。🎨 独特训练方法和精益求精的训练过程为玩具设计注入新鲜血液,展现出可爱风格。🚀 未来计划强化模型性能,为玩具设计领域带来更多可能性。,🌟 技术浪潮中的泡沫现象:少数企业将脱颖而出创造社会价值。🚀 AI模型准确性提升:Chatbot能提供可靠答案。💡 技术革命将替代辛苦工作:创造更舒适新工作。,西湖心辰开源中文情感端到端语音大模型Westlake-Omni西湖心辰宣布开源其研发的Westlake-Omni模型,作为全球首个开源的中文情感端到端语音交互大模型。该模型采用离散表示法统一文本和语音模态,注重实时性,提供零延迟体验。具备出色的情感理解与表达能力,生成清晰、自然、富有表现力的中文语音。期望通过开源鼓励更多开发者参与中文情感语音交互技术的发展。
🚀 Molmo以小巧高效的设计理念挑战传统商业模型🎯 Molmo引入指向功能,拓展人机交互和增强现实应用可能性💡 Molmo在性能评估中表现亮眼,仅次于GPT-4o,排名第二,在这篇文章中,OpenAI向法庭申请驳回马斯克对公司的诉讼,称其为“骚扰”行为。文章揭示了马斯克和OpenAI之间的法律纠纷背景,强调马斯克的指控缺乏证据,并质疑他的法律地位。
🔒 数据隐私成为2024年生成性AI的主要担忧,关注从22%跃升至72%。📈 78%的商业领袖将“安全和保障”列为伦理技术原则之一,强调安全性的重要性。⚖️ 欧盟AI法案的实施影响深远,促使公司在AI使用上进行必要的调整与合规。,OpenAI全新多模态内容审核模型上线:基于 GPT-4o,可检测文本和图像数字时代对内容安全问题的重视日益增强,OpenAI推出了名为“omni-moderation-latest”的多模态内容审核模型,基于最新的GPT-4o技术,能准确识别有害文本和图像。这一更新为开发者提供强大工具,构建更强大的审核系统。新模型支持对文本和图像输入进行审核,尤其在处理非英语内容时表现出色,提高了准确性和检测能力,确保用户在更安全的空间中交流。,🌟 Kimi 助手更新语音通话功能,提升用户互动体验。🎤 支持实时字幕和可调节声音,交互更自然。🤖 引入声音克隆技术,增加趣味性和应用场景。,🎮 DIAMOND模型能模拟CS:GO游戏,运行速度达每秒10帧。📊 仅使用87小时游戏数据训练,仍能模拟复杂游戏场景。🐛 存在缺陷,如无限跳跃和路径偏离导致模拟崩溃,但未来有改善潜力。