
😙【AIGC每日新闻】
【OpenAI发布GPT-4o:多模态AI模型新标杆】OpenAI刚刚推出了GPT-4o,这是一款先进的多模态模型,它整合了文本、视觉和音频处理能力,并在性能上设立了新的基准。GPT-4o在文本、视觉、音频、编码和非英语生成等方面的性能均优于GPT-4T。新模型的使用成本降低了50%,速率限制提高了5倍,生成速度是之前模型的两倍。GPT-4o还被发现是上周在Lmsys Arena中发现的神秘模型‘im-also-a-good-gpt2-chatbot’。新模型的其他升级包括:新的语音功能,如实时响应、情感检测和响应,以及将语音与文本和视觉结合的能力;演示展示了实时翻译、两个AI模型分析实时视频、以及使用语音和视觉进行辅导和编码协助等壮举;OpenAI的博客还详细介绍了3D生成、字体创建、图像内文本生成的巨大改进、音效合成等进步;OpenAI还宣布了一个新的ChatGPT桌面应用程序,专为macOS设计,具有刷新的用户界面,并直接集成到计算机工作流程中;GPT-4o、GPT模型以及记忆和数据分析等功能现在对所有用户开放,首次将高级功能带入免费层。GPT-4o模型目前正在向所有ChatGPT用户和通过API的用户推出,预计新的语音功能将在未来几周内推出。参考博客链接:https://www.youtube.com/watch?v=DQacCB9tDaw&ab_channel=OpenAI&utm_source=www.therundown.ai&utm_medium=newsletter&utm_campaign=chatgpt-s-new-voice
【Meta开发AI耳塞“Camerabuds”,与OpenAI和苹果竞争】据报道,Meta正在开发一款名为“Camerabuds”的AI驱动耳塞,旨在与OpenAI和苹果在可穿戴设备领域展开竞争。这款“Camerabuds”耳塞将具备以下特点:能够映射用户周围环境,通过内置摄像头识别物体并翻译外语;Meta已经拥有其AI驱动的Ray Ban智能眼镜,而OpenAI和苹果也在探索类似的AI可穿戴耳塞技术;潜在挑战包括设备体积、发热问题,以及隐私担忧,特别是对于长发用户可能会阻碍摄像头的视角。这一发展之所以重要,是因为尽管Meta在硬件领域的尝试并不总是成功,但马克·扎克伯格仍在大力投资他所相信的未来——一个每台设备都嵌入AI的未来。然而,当市场上出现完全集成AI的手机时,这类独立设备是否能够赢得用户的青睐,仍是一个值得关注的问题。参考博客链接:https://www.theinformation.com/articles/meta-explores-ai-assisted-earphones-with-cameras?utm_source=www.therundown.ai&utm_medium=newsletter&utm_campaign=chatgpt-s-new-voice
【AE Studio:将AI项目高成功率转化为现实】尽管85%的AI项目失败,AE Studio却擅长将雄心勃勃的想法变为现实。他们的成功秘诀是什么?超能力,以及像对待自己的初创公司一样对待每个项目。与AE Studio合作,你将获得:在AI、区块链、脑机接口(BCI)等领域的经过验证的专业知识;从创意到部署的端到端战略开发;为你的独特产品量身定制的解决方案;与伯克希尔哈撒韦公司、Global Shop Solutions、IncomeMax和Protocol Labs等客户成功合作的记录。AE Studio通过其专业的技术实力和对项目的深入投入,帮助客户克服AI项目开发中的常见障碍,实现创新想法的商业化。参考博客链接:http://ae.studio/therundown?utm_campaign=the-rundown-051424&utm_source=the-rundown&utm_medium=newsletter
🌄【今日份prompt工具推荐】
https://github.com/prompt-engineering/click-prompt