• 我的订阅
  • 头条热搜
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...非与启元世界多模态负责人吴昌桥,研究兴趣为多模态大模型、LLM Agents 等。本论文上线几天内在 github 上斩获 1000+ 星标。随着多类型大模型的飞速发展,全球 AI 已经进入到了多模交互时代。2024 年 5 月,OpenAI 推出了全新的多模...……更多
字节跳动推出对话式ai实时交互解决方案
...日宣布推出对话式AI实时交互解决方案,搭载火山方舟大模型服务平台。该方案通过火山引擎RTC实现语音数据的采集、处理和传输,并深度整合豆包・语音识别模型和豆包・语音合成模型,简化语音到文本和文本到语音的转换过...……更多
标贝科技GPT语音助手测评:看语音大模型如何重塑语音交互体验
...步,语音助手已经融入了我们生活的方方面面。同时在大模型落地千行百业的大潮之下,语音助手也快速卷入AI革命的浪潮中。GPT大模型作为一种强大的语言生成模型,通过语言理解、生成能力和上下文记忆能力,不断地自我完...……更多
刚刚,我们感受了一波最「像人」的国产AI,模型还是开源的
...EglhJA与此同时,智谱还重磅宣布,该功能背后的情感语音模型 GLM-4-Voice 同步正式开源。不久后,相关能力还将上线视频通话,为所有用户提供一个既能「看」又能「说」的 AI 语音助理。开源地址:https://github.com/THUDM/GLM-4-Voice自...……更多
OpenAI推迟上线语音功能,GPT-5或要等到明年,大模型技术速度正在放缓
出品 | 搜狐科技作者 | 梁昌均大模型技术进展肉眼可见地放缓了,OpenAI此前说好的语音功能也鸽了。OpenAI针对此前展示的高级语音功能发布最新进展称,原计划在六月底开始向少部分ChatGPT Plus用户推出alpha版本,但需要再花一个...……更多
OpenAI发布免费新品GPT-4o:可对音频、视觉和文本实时推理,与人自然对话,功能秒杀Siri
...布新产品,不是AI搜索引擎,也不是GPT-5,而是GPT-4o旗舰模型。OpenAI在ChatGPT中引入GPT-4o并免费提供更多功能。GPT-4o的“o”代表“omni”,意为全能,与现有模型相比,它在视觉和音频理解方面尤其出色。GPT-4o可以在音频、视觉和...……更多
语音能力再突破!讯飞星火语音大模型即将发布
...人机交互将迎来新的发展阶段。1月30日,讯飞星火认知大模型V3.5升级发布会即将举行,会上将同步发布讯飞星火语音大模型, 此外还将发布开源大模型等。2023年5月6日,科大讯飞正式发布了讯飞星火认知大模型,可以基于自然...……更多
讯飞星火首发智能体平台,敏捷触达大模型应用企业落地最后一公里
4月26日,讯飞星火大模型V3.5(以下简称“讯飞星火”)春季上新。面向用户高效准确知识获取的痛点,科大讯飞发布业界首个长文本、长图文、长语音大模型,不仅能够把各种信息来源的海量文本、图文资料、会议录音等进行...……更多
仅用4块GPU、不到3天训练出开源版GPT-4o,这是国内团队最新研究
...4o 的平均音频响应延迟 320ms。以 ChatGPT 为代表的大型语言模型(LLM)已成为强大的通用任务解决器,但大多数 LLM 仅支持基于文本的交互,这限制了它们在不适合文本输入输出的场景中的应用。GPT-4o 的出现使得通过语音与 LLM 进...……更多
别只盯着ChatGPT版Her,多模态AI拟人互动上,国内玩家也支棱起来了
...利用少量有标签和大量无标签数据视频数据来训练自己的模型,并对模型在无标签数据集上的表现和泛化能力进行评估。该赛道获胜的关键在于通过改进半监督学习技术来提高模型情感识别性能,比如预测情绪类别的准确率。自...……更多
全面透视豆包:功能、版本、价格、优势、应用
...率与竞争力。一、豆包介绍豆包是字节跳动公司基于云雀模型开发的 AI 工具,提供聊天机器人、写作助手以及英语学习助手等功能,它可以回答各种问题并进行对话,帮助人们获取信息,支持网页、客户端、APP、插件等形式。...……更多
《崩坏:星穹铁道》1.4版本内容介绍
...器及特效、角色「开拓者(存护•火)」的武器、NPC信使模型中,钻石材质有误的问题。 ● 修复了角色「素裳(巡猎•物理)」在转身时胸前流苏显示异常的问题。● 修复了特定战斗场景中,角色「三月七(存护•冰)」施...……更多
讯飞版「Her」横空出世全民开放!百变人设逼真丝滑,情绪价值逆天
...么接不上来,要么就开始「已读乱回」。但这次的小星,模型响应的快速和流畅度让人眼前一亮。即使随时打断、插话,小星依旧能做到秒回,这个快速反应能力,让我们的观感仿佛真人一般。比如,我们拿前段时间的全球大热...……更多
2022生成模型进展有多快,新论文盘点9类生成模型代表作
ChatGPT的出现,彻底将生成AI推向爆发。但别忘了,AI生成模型可不止ChatGPT一个,光是基于文本输入的就有7种——图像、视频、代码、3D模型、音频、文本、科学知识……尤其2022年,效果好的AI生成模型层出不穷,又以OpenAI、Meta...……更多
谷歌AI播客刚火,Meta就开源了平替,效果一言难尽
随着谷歌和 Meta 相继推出基于大语言模型的 AI 播客功能,将极大地丰富人类用户与 AI 智能体互动的体验。上个月,谷歌宣布对旗下 AI 笔记应用 NotebookLM 进行一系列更新,允许用户生成 YouTube 视频和音频文件的摘要,甚至可以...……更多
汉王语音王 App 发布:支持 AI 语音记录、对话翻译、同声传译
...息如下:据介绍,汉王语音王基于汉王自研多模态天地大模型研发,集成 AI 语音记录、智能翻译与同声传译等技术,支持 AI 精准转写、拍录同步(自动裁边)、话稿整理、智能总结及不间断实时翻译等功能。 AI 语音记录AI 语...……更多
云知声推出山海多模态大模型:实时生成文本、音频和图像
...家 8 月 26 日消息,云知声于 23 日宣布推出山海多模态大模型。通过整合跨模态信息,山海多模态大模型能够接收文本、音频、图像等多种形式作为输入,并实时生成文本、音频和图像的任意组合输出。▲云知声山海助手微信小...……更多
抢先OpenAI!Hume AI发布第二代情感智能AI,支持自定义语音,在线可玩
...提升,还支持自定义语音EVI 2集成了一个先进的语音生成模型和情感大型语言模型(eLLM),能够处理和生成文本及音频。这种多模态方法使得EVI 2生成的语音听起来更自然,语调更恰当,表现力更高,输出更连续。此外,在同一...……更多
CybotStar——大模型一站式应用开发平台
大模型在垂直产业正朝着不同的方向奋力进发。据研究机构调研指出:有四分之三的受访CEO认为,部署先进的生成式人工智能将为企业带来竞争优势。但一直以来,大模型落地产业似乎总是有些“水土不服”。直面大模型产业...……更多
喜马拉雅珠峰语音生成技术实现5秒极速克隆,亮相云栖大会
...新的自研语音技术成果,包括喜马拉雅珠峰语音生成式大模型和第二代智能语音交互系统,为参会者展示AIGC与文娱音频产业深度融合的最新成果。据了解,喜马拉雅珠峰语音生成式大模型是喜马拉雅的一项创新性技术,具备快...……更多
融资1600万美元,这家法国AI创企推新语音转录引擎,支持100种语言
...识别他的法语口音。他说:“考虑到目前大多数语音识别模型主要在英语音频数据上训练,存在固有的偏见,Gladia优先构建了第一个真正多语言的实时产品。”此外,Gladia引擎的特别之处在于能够即时从对话中提取信息,如来电...……更多
科大讯飞多语种技术,提供超1亿分钟公益服务
...冠军及7个语种非受限赛道冠军;2024年,讯飞星火语音大模型的首批37个主流语种的语音识别效果超过OpenAI最新语音大模型Whisper V3。 星火语音大模型首批覆盖语种中,24个主要语种识别率达到了90%(已超过实用门槛);13个重点...……更多
“寡姐”斯嘉丽·约翰逊怒怼OpenAI山寨其声音:连我的朋友都分辨不出来
...,强调所有配音均来自专业演员。此前,OpenAI推出新旗舰模型GPT-4o,该模型在保留了之前的五种语音模式的基础上,大大提升了图像和音频理解方面的能力,能够进行实时语音通信,可以识别音调、说话的人和背景噪音,甚至可...……更多
vivo发布自研大模型,为用户和开发者带来诸多惊喜
...发者大会于10月10日在广东深圳正式召开,vivo发布自研大模型——全新蓝心大模型矩阵,为用户和开发者带来诸多惊喜。在同日举办的人工智能会场上,vivoAI团队分享了在AI领域取得的最新成果,以前沿解决方案引领大模型创新...……更多
能“听懂”用户情绪的对话机器人,已成为营销获客新的“技术红利”
...活实验室在春节前做的一次暖心实验,依托京东云言犀大模型和言犀智能外呼产品,帮助那些害怕回家的人拨开云雾,看到那些心结背后的真实答案。教机器说话像真人,言犀用了什么“魔法”智能外呼拨出的电话,不仅能听懂...……更多
讯飞星火v4.0将于6月27日发布
6月11日消息,科大讯飞今年3月推出了讯飞星火大模型V3.5,而讯飞星火V4.0将于今年6月27日正式发布。科大讯飞董事长刘庆峰在公司成立25周年司庆活动上透露,讯飞星火V4.0发布时将展示最新的端到端智能语音落地成果,同时公...……更多
AI大模型时代,如何用RAG技术重塑传统智能客服问答机器人?
...险行业智能客服的调研,因为当时的AI还无法像现在的大模型一样理解大家的意图(文本+图片),所以原本智能对话机器人的实现不仅费时费力,且还没有一个很好的效果,导致“在智能对话机器人的部分,在晚上10:50我还测...……更多
趣丸科技副总裁兼CTO谢睿:多模态智能激发应用新场景 | 新质生产力·AI Partner大会
...沿技术研究和提供企业级解决方案。我们目前围绕四个大模型(生成式3D大模型、生成式音频大模型、生成式动作大模型、对话大模型)在开展技术自研,后续将推动规模化落地应用。前段时间GPT-4o的问世,相信大家都看到很多...……更多
openai免费开放chatgptvoice功能
...年9月推出了基于ChatGPT的文本转语音功能,使用神经网络模型从文本生成类似人类的语音。该功能此前仅面向ChatGPTPlus订阅用户提供,现在向所有免费用户推出。该系统通过采样配音演员录制的几秒钟音频,能够创建具有不同口...……更多
免费!免费!免费!GPT-4o是什么?是你想要的一切
...内,用户将会陆续自动更新到GPT-4o。GPT-4o作为新一代旗舰模型,把AI工具的使用门槛降到了更低的程度,不仅比上一代速度快两倍,能实现无延迟实时对话,而且用户不用注册,功能全部免费。此外,ChatGPT现在有桌面版本了,轻...……更多
更多关于科技的资讯:
当东明石化“EPOE”,遇上DeepSeek
大众网记者 王晓姝 济南报道在国际舞台上,中国“智”造正以前所未有的速度崛起,近日火爆全球的DeepSeek是其中代表
2025-03-01 21:17:00
震撼!一千四百年前古人竟已用上储粮黑科技
快科技3月1日消息,近日,据央视报道,一项关于古代储粮技术的发现再次引发了热议。原来,在一千四百年前,古人就已经掌握了一种堪称“黑科技”的储粮秘诀
2025-03-01 13:38:00
春晚出圈的宇树科技招人了:年薪可达百万!
快科技3月1日消息,蛇年春晚舞台上,来自杭州的宇树科技凭借出色表现刷屏热搜。而就在今日,杭州今年新春最大规模的线下人才招聘会于上午9时在杭州大会展中心盛大启幕
2025-03-01 14:08:00
凌晨退税喜提5万多!网友直呼:3月第一份快乐
快科技3月1日消息,三月第一天,许多网友卡点干的第一件事,就是退税!2024年度个人所得税综合所得汇算清缴今天开始了,汇算的时间为3月1日至6月30日
2025-03-01 14:38:00
抗病5年 知名歌手方大同去世:年仅41岁
快科技3月1日消息,今日中午,歌手方大同独立音乐厂牌@赋音乐FUMUSIC 发布消息称:以积极的态度面对顽疾5年, 方大同于2025年2月21日早晨
2025-03-01 14:38:00
董明珠回应500亿做芯片质疑:国家和企业发展都需要
快科技3月1日消息,近日,董明珠在央视频的视频中回应了外界对于格力投资500亿做芯片的质疑。此前,格力大价钱投资造芯片引发热议
2025-03-01 15:08:00
DeepSeek大胆披露:理论利润率高达545%!
快科技3月1日消息,今日,DeepSeek正式在知乎平台开设了其官方账号,并发布了一篇名为《DeepSeek-V3/R1推理系统概览》的技术文章
2025-03-01 15:08:00
同比增长62.2%:蔚来公司2月交付新车13192辆
快科技3月1日消息,在刚刚过去的2月份,蔚来公司交付新车13192台,同比增长62.2%。其中,蔚来品牌交付新车9143台
2025-03-01 16:08:00
气胸是什么病、为什么高瘦男性容易得:医生科普
快科技3月1日消息,歌手方大同因病去世,享年41岁,据报道,2010年他因操劳过度,出现(气胸)爆肺而数度住院。那么什么是气胸
2025-03-01 16:38:00
每年导致40万人截肢:这种动物被联合国列入“危险疾病名单”
在非洲肯尼亚的一个小镇,11 岁的比阿特丽斯坐在路边,用手划拉着地上的泥土打发时间。忽然,石缝中弹出一条“红线”,她还没来得及反应
2025-03-01 17:08:00
9.98万 赛力斯蓝电E5 PLUS长续航先享版上市:纯电能跑165公里
快科技3月1日消息,就在今日,蓝电E5 PLUS 165km长续航先享版车型上市,限时一口价9.98万元,限量1000台
2025-03-01 17:08:00
英特尔再度推迟“千亿美元”芯片工厂的建设!投产起码再等5年
陷入困境的芯片制造商英特尔周五(2月28日)宣布,该公司将推迟在俄亥俄州开设芯片制造工厂的进程。2022年时,英特尔曾承诺将投资高达1000亿美元
2025-03-01 17:38:00
骁龙8 Elite近乎“白菜价”!有厂商要干到2500元以内:网友担心会不会赔钱
快科技3月1日消息,博主数码闲聊站爆料,某款骁龙8 Elite机型好像要干到2500元以内。这条微博引发热议,有网友担心“厂商会不会赔钱”
2025-03-01 17:38:00
因“方向感不清晰”:车主控诉小鹏P7+智驾时撞上护栏
快科技3月1日消息,当前一切高阶智能驾驶均为辅助驾驶,使用时还需小心谨慎,时刻准备接管,以防事故发生。据“1818黄金眼”最新报道
2025-03-01 18:08:00
老了也有依靠!京东外卖骑手感谢刘强东
快科技3月1日消息,据媒体报道,近日京东首批全职外卖骑手代表正式签约,引发热议。多位外卖骑手表示,公司为其缴纳五险一金对房贷
2025-03-01 18:08:00