• 我的订阅
  • 头条热搜
...公司等近日宣布,利用超级计算机“富岳”,他们开发的大规模语言模型“Fugaku-LLM”正式发布。“Fugaku-LLM”是首个完全由日本国产技术构建的AI语言模型,其在处理日语及相关文化内容上表现卓越。模型特别擅长基于日语敬语...……更多
openai发布多语言大规模多任务语言理解
...23日)发布博文,报道称OpenAI在HuggingFace上发布了多语言大规模多任务语言理解(MMMLU)数据集。背景随着语言模型日益强大,评估其在不同语言、认知和文化背景下的能力已成为当务之急。OpenAI决定推出MMMLU数据集,通过提供强...……更多
迈向多语言医疗大模型:大规模预训练语料,开源模型与全面基准测试
... MMedC 上进⼀步预训练使模型性能相⽐于基线显著提升。大规模多语医疗语料(MMedC)构建在构建数据集方面,研究团队收集了一份多语言医疗语料库,命名为 MMedC。该数据集包含 255 亿 tokens,其内容来自于四个来源:1. 通过启发...……更多
...过用于训练其大型语言模型的算力来区分;第三级被称为大规模通用目的人工智能系统,将包括最流行的人工智能工具,并以用户总数来衡量。欧盟正在考虑采用分级方法来监管生成式人工智能(AI)模型。一项提案称,欧盟将...……更多
AI大模型行业报告:大模型发展迈入爆发期,开启AI新纪元(附下载)
...mer为技术基座1.1 大模型“大力出奇迹”的背后:Scaling Law大规模语言模型(Large Language Models,LLM)泛指具有超大规模参数或者经过超大规模数据训练所得到的语言模型。与传统语言模型相比,大语言模型的构建过程涉及到更为复...……更多
清华提出时间序列大模型:面向通用时序分析的生成式Transformer
...于起步阶段。近期,清华大学的研究团队基于Transformer在大规模时间序列上进行生成式预训练,获得了任务通用的时序分析模型,展现出大模型特有的泛化性与可扩展性时间序列提供了数据随时间变化的视角,对于理解复杂系统...……更多
微软推出14b参数“最先进”小型语言模型
...以及训练后的创新,Phi-4在数学推理方面超越了同类和更大规模的模型。其在数学竞赛问题上的表现超过了包括GeminiPro1.5在内的多个更大规模模型。IT之家附有关基准测试结果的技术论文:点此前往微软宣布,将“强大且负责任...……更多
...工智能大模型,标志着国内大模型从小范围内测开始走向大规模应用。大模型将如何为个人和产业赋能?这轮开放服务将为行业竞争带来什么影响?国内大模型未来的发展趋势又将如何?人工智能大模型竞争进入新阶段9月初,...……更多
21.5万张X光,78万个问题!德州大学NIH等联合发布医学视觉问答数据集Medical-CXR-VQA
...了解决这一问题,研究团队提出了Medical-CXR-VQA,这是一个大规模的X光胸片问答数据库,覆盖了更广泛的问题类型,包括异常、存在、位置等七种问题类型,为构建更准确的医学VQA模型提供了基础。多模态大语言模型 (Multimodal Larg...……更多
...、音频和编程代码,具备更强的理解和推理能力,还在“大规模多任务语言理解”测试中首次超越人类专家。谷歌公司称,“双子座”将推出三种版本:Ultra版本功能最强大,适用于高度复杂的任务,预计2024年初发布;Nano版本...……更多
综合RLHF、DPO、KTO优势,统一对齐框架UNA来了
...专注于 LLM Alignment。3. 黄灿:厦门大学数学系副教授随着大规模语言模型的快速发展,如 GPT、Claude 等,LLM 通过预训练海量的文本数据展现了惊人的语言生成能力。然而,即便如此,LLM 仍然存在生成不当或偏离预期的结果。这种...……更多
新研究:日本人祖先或有“3方起源”
来源:看看新闻Knews日本研究团队日前通过大规模分析日本人全基因组测序数据,为日本人祖先有三支的“三方起源模型”提供了证据,而不是迄今被广泛接受的“二元结构模型”。日本理化学研究所日前发布新闻公报说,研究...……更多
...企业客户开放。据介绍,“双子座”Ultra版本是首个在“大规模多任务语言理解”(MMLU)领域超越人类专家的模型。“大规模多任务语言理解”结合了数学、物理、历史、法律、医学和伦理学等57个学科来测试人工智能掌握知识...……更多
清华教授唐杰:Scaling Laws虽被质疑,但至今仍是提高大模型性能的重要方法
...,先后出现了基于Transformer的BERT、GPT/GPT-2/GPT-3、T5等基于大规模无标注数据自监督学习的大规模预训练算法。这些算法模型均在大数据支持下拥有较大规模模型参数,具备较强的通用能力,可完成多场景任务,显著降低学习成本...……更多
Mamba再次挑战霸主Transformer!首个通用Mamba开源大模型一鸣惊人
...计算机视觉、音频处理以及估计和预测等任务。首个通用大规模Mamba模型上面提到,基于注意力机制的Transformer是当今所有最强大语言模型中占主导地位的架构。然而,由于计算和内存成本随着序列长度的增加而增加,注意力机...……更多
AI视野:Gen-2支持生成4K高清视频;Midjourney推出Style Tuner工具;
...语言模型日本电报电话公司(NTT)宣布将在明年3月推出大规模语言模型(LLM),为生成式日语学习人工智能提供支持,以降低学习成本和与美国信息技术巨头竞争。Phind:一款号称代码能力超越GPT-4的模型Phind是一个声称代码能力超...……更多
最新美国国家人工智能科学院院士介绍
...来自牛津大学,专注于机器学习和数据挖掘,尤其在处理大规模数据集方面取得了显著成果。 SophiaWang,来自哈佛大学,致力于自然语言处理与机器翻译的研究,提高了多语言之间的转换准确率。EthanLee,来自加州大学圣地亚哥...……更多
大语言模型、量子计算、再生稻等入选2023年度十大科技名词
...能。生成式人工智能是利用复杂的算法、模型和规则,从大规模数据集中学习,以创造新的原创内容的人工智能技术。2022年末,OpenAI推出的ChatGPT标志着这一技术在文本生成领域取得显著进展,2023年被称为生成式人工智能的突破...……更多
chatgpt低成本复现流程开源
...Critic和奖励模型则使用了60亿参数的GPT-3系列模型。如此大规模的模型参数,意味着想要启动原始ChatGPT训练流程,需要数千GB的显存开销,单张GPU显然无法容纳,常见的数据并行技术也不能搞定。即便引入张量并行、流水并行对...……更多
浪潮AI 人工智能“小源” 破“杀猪盘”诈骗套路
日前,由浪潮AI研究院研发的大规模中文语言模型“源1.0”在某次反诈行动中发挥出了出色的实效。期间,在“源1.0”的基础上,开发者开发了一个能够无障碍进行微信聊天的人工智能“小源”,并在与骗子的真实对话场景中进...……更多
小模型正在成为AI界的新宠
...特别是 GPU 和专用 AI 芯片(如 TPU)的发展,使得训练更大规模的模型成为可能;新的模型架构和训练技术的出现,如 Transformer 架构和预训练技术,使得模型能够更有效地扩展到更大的规模。此外,模型的大小往往被视为技术创...……更多
github发布2023年度开源状态报告
...有开发人员(92%)都在使用或尝试AI工具。开发人员正在大规模运行云原生应用程序:基于Git的基础设施作为代码(IaC)工作流程的声明性语言有所增加,云部署的标准化更广,开发人员使用Dockerfile和容器、IaC以及其他云原生技...……更多
百万鲁棒数据训练,3D场景大语言模型新SOTA!IIT等发布Robin3D
...元导读】Robin3D通过鲁棒指令数据生成引擎(RIG)生成的大规模数据进行训练,以提高模型在3D场景理解中的鲁棒性和泛化能力,在多个3D多模态学习基准测试中取得了优异的性能,超越了以往的方法,且无需针对特定任务的微调...……更多
【科技早报】神舟十七号发射圆满成功;苹果或将Vision Pro应用于心理健康领域
...提升,通过对预售包裹提前处理下沉到快递网点,实现更大规模的半日送达。菜鸟速递将继续把送货上门作为标配,同时菜鸟驿站继续在全国核心城市提供按需上门服务。(全天候科技) PayPal被罚逾9亿韩元,因泄露2.3万名用户...……更多
字节豆包大模型团队突破残差连接局限!预训练收敛最快加速80%
...述 “跷跷板式” 困境,实现了显著提升。该方法适用于大规模语言模型(LLMs)的预训练,在面向 Dense 模型和 MoE 模型的实验中,展示了显著性能提升效果,使预训练收敛速度最高可加速 80%。 研究团队还发现,超连接在两个小...……更多
Scaling Law百度最早提出!OpenAI/Claude受它启发,致谢中有Ilya
...训练集大小、计算规模和模型精度之间的关系,并且通过大规模实证研究揭示了深度学习泛化误差和模型大小的缩放规律,还在图像和音频上进行了测试。只不过他们使用的是 LSTM,而不是Transformer;也没有将他们的发现命名为...……更多
面向“万星星座”专注卫星智能化管理 中科天塔完成近亿元A轮融资
...式已遇到“瓶颈”,依靠人力人工方式在未来将无法满足大规模星座的管理要求。因此,借助生成式人工智能(AI)技术对专家经验和垂直数据库进行标准化收敛、形成高稳定性、强专业性、高度自动化的大规模卫星智能测运控能...……更多
腾讯云向量数据库多项升级:最高支持千亿向量,一键打包开箱即用 | 最前线
...向量数据库标准,推进向量数据库及大模型相关产业走向大规模应用。腾讯云还与硬件厂商、大模型厂商、行业代表等联合成立了“AGI技术生态联盟”。来源:腾讯向量数据库可以说是大模型的数据“底层”,大模型若需要处理...……更多
阿里CEO吴泳铭:生成式AI让世界有了一个统一的语言——Token
...然在理论和实验室环境中展现了巨大的潜力,但将其推向大规模商用并非易事。一个显著的挑战就是其高昂的计算和处理成本。Token的处理,涉及海量的数据分割、编码、解码以及跨模态的信息融合。这些操作需要强大的计算能...……更多
以“价值创造”为导向,医渡科技自研大模型即将发布
...智能领域深耕近10年,从解决数据可计算性,到安全可信的大规模计算,再到多任务的专业AI模型,医渡科技自主研发了自然语言处理平台、多中心加密安全计算平台和AI算法集,以及可解释、模型化知识图谱等一系列技术与产品,业务也...……更多
更多关于科技的资讯:
摘要:随着生成式人工智能技术在各行业的广泛应用,模型输出结果的不确定性问题日益受到关注。为提高模型在关键领域的可靠性,对输出不确定性进行量化分析成为重要方向
2025-12-04 06:17:00
杭州博士后用AI让机器懂协作、更安全杭州日报讯 让机器从执行命令的“孤岛”,成为懂得协作的群体?让机器人安全走进人类生活
2025-12-04 06:38:00
12月3日从紫林醋业获悉,紫林醋业部分主导产品通过欧盟有机认证(EU Organic Certification),获准使用欧盟统一有机标识“欧洲叶标”(Euro-Leaf)
2025-12-04 07:31:00
中新经纬12月3日电 12月3日,豆包手机助手在官方微信号就“侵犯用户隐私”等问题进行回应,称不存在任何黑客行为。具体来看
2025-12-04 07:42:00
支付宝AI4SDL研发安全体系斩获首届“AI领航杯”星光金奖
12月1日-3日,由中国互联网协会主办的2025“人工智能+”产业生态大会在北京举办。开幕式上,首届“AI领航杯”“人工智能+”应用与技能大赛总决赛举行了隆重的颁奖仪式
2025-12-04 07:47:00
近期,在“智绘星空胜算在天—太空数据中心建设工作推进会”上,北京拟在700—800公里晨昏轨道建设运营超GW(千兆瓦)级集中式大型数据中心系统
2025-12-03 09:42:00
太极韵动武汉,一场独属于银发爱好者的健康之约
承武当余韵,赴江城之约——小糖乐学以“传韵江城汇,小糖太极行”为引,再启太极文化与健康同行之旅。继武当山“问道太极”盛会圆满落幕
2025-12-03 13:40:00
杭州日报讯 产品还没走下生产线,就能在虚拟世界预知它未来十年会不会开裂、变形——这样的场景正在杭州成为现实。日前,工业科技企业浙江远算科技有限公司发布“AI质检数实融合验证平台”
2025-12-03 13:41:00
本报记者 陆春花 为进一步深化江苏与中东地区在“一带一路”倡议下的经贸合作,推动江苏制造高质量“走出去”、精准“引进来”
2025-12-03 13:41:00
曹操出行与越疆合作,人形机器人入驻行业首个“绿色智能通行岛”,推进具身智能在出行、物流领域的规模化应用
12月1日,曹操出行与越疆科技正式签署战略合作协议。双方将围绕Robotaxi(自动驾驶出租车)运营场景,共同探索机器人技术在车辆清洁
2025-12-03 13:41:00
江苏“领航工厂”引领“智造”变革
从“智慧车间”到“工业大脑”,“江苏智造”通过数据驱动全流程变革,赋能产业链协同升级 近日,全国首批15家领航级智能工厂名单发布
2025-12-03 13:41:00
国内首款AI助盲眼镜发布,基于通义千问打造
12月3日,杭州瞳行科技公司正式发布国内首款AI助盲眼镜。该眼镜基于通义千问Qwen-VL、OCR等系列模型打造,具有出行避障
2025-12-03 13:41:00
橙友“橙汁儿”向橙柿直通车反映:这几天收到了短信,是杭州市公共自行车公司发来的——“尊敬的用户,由于业务升级,您之前办理的绑卡租车功能即将在2025年12月底取消
2025-12-03 13:41:00
北京上班族李想称,健身私教课结束后,教练为索要好评,直接拿他手机代笔修改达3分钟。好评既影响消费者选择,也关联平台推流与服务者收益
2025-12-03 13:41:00
找“搭子” 聊技术 谈合作每日商报讯 一个多星期前,“魔搭社区”(杭州)开发者中心启用。这个中心是国内规模最大的模型开源社区“魔搭社区”的首个线下实体空间
2025-12-03 13:41:00