• 我的订阅
  • 头条热搜
实测 GPT-o1:学会了思考 也学会了偷懒
我可能是全网第一个花钱向 GPT-o1 提问,人在深圳靠一条网线横跨太平洋到美国硅谷让 OpenAI 最强大模型 GPT-o1 模型思考 38 秒之后、宕机了半小时选择拒绝回答问题并收了我2.5块(一瓶肥宅快乐水)的韭菜...... (因为这个模型只...……更多
腾讯混元大模型批量上新:10秒生成AI图像,超过180个腾讯业务接入 | 最前线
...千亿级主模型,中文效果整体超过GPT3.5,而7B/13B中小模型实测效果整体优于国内外开源模型,如LLaMA2等。 康战辉尤其指出了压缩比这一参数——同等效果下,混元仅需较少的tokens,训练效率更高。如今,基于,基于探真技术,...……更多
偷X数据 用特斯拉显卡 马斯克把AI炼成啥样了?
有个怪事儿,前段时间,大模型竞技场上,一位代码为 sus-column-r 的匿名模型横空出世。没人知道它师出何门,但在过去的一个月里,它却称得上是过关斩将。。。累计一万多人的投票,硬生生让它挤进了排行榜前列。到现在,...……更多
做好中考数学冲刺复习
...率的计算和应用。四是应用题,包括:解实际问题的数学模型;运用数学知识解决实际问题。2.基础题目训练。在冲刺复习阶段,同学们要通过大量基础题目训练,巩固基础知识,提高解题能力。建议同学们重点练习易错题和常...……更多
科学家推出大模型数据集,涵盖奥赛数学题,有望让AI辅导数学课程
...业大学工作期间,他曾和同事在一项研究中成功提高了大模型解决复杂数学问题的能力。通过此,他们不仅提高了算法推理速度,还提高了算法搜索中间结果的质量。所新推出的数据集 TriMaster100,也更加符合算法在复杂数学问...……更多
DeepSeek开源周才第二天 有些公司就已经坐不住了
...onnet 的推理能力,是另外的价格。世超还找了几个外网的实测案例,发现 Claude 的代码能力依然强得可怕。 同一组提示词喂给 Claude 3.7 Sonnet 和 Grok 3 ,这是 Claude 3.7 Sonnet 的结果。再来看 Grok 3 的,直接被碾压。即使 DeepS……更多
实测升级后的文小言:吉卜力风周边一键生成,全新语音大模型、图片问答齐亮相
...尖模型能力,做出更强大、更简单的AI产品。” 搜狐科技实测显示,若切换至文心大模型并指定文心X1来解决问题,其优势在于灵活调用工具。以“设计吉卜力风的帆布包”为例,文心X1首先能精准解析吉卜力风格特点,再多次...……更多
不用部署,实现大模型切换自由!Token、算力免费薅!
...疼的问题了~不用下载!实现模型试用自由!开源大模型实测频道持续上新,在线随便用、花样试~ 不用部署!实现模型 API 切换自由!看上哪个模型立刻换,MaaS API一键启动 ~ 不用充值!实现DEMO开发token自由!免费算力「立等可...……更多
古早费曼论文手写公式也能转LaTeX,马斯克Grok功能上线就火了
...说法,机器之心在第一时间进行了测试。 公式 OCR 能力实测首先,机器之心测试了一下 Grok 对公式的处理能力。我们输入经典论文《 Attention Is All You Need 》中的一张公式截图,要求转换成 LaTeX 代码。输入的公式截图,对应论文...……更多
苹果AI震撼上线iPhone,进化版Siri却没有ChatGPT!47页技术报告揭秘自研模型
...批拿到iOS18.1测试用户,已经在欢呼雀跃,一波又一波的实测分享铺屏全网。最新推出的预览版,包含了许多惊喜(速览版):全新Siri:唤醒时会在屏幕边缘亮起柔光;与用户交流,可在文本语音之间随意切换;说话者磕磕绊绊...……更多
给小学数学题加句废话,OpenAI o1就翻车了,苹果论文质疑AI推理
苹果新论文:AI 大模型可能不会推理。AI 大模型(LLM)真的像我们理解的那样能「思考」或「推理」吗?最近,苹果的一篇论文探讨了这个问题,并且给出了一个倾向于「否」的答案。相关帖子被很多人围观。这篇题为「GSM-Symb...……更多
...9哪个更大?一道小学生都会的数学题,却难倒了一众AI大模型。昨天,“大模型测不出9.11和9.9哪个大”还登上了微博热搜。这个难倒大多数AI大模型的数学题,其实来自于最近热播的《歌手》。7月13日,在最新一期《歌手》公布...……更多
...加快研究成果转化,培养“数学+”复合型人才 两大应用模型同日发布 本报讯 (记者 姜澎)上海张江再增一家新型研发机构。上海张江数学研究院日前正式成立,上海张江数学院同济大学分院和上海大学分院也同时成立。...……更多
...本文转自:科技日报人工智能提供学习知识新途径大语言模型对著名数学问题有“新见解”【总编辑圈点】科技日报北京12月14日电 (记者张梦然)“深度思维”团队利用大语言模型(LLM)对一个著名的数学问题提出了“新见解...……更多
谷歌deepmind公布ai模型训练法
...15日消息,谷歌DeepMind日前公布了一种名为“FunSearch”的模型训练法,号称能够计算包含“上限级问题”、“装箱问题”在内的一系列“涉及数学、计算机科学领域的复杂问题”。▲图源谷歌DeepMind(下同)据悉,FunSearch模型训练...……更多
实测车载DeepSeek:做北京旅游攻略 避开喝豆汁儿那种
...句“我不喝豆汁儿”,他就真给你做北京一日游攻略啊。实测「汽车版DeepSeek」更新理想OTA 7.2版本后,进入语音设置界面会看到一个深度思考的按钮,就像咱们日常用的DeepSeek一样,点击打开:你也可以用语音对话,让理想同学...……更多
天玑9300抢先实测:全大核架构将如何改变手机体验?
...9300工程机获得了GeekBench单核2209分、多核7583分的成绩经过实测,内置天玑9300的工程机在安兔兔项目中获得了2148858分的成绩,综合性能位于当前安卓阵营的第一梯队,而在GeekBench测试中,天玑9300也获得了单核2209分、多核7583分的...……更多
OpenAI o1 模型 PlanBench 规划能力实测:准确率 97.8%
IT之家 9 月 25 日消息,来自亚利桑那州立大学的科研团队利用 PlanBench 基准,测试了 OpenAI o1 模型的规划能力。研究结果表明 o1 模型取得了长足的进步,但仍然存在很大的局限性。PlanBench 基准简介PlanBench 开发于 2022 年,用于评...……更多
...报记者 赵广立2024年全国高考的“硝烟”刚刚散去,“大模型考生”就被抓回来重新“做题”了。市面上涌现出的大模型产品让人眼花缭乱,围绕“大模型技术哪家强”的讨论不绝于耳,各色名目的大模型评测应运而生。作为国...……更多
上海AI实验室版o1已上线!数学题、Leetcode全拿下,还会玩24点
...、数字游戏等任务。这就是上海AI实验室版o1——强推理模型书生InternThinker,刚刚正式开放试用!新模型不仅在长思维能力方面有了很大提升,而且还能在推理过程中进行自我反思和纠正。先来一起看两个例子感受一下:比如官...……更多
哪里不会扫哪里!全球最强数学大模型在线玩,阿里多模态模型加持
现在,最强数学大模型,人人都可上手玩了!一觉醒来,阿里千问大模型团队发布了Qwen2-Math的Demo,抱抱脸在线可玩。惊喜的是,如果嫌输入数学公式比较麻烦,可以把想问的题截图or扫描,上传即可解题。整得挺方便。试玩界...……更多
ICML2024演讲爆火!Meta朱泽园揭秘大模型内心世界:不同于人类推理
...稿邮箱:liyazhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com大语言模型 (LLM) 是如何解数学题的?是通过模板记忆,还是真的学会了推理思维?模型的心算过程是怎样的?能学会怎样的推理技能?与人类相同,还是超越了人类?只学一种类...……更多
...北京日报让抽象数学与现实世界相连雁栖湖数学院用数学模型解析疾病成因本报讯(记者 刘苏雅)复杂疾病的成因如何,怎样才能有效防治?北京雁栖湖应用数学研究院研究员邬荣领、吴杰团队创新运用数学手段构建新模型,...……更多
对标o1,Kimi放出了最能打的国产模型
...性能提升关键。两个月前,OpenAI o1 的诞生再次引领了大模型技术的突破。从后训练阶段入手,通过更多的强化学习、原生的思维链和更长的推理时间,o1 将大模型的能力又往前推了一步。这段时间,国内大模型初创公司月之暗...……更多
三个大模型组队挑战o1,实测360多模型协作干掉提示词工程
OpenAI o1的横空出世,开启了大模型演化的新范式——Inference law(推理定律)。正如英伟达AI科学家Jim Fan所说,o1的出现标志着大模型研发者开始把集中在训练阶段的投入,开始转移到了推理过程。Jim还引用了机器学习先驱Rich Sut...……更多
...化引领高质量发展论坛上指出,未来,金融和汽车将是大模型最早使用的两大场景。作为汽车制造重镇的重庆,在大模型发展方面极具潜力。邬贺铨在《模型融入云平台 信息化走向数智化》主题报告中指出,大模型将给产业链...……更多
OpenAI o1模型到博士水平了?复旦教授:没有真正推理能力,学到的还是概率相关性
...enAI放出了一个大招,预热了许久的“草莓”(Strawberry) 模型终于来了。“需要耐心等待的时刻结束了。”该公司CEO山姆·奥特曼(Sam Altman)说。这就是名为 o1的新模型,这次发布包括预览版o1-preview和小尺寸版o1-mini。OpenAI官方...……更多
视频大模型Vidu发布3个月后正式全球上线 记者实测
...大模型,Vidu有何特别之处?新京报贝壳财经记者进行了实测。分写实与动画风格 可生成4秒或8秒视频新京报贝壳财经记者发现,此次Vidu上线面向的是全球用户,通过网址(www.vidu.studio)用户可以进入Vidu界面,此后可选择谷歌账...……更多
讯飞星火V3.0发布,打造每个人的AI助手
...实现成果调研、论文研读、学术写作三大功能。刘聪现场实测,用科技文献大模型将十几份量子计算论文一键生成综述报告,为科研人员快速了解最新论文大幅提效。测试显示,学者成果调研的效率被提高超10倍,论文研读有效...……更多
OpenAI直播最后一天放出“王炸”:下一代推理模型o3亮相
...享直播活动的最后一天!周五,OpenAI发布了下一代的推理模型o3,这是今年早些时候发布的o1推理模型的升级版本。更准确地说,o3是一个模型系列——就像o1一样,同时有o3和o3-mini两个版本,后者是一款更小的精简版模型,针对...……更多
更多关于科技的资讯:
近日,上城区发布第四批“人工智能+”机会场景清单,25个场景聚焦产业升级、金融服务、智慧教育、智能医疗等重点领域。据悉
2025-12-13 08:06:00
“甩一甩”就能测温的水银体温计,即将在2026年1月1日全面禁产的政策下退出历史舞台。这则消息引发的全网热议,恰是怀旧情感与环保理性
2025-12-13 08:16:00
厦门网讯(厦门日报记者 应洁)昨日,“新质设计——红点产品设计大奖·中国获奖作品精选展”在红点厦门设计博物馆开展,来自70多家中国企业的百余件“红点奖”获奖作品呈现出国际一流设计的“中国力量”
2025-12-13 08:39:00
第六届中国人工智能大赛配套论坛在厦成功举办
厦门网讯(厦门日报记者 翁华鸿 通讯员 张晶晶 王艳红)12日,第六届中国人工智能大赛配套论坛在厦门成功举办。论坛以“融新汇智
2025-12-13 08:39:00
中新经纬12月13日电 据“网信中国”微信号13日消息,2025年12月2日,中央网信办提出并归口的《数据安全技术 电子产品信息清除技术要求》强制性国家标准由国家市场监督管理总局
2025-12-13 10:42:00
中国科大利用磁力系统实现宽带磁声混合频率梳
大皖新闻讯 12月13日,大皖新闻记者从中国科学技术大学获悉,该校郭光灿院士团队在磁力系统研究中取得新进展。该团队董春华教授研究组通过磁振子与高频声子相互作用
2025-12-13 14:35:00
京东宠物百千万爆品计划启动:联合pidan打造确定性产品 单款猫砂月销1500万
猫砂是猫用品购买频率最高的产品,其潜力被外界看好。不过,因行业门槛低,这两年入局者多、竞争加剧,猫砂利润像纸一样薄,最低仅1%
2025-12-13 14:56:00
2025年“福满榕城 奋勇争先”短视频征集展播——《项目审批专班:“五项机制”激活发展新效能》。
2025-12-13 15:03:00
沁珠宝的2025年:文化赋能,匠心质造,新中式珠宝坚定前行
2025年,是新中式珠宝赛道蓬勃发展的一年,也是沁珠宝以文化为帆、品质为桨,实现跨越式发展的关键之年。在刚刚过去的2025年11月
2025-12-13 16:41:00
鲸鸿动能系列营销案例正式入库复旦管院案例中心,开启产学融合新路径
2025年12月10日,由复旦大学管理学院与鲸鸿动能联合举办的“技术驱动的商业创新:从生态支撑到全球竞逐”主题的案例课堂暨鲸鸿动能案例入库仪式
2025-12-13 16:42:00
硬核突破!全球领先脑肿瘤放疗设备将在廊坊临空实现“中国制造、全球交付”
河北新闻网讯(刘英、刘岩)12月6日,百洋医药高端制造产业化基地在临空经济区(廊坊)高端智能制造港正式启用投产,将承担全球领先脑肿瘤精准放疗设备ZAP-X火星舟放射外科机器人的生产供应任务
2025-12-13 17:52:00
开栏语 深圳,一座将创新刻入基因的城市。无数海归人才,正是这基因中最活跃的段落。作为改革开放的窗口与先锋,她以澎湃的活力与无限的机遇
2025-12-14 11:22:00
日前,第七届浙江国际智慧交通产业博览会在杭州盛大开幕。开幕式上,多项重磅政策与创新成果集中亮相,省交通运输厅、省科技厅共同发布《交通科技创新合作协议》
2025-12-14 11:39:00
海辰储能第三届生态日 发布长时储能与AIDC最新成果
当前,长时储能技术已成为破解新能源波动性难题、打造全天候绿电系统的核心支撑,而AIDC等高能耗行业也亟需依托长时储能的优势破解能源困局
2025-12-14 12:45:00