您正在搜索 ai-nei-rong-bo-yi-openai-zai-he-xin-wen-ji-gou-ban-quan-jiu-fen-an-zhong-ying-de-shou-lun-sheng-li

ChatGPT两周年：从不被看好到掀起AI浪潮，一文解析缘起与未来

2022年11月30日，当时还只是一个小型初创的OpenAI用一篇博客，以及首席执行官Sam Altman的一条推特，悄然推出了一项名为ChatGPT的新服务。在推文中，奥特曼低调地将其称为「一种可能性的早期demo」，「很大程度上是一项研究的发布」，「仍然有很多限制」。这种措辞看起来与之后的现实情形完全不相符，但从当时来看，OpenAI的团队将期望设定在这个程度是有充足理由的。

企业软件是否已告别“太贵”时代？

在不太遥远的未来，GenAI将使企业软件领域以往无法实现或成本过高的功能成为可能。 GenAI，尤其是大型语言模型(LLM)，正在改变公司开发和交付软件的方式。从聊天机器人和简单自动化工具开始的这一进程，正在发展成为功能更为强大的AI系统——这些系统与软件架构深度融合，并影响从后端流程到用户界面的方方面面。

让Qwen2.5 7B超越o1，微软干的！MSRA推出小模型数学推理自我进化新方法

7B参数的Qwen2.5数学推理表现超过o1-preview，这是怎么做到的？！靠的就是MSRA最新的创新算法，rStar-Math。

个人跑大模型，英伟达「皮衣刀客」新出的Project DIGITS与M4 Mac Mini到底哪个好？

前些天，英伟达发布了一大堆东西，其中包括一款 AI 超级计算机 Project DIGITS，机器之心也在第一时间进行了报道，参阅《RTX5090 震撼发布，国行 16499 元起，黄仁勋「美国队长」pose 亮翻全场》。在这篇文章的评论区，一位读者的问题引发了不少争议。虽然该问题的最高赞回复表示这是「英伟达被黑得最惨的一次」，但实际上使用 Mac Mini 作为个人的大模型运行平台并不是什么罕见操作。

具身智能新高度！智元机器人推出全球首个4D世界模型EnerVerse

如何让机器人在任务指引和实时观测的基础上规划未来动作，一直是具身智能领域的核心科学问题。然而，这一目标的实现受两大关键挑战制约：模态对齐：需在语言、视觉和动作等多模态空间中建立精确的对齐机制。数据稀缺：缺乏规模化、多模态且具备动作标签的数据集。

讯飞商业生态平台2.0来了！构建大模型应用服务新体系

AI时代的聚光灯已经由“模型参数”转移到“应用价值”，引领千行百业发掘大模型刚需场景，构建新质生产力。据智能超参数发布的《中国大模型中标项目监测报告(2024)》显示，2024年有披露的大模型中标项目达到1520个，相比去年增长了15.5倍。 1月8日，科大讯飞AI服务市场行业伙伴生态大会在北京中关村国际会议中心成功举办。

OpenAI智能体曝本月诞生！比谷歌Anthropic慢，竟是担心prompt攻击

2025年，智能体将是AI领域最激烈的战场。然而，一直在AI领域「独占鳌头」的OpenAI，却迟迟没有出手。不过，外媒最近曝出了一条好消息——OpenAI可能在本月就会发布自家的「计算机操作智能体」！

黄仁勋圈重点的世界模型平台是个啥？技术报告全解析，华人贡献中坚力量

AI 的下一个前沿是物理。在昨天的 CES 发布会上，英伟达 CEO 黄仁勋通过一个名为「Cosmos」的平台点明了这一主题。简单来说，Cosmos 是一个世界模型平台，上面有一系列开源、开放权重的视频世界模型，参数量从 4B 到 14B 不等。

o1也会「想太多」？腾讯AI Lab与上海交大揭秘o1模型过度思考问题

本文的共同通讯作者为涂兆鹏和王瑞，涂兆鹏为腾讯专家研究员，研究方向为深度学习和大模型，在国际顶级期刊和会议上发表学术论文一百余篇，引用超过9000次。担任SCI期刊NeuroComputing副主编，多次担任ACL、EMNLP、ICLR等国际顶级会议领域主席。王瑞为上海交通大学副教授，研究方向为计算语言学。

单张图像探索3D奇境：Wonderland让高质量3D场景生成更高效

本文的主要作者来自多伦多大学、Snap Inc.和UCLA的研究团队。第一作者为多伦多大学博士生梁汉文和Snap Inc.的曹军力，他们专注于视频生成以及3D/4D场景生成与重建的研究，致力于创造更加真实、高质量的3D和4D场景。团队成员期待与更多志同道合的研究者们交流与合作。

实时高保真人脸编辑方法PersonaMagic，可根据肖像无缝生成新角色、风格或场景图像。

本文经AIGC Studio公众号授权转载，转载请联系出处。今天给大家介绍的是一个高保真实时人脸编辑方法PersonaMagic，通过分阶段的文本条件调节和动态嵌入学习来优化人脸定制。该技术利用时序动态的交叉注意力机制，能够在不同阶段有效捕捉人脸特征，从而在生成个性化图像时最大程度地保留身份信息。

AAAI 2025 | IML领域稀疏化视觉Transformer，代码已开源

SparseViT 的主要科研成员来自四川大学吕建成团队，合作方为澳门大学潘治文教授团队。论文：《Can We Get Rid of Handcrafted Feature Extractors? SparseViT: Nonsemantics-Centered, Parameter-Efficient Image Manipulation Localization through Spare-Coding Transformer》论文链接：：，图像处理变得非常方便。

跨年舞台歌手翻车惨烈，AI唱作俱佳，意外圈粉

AI好好用报道编辑：Sia刚刚过去的跨年舞台，依旧延续了群魔乱舞的台风。假唱早已见怪不怪。假唱。

「停止雇佣人类」广告牌爆火，OpenAI放惊人言论：每月2000刀，AI淘汰人类！

随着人工智能的日益强大，最令人担心的事情终于还是发生了。旧金山一家科技公司已经开始明目张胆地宣布「停止雇佣人类」！就在旧金山密西西比街的一侧，一些酒店从业者为了争取更高待遇与更多工作机会的罢工运动已经持续了数月。

动物版谷歌翻译来了？Nature：用AI解码野性的呼唤！

每一种动物都有其独特的历史。来自加拿大Carleton University的鲸鱼生物学家Shane Gero，花了20年时间试图了解鲸鱼是如何交流的。比如，同一个家族的鲸鱼会发出特定的声音，而不同区域的抹香鲸（Physeter macrocephalus）有自己的「方言」。

全新模型RoboVLMs解锁VLA无限可能，真实机器人实验交出满分答卷

本文作者来自清华大学、字节跳动、中科院自动化所、上海交通大学和新加坡国立大学。作者列表：李兴航、李沛言、刘明桓、王栋、刘济榕、康炳易、马骁、孔涛、张翰博和刘华平。第一作者李兴航是清华大学计算机系博士生。

多模态模型已落地多领域，OpenBayes贝式计算获评「大模型最具潜力创业企业 TOP 10」

缩放定律的放缓带来的技术路径演变在 2024 年的 NeurIPS 会议上，Ilya Sutskever 提出了一系列关于人工智能发展的挑战性观点，尤其集中于 Scaling Law 的观点：「现有的预训练方法将会结束」，这不仅是一次技术的自然演进，也可能标志着对当前「大力出奇迹」方法的根本性质疑。 Ilya 讨论了预训练模型的局限性，预见 AI 系统需要发展出更加接近人类思考方式的推理能力。他强调，为了突破当前的局限并继续提升 AI 的能力，必须寻找新的训练方法。

全面打破GPT-4垄断、DeepSeek打下训练成本...2024年大模型领域进展全复盘

刚刚过去的 2024 年是生成式 AI 大发展的一年，我们见证了 OpenAI Sora 的崛起，大模型服务价格的飞速下降，以及国内开源大模型的奋起直追。这全方位的快速发展让我们对下一波 AI 的新技术大规模应用充满了信心。对于身在 AI 领域的工程师和学者们来说，他们看待这一年的观点会有不同吗？

ai-nei-rong-bo-yi-openai-zai-he-xin-wen-ji-gou-ban-quan-jiu-fen-an-zhong-ying-de-shou-lun-sheng-li 的搜索结果