AI快讯

OpenAI发布o1模型:推理能力大幅提升,编程竞赛成绩超人类专家

OpenAI发布o1模型:推理能力大幅提升,编程竞赛成绩超人类专家

OpenAI于9月13日正式发布新一代AI模型o1,该模型在推理能力上取得重大突破,尤其在数学、编程和科学领域表现优异。o1模型通过强化学习训练,能够在回答前进行深度思考,生成内部推理链,从而解决复杂问题。在编程竞赛中,o1模型排名前11%,超越人类专家水平。o1模型包含o1-preview和o1-mini两个版本。o1-preview为早期预览版,具备高级推理能力;o1-mini则更轻量、高效,专注于编程和数学任务,成本降低80%。目前,ChatGPT Plus和Team用户已可使用o1模型,API开发者也可申请访问。OpenAI表示,o1模型代表了AI推理能力的新范式,尽管仍存在局限,但未来将持续优化,并计划推出更多功能。该模型的发布标志着AI在复杂推理任务上的重要进展,有望推动科学研究、代码生成和数学问题求解等领域的应用。
苹果开源Swift测试框架,助力跨平台开发效率提升

苹果开源Swift测试框架,助力跨平台开发效率提升

苹果近日开源了其Swift测试框架,旨在为开发者提供更高效、灵活的跨平台测试工具。该框架支持iOS、macOS、Linux等平台,并集成了现代测试特性,如并行执行和异步测试,以简化代码质量保障流程。此举不仅增强了Swift生态的开放性,也为服务器端Swift开发提供了官方测试支持。开发者可通过GitHub获取源码,并参与社区贡献。苹果表示,开源将加速框架迭代,推动Swift在更多场景中的应用。
阿里云发布Qwen2.5-Omni:全能端到端多模态模型

阿里云发布Qwen2.5-Omni:全能端到端多模态模型

阿里云近日正式发布Qwen2.5-Omni,这是一款全能端到端多模态模型,能够同时处理文本、图像、音频和视频等多种输入,并生成文本与自然语音输出。该模型在多项基准测试中表现优异,尤其在语音交互和多模态理解任务上达到领先水平。Qwen2.5-Omni采用统一架构设计,支持实时交互,可应用于智能客服、内容生成、教育辅导等场景。阿里云表示,该模型已通过阿里云百炼平台开放API,开发者可快速集成。此举进一步降低了多模态AI的应用门槛,推动行业智能化升级。
苹果AI负责人离职,团队重组影响Siri与iOS 19开发

苹果AI负责人离职,团队重组影响Siri与iOS 19开发

据知情人士透露,苹果公司人工智能负责人约翰·詹南德雷亚(John Giannandrea)已正式离职,其领导的AI团队正在进行重组。詹南德雷亚此前负责苹果的机器学习与AI战略,包括Siri、Core ML等核心技术的研发。此次人事变动可能影响苹果在AI领域的布局,尤其是即将推出的iOS 19系统中Siri的智能升级计划。苹果已任命资深高管接替其职责,并调整团队架构以加速AI技术的整合。分析人士认为,此举旨在应对谷歌、微软等竞争对手在生成式AI领域的快速进展,同时为下一代产品奠定技术基础。目前,苹果尚未就此事发表官方声明。
中信建投:K3发布标志AI产业分水岭,国产模型正面挑战美国前沿

中信建投:K3发布标志AI产业分水岭,国产模型正面挑战美国前沿

36氪获悉,中信建投研报指出,坚定看好AI产业趋势。K3的发布被认为是本周全球大模型行业的分水岭事件,也是另一个DeepSeek时刻:2.8万亿参数、100万上下文及Code Arena登顶,证明国产模型已在Agentic Coding主战场与美国前沿模型正面交锋。研报建议重点关注应用层机会。一方面,K3提升了开源模型智能水平,应用层使用tier1模型的门槛和成本预计均将降低,利好后续应用场景进一步打开;另一方面,头部和第二梯队模型厂商竞争激烈,竞争维度已从模型能力延伸至价格、产品力、场景拓展、成本优化等,利好应用层发展。
腾讯WorkBuddy 6月访问量破2000万,领跑国内AI办公市场

腾讯WorkBuddy 6月访问量破2000万,领跑国内AI办公市场

7月20日,最新发布的《2026年Q2中国办公智能体平台市场洞察报告》显示,腾讯WorkBuddy在国内PC端AI原生办公智能体市场表现强劲,6月单月访问量突破2000万,持续保持市场第一的领先优势。这一数据凸显了腾讯在AI办公领域的先发优势,WorkBuddy凭借其深度整合的办公生态与智能体能力,正在快速占领企业用户心智。随着AI办公市场竞争日趋激烈,头部平台的规模化效应或将进一步显现。
Meta开源多语言语音翻译模型MMS,支持1100+种语言

Meta开源多语言语音翻译模型MMS,支持1100+种语言

Meta近日开源了其多语言语音翻译模型MMS(Massively Multilingual Speech),该模型支持超过1100种语言的语音识别、文本转语音和语言识别,覆盖全球约10亿人口。MMS基于自监督学习,利用未标注的音频数据训练,显著降低了数据标注成本。与现有技术相比,MMS在低资源语言上的表现尤为突出,错误率平均降低50%以上。Meta表示,该模型将助力保护语言多样性,并推动语音技术在偏远地区的应用。目前,MMS已在GitHub开源,提供预训练模型和推理代码。
量子位:仿真底层逻辑揭秘,AI驱动虚拟世界构建新范式

量子位:仿真底层逻辑揭秘,AI驱动虚拟世界构建新范式

仿真技术正从传统物理模型向AI驱动的新范式演进。其底层逻辑核心在于通过数据驱动的方式,利用深度学习网络模拟复杂系统行为,从而突破传统仿真的计算瓶颈。这一转变使得虚拟世界的构建更加高效、精准,尤其适用于自动驾驶、机器人训练等需要海量场景测试的领域。当前,基于生成式AI的仿真平台能够自动创建多样化的虚拟环境,并实时响应交互动作。这种“数据闭环”模式不仅降低了人工建模成本,还提升了模型的泛化能力。专家指出,未来仿真将深度融合强化学习与数字孪生技术,实现从静态模拟到动态预测的跨越,为工业元宇宙的落地提供关键支撑。
WAIC 2026|智象未来推出全球首款无限时长AI创作智能体vivago R1

WAIC 2026|智象未来推出全球首款无限时长AI创作智能体vivago R1

在2026年世界人工智能大会(WAIC)上,智象未来正式发布了全球首个支持无限时长内容创作的智能体——vivago R1。该产品突破了传统AI视频生成的时间限制,能够根据用户输入的文本或图像,持续生成不限长度的连贯视频内容,为影视制作、广告创意、虚拟现实等领域带来革命性变革。vivago R1基于智象未来自研的“时空扩展”大模型,通过动态记忆与自适应生成技术,实现了对长视频中场景、角色和叙事逻辑的精准控制。据官方介绍,该智能体已支持4K分辨率输出,并能在保持风格一致性的前提下,自动优化画面细节与镜头语言。目前,vivago R1已开放内测申请,预计将在今年第三季度正式商用。
光鉴科技发布具身智能视觉方案,为物理AI打造“火眼金睛”

光鉴科技发布具身智能视觉方案,为物理AI打造“火眼金睛”

具身智能赛道再迎重磅玩家。7月25日,光鉴科技正式发布其自主研发的具身智能视觉感知方案,旨在为物理世界中的AI系统提供高精度、低延迟的视觉感知能力。该方案融合了3D结构光、双目视觉与深度学习算法,能够实现毫米级的环境建模与实时物体识别,为机器人、自动驾驶、智能制造等场景提供“看”与“理解”的核心基础。据光鉴科技介绍,这套方案的核心优势在于其“软硬一体”的设计。硬件层面,自研的纳米光子芯片与微型投影模组大幅降低了功耗与体积,使得方案可以灵活嵌入各类机器人平台;软件层面,基于Transformer架构的感知算法在公开数据集上的物体检测精度达到98.7%,处理延迟低于15毫秒。光鉴科技CEO表示:“我们希望为物理AI提供一双‘火眼金睛’,让机器不仅能看见,更能看懂。”目前,该方案已与多家头部机器人厂商达成合作,预计年内实现量产交付。