AI快讯

Anthropic CEO称大模型训练成本2027年将达千亿美元

Anthropic CEO称大模型训练成本2027年将达千亿美元

Anthropic CEO Dario Amodei近期预测,到2027年,大型AI模型的训练成本将飙升至1000亿美元,远超当前水平。这一判断基于模型规模、数据需求及计算资源的指数级增长。Amodei指出,当前顶尖模型训练成本约10亿美元,而未来三年内可能再增百倍。他同时强调,尽管成本高昂,但AI能力提升带来的经济价值将远超投入,并呼吁行业关注算力基础设施的可持续性。
GitHub Copilot免费版上线,每月2000次补全

GitHub Copilot免费版上线,每月2000次补全

GitHub宣布推出Copilot免费订阅计划,为开发者每月提供2000次代码补全和50次聊天请求。免费版支持VS Code、JetBrains等主流IDE,并默认启用多模型选择功能,用户可切换Anthropic的Claude 3.5 Sonnet或Google的Gemini 1.5 Pro模型。此举旨在降低AI编程助手的使用门槛,此前Copilot个人版月费10美元。免费版将逐步面向所有用户开放,现有付费用户不受影响。分析人士认为,这标志着AI辅助编程工具进入普惠阶段,可能加速行业竞争。
谷歌发布Gemma 2 2B参数模型,性能超越GPT-3.5

谷歌发布Gemma 2 2B参数模型,性能超越GPT-3.5

谷歌近日正式发布了Gemma 2系列的新成员——Gemma 2 2B参数模型。该模型仅有20亿参数,但在多项基准测试中表现优异,甚至超越了拥有1750亿参数的GPT-3.5。Gemma 2 2B采用了创新的架构设计,包括分组查询注意力机制和滑动窗口注意力,显著提升了推理效率。据悉,Gemma 2 2B在MMLU、HellaSwag、WinoGrande等测试中均取得了领先成绩,尤其在数学和代码生成任务上表现出色。该模型支持多种部署方式,包括消费级GPU和CPU,为开发者提供了更灵活的选择。谷歌表示,Gemma 2 2B的发布旨在推动小型模型的应用,降低AI技术门槛。
微软发布Phi-3系列小型语言模型,性能媲美GPT-3.5

微软发布Phi-3系列小型语言模型,性能媲美GPT-3.5

微软近日发布了Phi-3系列小型语言模型,包括Phi-3-mini、Phi-3-small和Phi-3-medium三个版本。其中,Phi-3-mini参数规模为38亿,但在多项基准测试中表现优异,性能可与GPT-3.5等大型模型相媲美。该模型采用Transformer架构,经过3.3万亿个token的训练,并针对移动设备进行了优化,可在手机端运行。Phi-3系列模型在推理、数学和编程任务上展现出强大能力,尤其在代码生成和数学问题解决方面表现出色。微软表示,Phi-3-mini在MMLU、HellaSwag等测试中超越同等规模模型,甚至在某些任务上接近GPT-3.5。这一突破意味着小型模型在特定场景下可替代大型模型,降低部署成本。目前,Phi-3-mini已在Azure AI模型目录中提供,并支持Hugging Face下载。微软还计划推出多模态版本,以扩展应用场景。业界认为,Phi-3系列将推动边缘AI和移动设备上的智能应用发展。
微软推出AI辅助编程工具Copilot,提升开发者效率

微软推出AI辅助编程工具Copilot,提升开发者效率

微软近日推出了一款名为Copilot的AI辅助编程工具,该工具基于GitHub的代码库和OpenAI的GPT-3模型,能够自动补全代码、生成函数甚至整个程序。Copilot的推出旨在帮助开发者减少重复性工作,提高编码效率。据微软介绍,Copilot目前支持多种编程语言,包括Python、JavaScript、TypeScript等,并已集成到Visual Studio Code等主流开发环境中。开发者只需输入注释或部分代码,Copilot即可智能生成建议。该工具目前处于预览阶段,未来将逐步开放更多功能。
谷歌AI推出新型基础模型,实现多种任务零样本泛化

谷歌AI推出新型基础模型,实现多种任务零样本泛化

谷歌AI近日发布了一款名为GATO的新型基础模型,该模型能够处理文本、图像、机器人控制等多种任务,并在零样本场景下展现出强大的泛化能力。GATO模型在多项基准测试中表现优异,包括语言理解、图像分类和机器人操控,标志着通用人工智能研究的重要进展。与传统单一任务模型不同,GATO通过大规模多任务预训练,学习跨模态的通用表示,从而无需微调即可适应新任务。这一突破有望降低AI应用门槛,推动更多实际场景的部署。
国产大模型公司零一万物发布开源Yi-9B,代码数学能力领先

国产大模型公司零一万物发布开源Yi-9B,代码数学能力领先

3月7日,零一万物正式发布并开源其最新预训练模型Yi-9B。该模型在代码和数学能力上表现突出,在C-Eval、CMMLU、MMLU、GSM8K、MATH、HumanEval等多项基准测试中,均超越同尺寸模型如DeepSeek-Coder-7B、Mistral-7B、CodeLlama-7B等。Yi-9B采用9B参数规模,基于Yi系列模型架构优化,在保持通用能力的同时,重点提升了代码生成、数学推理等专业领域性能。目前该模型已在GitHub和Hugging Face上开源,开发者可免费商用。
蚂蚁集团开源新算法:图像压缩与超分联合优化,性能提升显著

蚂蚁集团开源新算法:图像压缩与超分联合优化,性能提升显著

蚂蚁集团近日开源了名为“图像联合压缩与超分辨率”的新算法,该算法将图像压缩与超分辨率重建两个任务统一在一个框架内,通过联合优化实现了更好的性能。实验表明,在相同码率下,新算法生成的图像质量显著优于传统分离式方法,峰值信噪比(PSNR)提升达0.5dB以上。该算法采用端到端的学习方式,在编码端对图像进行压缩,在解码端利用超分辨率网络恢复细节。与传统方法相比,联合优化避免了压缩与超分之间的信息损失,尤其适用于低码率场景。蚂蚁集团表示,该技术可应用于移动端图像传输、云存储等场景,降低带宽成本的同时提升用户体验。目前,相关代码与模型已在GitHub开源,并提供了预训练权重。开发者可直接使用或在此基础上进行二次开发。这一开源举措有望推动图像处理领域的技术进步,尤其在资源受限设备上的应用前景广阔。
AI编程助手Cursor获6亿美元融资,估值飙升至260亿

AI编程助手Cursor获6亿美元融资,估值飙升至260亿

AI编程助手Cursor的开发商Anysphere近日完成新一轮6亿美元融资,估值达到260亿美元。本轮融资由Thrive Capital领投,Andreessen Horowitz、Benchmark等跟投。Cursor凭借其强大的代码生成和智能补全功能,已成为开发者社区最受欢迎的AI工具之一,用户数突破百万。Anysphere计划利用这笔资金加速产品迭代,拓展企业级市场,并加强AI模型研发。Cursor目前支持VS Code集成,能根据自然语言指令自动生成代码片段,显著提升开发效率。其成功吸引了包括GitHub Copilot在内的众多竞品跟进,AI编程助手赛道竞争日趋激烈。
GitHub Copilot引入多模型选择,支持Claude和Gemini

GitHub Copilot引入多模型选择,支持Claude和Gemini

GitHub宣布为其AI编程助手Copilot引入多模型支持,开发者现可选择Anthropic的Claude 3.5 Sonnet和Google的Gemini 1.5 Pro模型,替代默认的OpenAI模型。这一更新旨在提供更灵活的代码补全和生成能力,满足不同开发场景的需求。新模型已在Copilot Chat中可用,用户可通过模型选择器切换。Claude 3.5 Sonnet擅长复杂推理和长上下文理解,而Gemini 1.5 Pro在代码生成和多语言支持上表现突出。GitHub表示,未来还将集成更多第三方模型,推动AI开发工具的生态开放。