AI大事件2025-04-17

梦想家2025年4月18日0 回答144 浏览

1、OpenAI发布两款多模态推理模型o4-mini、满血版o3  

主要内容:  

🛠️ o4-mini和o3具备多模态处理能力,能同时处理文本、图像和音频,并自动调用外部工具。  

📊 o4-mini在AIME2024和2025测试中准确率分别达到93.4%和92.7%,超越满血版o3。  

💻 在编程竞赛中,o4-mini获得2700分,跻身全球前200名程序员,展现出强大的编程能力。  


2、微信首个AI助手“元宝”正式上线,可以添加为微信好友  

主要内容:  

🌟 微信首个AI助手“元宝”上线,用户可直接在微信中搜索添加。  

📊 元宝支持解析公众号文章、图片和文档,提供智能互动。  

🔒 具备隐私保护功能,支持证件照自动打码。  


3、字节发布豆包1.5深度思考模型:多模态深度思考、延迟低  

主要内容:  

📈 豆包1.5模型在数学、编程等领域表现出色,采用MoE架构,参数配置优越。  

🌍 新模型结合视觉理解技术,能够分析照片,辅助旅行和项目管理,功能强大。  

🎥 视频搜索能力显著增强,用户可快速获取视频中的相关信息,使用量持续增长。  


4、月之暗面Kimi开源数学定理证明模型Kimina-Prover  

主要内容:  

🔍 Kimina-Prover在miniF2F基准测试中达到了80.7%的通过率,超越了之前的最佳结果。  

🚀 该模型结合了大规模强化学习与形式化推理,显著提升了推理能力和样本效率。  

📚 Kimina-Prover的可解释性强,用户可以查看推导过程,为理解模型行为提供便利。  


5、OpenAI开源超Agent:Codex CLI,五小时内破5000颗星  

主要内容:  

🌟 Codex CLI在发布后仅5小时便获得5000颗星评价,预计当天将突破1万颗星。  

💻 该工具可以自动生成代码、运行代码、重构和测试代码,功能强大且实用。  

📈 OpenAI计划持续推出更多智能体产品,并在探索收购AI编程平台以增强竞争力。  


6、谷歌Gemini Live功能全面开放,安卓用户迎来新体验  

主要内容:  

🌟 Gemini Live功能现已免费向所有安卓用户开放,原本仅限于Pixel9和Galaxy S25用户。  

📸 该功能可以实时识别摄像头和屏幕内容,提供即时信息和反馈,提升用户互动体验。  

🚀 微软同日推出类似的AI工具Copilot Vision,显示出实时信息识别技术的快速进步。  


7、OpenAI拟以30亿美元收购AI编程工具Windsurf  

主要内容:  

💰 OpenAI正在与Windsurf进行30亿美元的收购谈判,若达成将成为其最大规模的并购交易。  

🚀 Windsurf是一款广受欢迎的AI编程助手,支持代码生成和解释,已获得超过2亿美元的融资。  

📈 此次收购将增强OpenAI的编程能力,帮助其在竞争激烈的AI工具市场中占据领先地位。  


8、JetBrains推出编码智能体Junie AI,助力编程与调试全新体验  

主要内容:  

🤖 Junie AI已达生产就绪状态,专注于复杂任务的处理与调试。  

📈 更新的AI助手支持多种最新AI模型,并新增多文件编辑功能。  

🌐 JetBrains将推出免费套餐,提供无限代码补全,以满足不同开发者的需求。  


9、Reachy 2开源人形机器人正式开售  

主要内容:  

🤖 高度仿人设计,具备7自由度手臂,能够自然、精准地执行动作,适合多种应用场景。  

🔄 模块化与开源架构,支持Python SDK编程,开发者可根据需求扩展功能,推动技术创新。  

🌍 已在全球20多个国家部署,客户包括知名机构,展现出在医疗、零售及教育等领域的广泛应用潜力。  


10、上海人工智能实验室推出升级版多模态大模型“书生・万象3.0”  

主要内容:  

🚀 升级版“书生・万象3.0”在多模态处理能力上有显著提升,适用于多种应用场景。  

💡 该模型在性能和用户体验上都有明显进步,响应速度和理解能力均增强。  

🌐 开源举措为开发者提供了新的平台,鼓励创新和应用,推动行业发展。  


11、豆包深度思考和文生图3.0模型正式开放API对企业客户开放  

主要内容:  

🧠 豆包1.5·深度思考模型在专业领域推理任务中表现优异,接近全球第一梯队水平。  

🎨 豆包文生图模型3.0实现高分辨率图像生成,提升了创作效率,具备商业级设计能力。  

🚀 两款模型的开放API为企业客户提供了更高效、通用的推理与图像生成能力,推动AI技术发展。