AI大事件2025-04-17
1、OpenAI发布两款多模态推理模型o4-mini、满血版o3
主要内容:
🛠️ o4-mini和o3具备多模态处理能力,能同时处理文本、图像和音频,并自动调用外部工具。
📊 o4-mini在AIME2024和2025测试中准确率分别达到93.4%和92.7%,超越满血版o3。
💻 在编程竞赛中,o4-mini获得2700分,跻身全球前200名程序员,展现出强大的编程能力。
2、微信首个AI助手“元宝”正式上线,可以添加为微信好友
主要内容:
🌟 微信首个AI助手“元宝”上线,用户可直接在微信中搜索添加。
📊 元宝支持解析公众号文章、图片和文档,提供智能互动。
🔒 具备隐私保护功能,支持证件照自动打码。
3、字节发布豆包1.5深度思考模型:多模态深度思考、延迟低
主要内容:
📈 豆包1.5模型在数学、编程等领域表现出色,采用MoE架构,参数配置优越。
🌍 新模型结合视觉理解技术,能够分析照片,辅助旅行和项目管理,功能强大。
🎥 视频搜索能力显著增强,用户可快速获取视频中的相关信息,使用量持续增长。
4、月之暗面Kimi开源数学定理证明模型Kimina-Prover
主要内容:
🔍 Kimina-Prover在miniF2F基准测试中达到了80.7%的通过率,超越了之前的最佳结果。
🚀 该模型结合了大规模强化学习与形式化推理,显著提升了推理能力和样本效率。
📚 Kimina-Prover的可解释性强,用户可以查看推导过程,为理解模型行为提供便利。
5、OpenAI开源超Agent:Codex CLI,五小时内破5000颗星
主要内容:
🌟 Codex CLI在发布后仅5小时便获得5000颗星评价,预计当天将突破1万颗星。
💻 该工具可以自动生成代码、运行代码、重构和测试代码,功能强大且实用。
📈 OpenAI计划持续推出更多智能体产品,并在探索收购AI编程平台以增强竞争力。
6、谷歌Gemini Live功能全面开放,安卓用户迎来新体验
主要内容:
🌟 Gemini Live功能现已免费向所有安卓用户开放,原本仅限于Pixel9和Galaxy S25用户。
📸 该功能可以实时识别摄像头和屏幕内容,提供即时信息和反馈,提升用户互动体验。
🚀 微软同日推出类似的AI工具Copilot Vision,显示出实时信息识别技术的快速进步。
7、OpenAI拟以30亿美元收购AI编程工具Windsurf
主要内容:
💰 OpenAI正在与Windsurf进行30亿美元的收购谈判,若达成将成为其最大规模的并购交易。
🚀 Windsurf是一款广受欢迎的AI编程助手,支持代码生成和解释,已获得超过2亿美元的融资。
📈 此次收购将增强OpenAI的编程能力,帮助其在竞争激烈的AI工具市场中占据领先地位。
8、JetBrains推出编码智能体Junie AI,助力编程与调试全新体验
主要内容:
🤖 Junie AI已达生产就绪状态,专注于复杂任务的处理与调试。
📈 更新的AI助手支持多种最新AI模型,并新增多文件编辑功能。
🌐 JetBrains将推出免费套餐,提供无限代码补全,以满足不同开发者的需求。
9、Reachy 2开源人形机器人正式开售
主要内容:
🤖 高度仿人设计,具备7自由度手臂,能够自然、精准地执行动作,适合多种应用场景。
🔄 模块化与开源架构,支持Python SDK编程,开发者可根据需求扩展功能,推动技术创新。
🌍 已在全球20多个国家部署,客户包括知名机构,展现出在医疗、零售及教育等领域的广泛应用潜力。
10、上海人工智能实验室推出升级版多模态大模型“书生・万象3.0”
主要内容:
🚀 升级版“书生・万象3.0”在多模态处理能力上有显著提升,适用于多种应用场景。
💡 该模型在性能和用户体验上都有明显进步,响应速度和理解能力均增强。
🌐 开源举措为开发者提供了新的平台,鼓励创新和应用,推动行业发展。
11、豆包深度思考和文生图3.0模型正式开放API对企业客户开放
主要内容:
🧠 豆包1.5·深度思考模型在专业领域推理任务中表现优异,接近全球第一梯队水平。
🎨 豆包文生图模型3.0实现高分辨率图像生成,提升了创作效率,具备商业级设计能力。
🚀 两款模型的开放API为企业客户提供了更高效、通用的推理与图像生成能力,推动AI技术发展。