AI日报:可灵AI全量上线O1视频大模型;千问APP接入万相Wan2.5

AI日报:可灵AI全量上线O1视频大模型;千问APP接入万相Wan2.5

本文汇总了AI领域的最新动态:可灵AI发布O1视频大模型,支持多模态输入一键生成视频;千问APP接入万相Wan2.5,提升视频创作能力;PixVerse V5.5实现音画同步,简化视频制作


闪购转向收缩,阿里要在「AI to C」发起新攻势

闪购转向收缩,阿里要在「AI to C」发起新攻势

在阿里于11月25日发布Q2财报之后,AI和中国电商业务里淘宝闪购业务的进展,毫无疑问是其中的两大关注点。值得关注的几组数据包括,集团收入2477.95亿元,剔除已出售的高鑫零


AI日报:FLUX.2开源发布;腾讯混元3D创作引擎上线国际站;百度新设立两个大模型研发部门

AI日报:FLUX.2开源发布;腾讯混元3D创作引擎上线国际站;百度新设立两个大模型研发部门

本期AI日报聚焦多项技术突破:FLUX.1开源图像模型支持多图参考与4MP编辑;腾讯混元3D引擎国际站上线,简化海外用户创作流程;字节跳动TRAE SOLO模式实现端到端自动化开发;


AI日报:豆包输入法正式上线;混元开源HunyuanOCR模型;Claude Opus4.5发布

AI日报:豆包输入法正式上线;混元开源HunyuanOCR模型;Claude Opus4.5发布

本期AI日报聚焦多项技术突破:腾讯开源10亿参数OCR模型HunyuanOCR,在多场景实现SOTA性能;豆包输入法整合AI实现智能预测;Anthropic推出Claude Opus4.5提升推理效率;Chat


百度AI:熬过“起大早”的孤独,等来时代的奖励

百度AI:熬过“起大早”的孤独,等来时代的奖励

AI的故事,又进入到了新阶段。11月13日,第20届百度世界大会举行。在这场被视为AI行业风向标的会议上,百度创始人李彦宏发表了题为《效果涌现》的主旨演讲。他表示,当前,


AI日报:腾讯元宝推视频模型HunyuanVideo1.5;谷歌Nano Banana Pro上线;夸克AI眼镜与高德合作加码

AI日报:腾讯元宝推视频模型HunyuanVideo1.5;谷歌Nano Banana Pro上线;夸克AI眼镜与高德合作加码

腾讯元宝推出视频生成新功能,支持一句话或图片生成5-10秒高清视频;谷歌发布Nano Banana Pro模型,具备4K分辨率及联网搜索能力;夸克AI眼镜新增导航投屏等出行功能;豆包输


AI日报:谷歌Gemini 3 Pro Preview模型上线;Cloudflare文件异常致全球宕机;百度Q3 AI收入96亿元

AI日报:谷歌Gemini 3 Pro Preview模型上线;Cloudflare文件异常致全球宕机;百度Q3 AI收入96亿元

谷歌发布Gemini 3大模型及Antigravity AI开发平台,支持参数灵活调整;Cloudflare因配置异常致全球服务中断6小时;微软测试AI文件连接器,允许Claude直接读取本地文件;百度


50人团队、1亿美元ARR,AI PPT还在续写“神话”?

50人团队、1亿美元ARR,AI PPT还在续写“神话”?

AI 生成 PPT 可以说是去年的热门赛道,尤记得关于这类产品是否具有真正竞争力的热烈讨论,而2025年9月份的数据显示,赛道头部的明星创企 Gamma 却已经默默接近3000万的访问


谷歌发布Gemini 3 数学能力堪称全球最强

谷歌发布Gemini 3 数学能力堪称全球最强

谷歌正式推出新一代推理模型Gemini 3.0 Pro,在各大评测榜单表现优异:LMArena竞技场以1501分登顶,数学基准测试达23.4%远超同行,编程能力稳居第一梯队,视觉理解准确率高


AI日报:阿里千问APP公测;Veo 3.1上线多图参考;超级小爱AI大模型“随心修图”上线

AI日报:阿里千问APP公测;Veo 3.1上线多图参考;超级小爱AI大模型“随心修图”上线

本期AI日报聚焦多项技术突破:阿里千问APP公测,基于Qwen3模型对标ChatGPT;谷歌Veo 3.1支持三图融合生成8秒视频;小米推出


AI日报:李飞飞Marble 3D世界模型公测;OpenAI首次推出ChatGPT群聊功能;百度发布多模态 AI助手超能小度

AI日报:李飞飞Marble 3D世界模型公测;OpenAI首次推出ChatGPT群聊功能;百度发布多模态 AI助手超能小度

本期AI日报聚焦多项技术突破:World Labs推出Marble 3D模型,实现多模态生成可交互虚拟世界;OpenAI在韩新试点ChatGPT群聊功能,支持多人协作互动;苹果更新隐私政策,要求


AI日报:上海首例涉AI提示词著作权案宣判;Kimi K2 Thinking发布;中文图像编辑新王UniWorld-V2发布

AI日报:上海首例涉AI提示词著作权案宣判;Kimi K2 Thinking发布;中文图像编辑新王UniWorld-V2发布

今日AI领域动态:上海首例AI提示词著作权案宣判,法院认定提示词不具独创性;月之暗面发布Kimi K2思考模型,实现自主多轮工具调用;UniWorld-V2图像编辑模型支持中文框选即


AI日报:美团LongCat-Flash-Omni发布;Qwen3-Max上线深度思考功能;百度“文心”5.0重磅回归

AI日报:美团LongCat-Flash-Omni发布;Qwen3-Max上线深度思考功能;百度“文心”5.0重磅回归

本期AI日报聚焦多领域技术突破:美团发布全模态交互模型LongCat-Flash-Omni;阿里通义千问Qwen3-Max上线深度思考功能;百度文心5.0升级多模态生成能力;谷歌确认Gemini3年内


AI日报:豆包视频1.0pro fast发布;谷歌Gemini新功能上线;百度推上体体育大模型 2.0

AI日报:豆包视频1.0pro fast发布;谷歌Gemini新功能上线;百度推上体体育大模型 2.0

本期AI日报聚焦多项技术突破:火山引擎发布豆包视频生成模型1.0pro+fast,速度提升3倍且价格下降72%;百度与上海体育大学推出“上体体育大模型2.0”,拓展AI在运动员训练等


AI日报:腾讯发布全新ima2.0;微软发布 Copilot 一系列重磅更新;阿里夸克AI眼镜开启预售

AI日报:腾讯发布全新ima2.0;微软发布 Copilot 一系列重磅更新;阿里夸克AI眼镜开启预售

本文汇总近期AI领域重要动态:月之暗面再获数亿美元融资,显示资本对国产大模型的信心;Anthropic为Claude推出记忆功能,兼顾个性化与隐私保护;中科大与字节发布MoGA长视频


只有0.9B的PaddleOCR-VL,却是现在最强的OCR模型。

只有0.9B的PaddleOCR-VL,却是现在最强的OCR模型。

​这几天,OCR这个词,绝对是整个AI圈最火的词。因为DeepSeek-OCR,甚至让OCR这个赛道文艺复兴,又给直接带火了。整个Hugging Face的趋势版里,前4有3个OCR,甚至Qwen3-VL-


AI日报:OpenAI发布浏览器Atlas;通义Qwen3-VL新增2B、32B两个模型尺寸;百川发布循环证据增强大模型

AI日报:OpenAI发布浏览器Atlas;通义Qwen3-VL新增2B、32B两个模型尺寸;百川发布循环证据增强大模型

本文汇总AI领域最新动态:OpenAI推出集成ChatGPT的Atlas浏览器,实现多任务自主处理;阿里通义千问新增2B/32B视觉语言模型,手机可流畅运行;谷歌AI Studio升级Vibe Coding


ROBOT PHONE登场:荣耀为AI终端开了自进化的未来新局

ROBOT PHONE登场:荣耀为AI终端开了自进化的未来新局

​十年前,AI还停留在算力、模型与数据此消彼长的层面。如今,技术的发展早已超乎想象。2025年上半年,Google DeepMind重磅推出的AlphaEvolve揭示了一个重要趋势:AI开始拥有


AI日报:视觉中国与多家大模型公司达成合作;OpenAI紧急暂停Sora生成已故名人;谷歌推出Gemini地图数据集成工具

AI日报:视觉中国与多家大模型公司达成合作;OpenAI紧急暂停Sora生成已故名人;谷歌推出Gemini地图数据集成工具

视觉中国与多家AI公司合作开发可商用视觉大模型,已获阿里、微软等订单。OpenAI因不当内容暂停Sora生成马丁·路德·金形象视频,引发AI伦理讨论。DeepSeek在加密货币交易实


AI日报:豆包大模型1.6-vision发布;DeepSeek发布V3.2-exp模型;Claude Sonnet4.5发布

AI日报:豆包大模型1.6-vision发布;DeepSeek发布V3.2-exp模型;Claude Sonnet4.5发布

本期AI日报聚焦多项技术突破:DeepSeek发布V3.2-exp模型,通过稀疏注意力机制降低API成本50%;Anthropic推出Claude Sonnet 4.5,在编码任务表现卓越;ChatGPT新增即时结账功


返回顶部