全部 未讀 (37762) ★ 收藏 (0) 🤖 人工智能 (14310) 📊 商业科技 (6638) 📁 媒体资讯 (5234) 📁 投资财经 (3217) 📁 生活文化 (2777) 💻 软件编程 (2052) 📁 个人成长 (1956) 📁 体育运动 (995) 🎨 产品设计 (531) 📁 AI 产品 (39)
篩選中: 🏷️ 视觉编码器 共 2 篇 ✕ 清除篩選
37764
全部文章
37762
未讀
32
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-07 00:00)
BestBlogs 精選 (37691)

🏷️ 熱門標籤

AI Agent 3164 政策解读 1599 投资与市场 1393 AI 编程 1329 宏观经济 1267 产业动态 1250 国际新闻 1152 LLM 1148 Anthropic 1087 Claude Code 1038 社会议题 989 国内新闻 963 地缘政治 924 OpenAI 891 科技新闻 879 AI 智能体 788 生活方式 690 开源 683 足球 671 个人成长 663
刚刚,谢赛宁团队放出第二代表征自编码器
📌 一句话摘要 纽约大学谢赛宁团队联合 Adobe Research 与澳大利亚国立大学发布 RAEv2,通过融合多层编码器特征、互补 REPA 对齐损失以及利用 REPA 头实现免训练引导,将图像生成模型训练收敛速度提升 5-10 倍,同时保持极低计算成本。 📝 详细摘要 本文报道了纽约大学谢
📅 2026-05-21 11:03 (05-21 11:03) 机器之心 人工智能 2 分鐘 ★ 88
RAEv2 表征自编码器 图像生成 扩散模型
对话灵感实验室:全帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型
📌 一句话摘要 格灵深瞳灵感实验室分享了其在低成本全帧率视频理解上的技术突破,以及从 CV 到多模态时代,如何通过分层部署策略解决真实业务落地的工程化思考。 📝 详细摘要 本文是 InfoQ 对格灵深瞳灵感实验室的深度访谈。文章核心围绕两个层面展开:技术层面,灵感实验室介绍了其最新成果 LLaV
📅 2026-05-20 16:39 (05-20 16:39) InfoQ 中文 人工智能 2 分鐘 ★ 88
全帧率视频理解 LLaVA-OneVision-2.0 视觉编码器 VLM