全部 未讀 (37893) ★ 收藏 (0) 🤖 人工智能 (14331) 📊 商业科技 (6658) 📁 媒体资讯 (5261) 📁 投资财经 (3246) 📁 生活文化 (2798) 💻 软件编程 (2055) 📁 个人成长 (1960) 📁 体育运动 (999) 🎨 产品设计 (533) 📁 AI 产品 (39)
篩選中: 🏷️ 实时 共 96 篇 ✕ 清除篩選
37895
全部文章
37893
未讀
163
今日新增
0
收藏
📡 Poller 最後抓取: 1 小時前 (08-07 12:00)
BestBlogs 精選 (37822)

🏷️ 熱門標籤

AI Agent 3170 政策解读 1608 投资与市场 1404 AI 编程 1330 宏观经济 1277 产业动态 1257 国际新闻 1156 LLM 1150 Anthropic 1087 Claude Code 1038 社会议题 993 国内新闻 967 地缘政治 929 OpenAI 891 科技新闻 883 AI 智能体 788 生活方式 696 开源 684 足球 673 个人成长 668
SeedRealtime 音视频全双工大模型发布:走向全模态自然交互
📌 一句话摘要 字节跳动 Seed 团队发布原生音视频全双工大模型 SeedRealtime,通过统一架构融合音频、视频与文本,实现边看、边听、边说的实时交互体验,已在豆包 App 全量上线。 📝 详细摘要 本文是字节跳动 Seed 团队关于 SeedRealtime 模型的官方发布文章。文章首
📅 2026-08-05 12:05 (2 天前) 字节跳动Seed 人工智能 2 分鐘 ★ 90
多模态 AI AI Agent 音视频交互 实时交互
GPT-Live 底层拆解:OpenAI 如何让 95% 的音频帧不再延迟
📌 一句话摘要 文章深度拆解了 GPT-Live 如何通过音频路径重构、WARP 协议优化和双模型架构,将音频帧 p95 延迟降至旧系统 p50 水平,实现近实时语音交互。 📝 详细摘要 文章详细解析了 OpenAI 在 GPT-Live 中对实时语音系统的工程改造:首先将音频处理从 Pytho
📅 2026-08-04 18:27 (2 天前) AI科技评论 人工智能 2 分鐘 ★ 86
实时语音 WebRTC GPT-Live AI Agent
理解归 AI,正确归引擎:从一句话到一条实时数据链路(0 代码搭建实时任务)
📌 一句话摘要 本文介绍一种 AI 辅助的指标驱动实时数据开发系统,通过自然语言生成 DSL 再由引擎生成 Flink SQL,实现零代码搭建实时任务。 📝 详细摘要 文章以直播业务中的实时数据需求为切入点,指出离线数据开发仅需表达业务逻辑,而实时数据开发还需处理窗口、状态、乱序等流式特性,导致
📅 2026-08-04 09:56 (3 天前) 阿里云开发者 人工智能 2 分鐘 ★ 93
AI 辅助开发 LLM Prompt Engineering Developer Tools
文件上传即可检索|实时多模态向量链路落地实践分享
📌 一句话摘要 本文介绍了基于火山引擎 Flink 与 VikingDB 构建的实时多模态向量链路,详细说明架构、两种实现方案及验证方法,实现文件上传秒级可检索。 📝 详细摘要 文章围绕企业 AI 应用从概念验证到生产的数据更新痛点,提出使用 TOS-CDC、Flink 和 VikingDB 构
📅 2026-08-04 19:12 (2 天前) 字节跳动技术团队 人工智能 2 分鐘 ★ 90
实时向量化 Flink VikingDB 多模态
RSTGameTranslation:游戏画面实时 OCR 翻译工具
📌 一句话摘要 该项目通过 OCR 识别游戏文字并调用 AI 翻译(支持云端和本地),在屏幕上实时显示翻译结果并可语音朗读。 📝 详细摘要 针对日文、韩文等缺少官方中文的游戏,RSTGameTranslation 能在游戏画面上实时捕获文字并使用 OCR 进行识别,再通过 Gemini、Chat
📅 2026-08-02 21:30 (4 天前) GitHubDaily 人工智能 1 分鐘 ★ 73
RSTGameTranslation 游戏实时翻译 OCR AI翻译
昆仑万维押注世界模型的两大产业路径:内容创作实时、可交互,机器人先“预演”再行动
📌 一句话摘要 昆仑万维发布 Matrix-3.5、Mureka V9.5 及 Riemann-1.0 等世界模型,分别探索游戏内容实时生成、AI 音乐创作与机器人具身智能两大产业路径,强调实时交互、状态预测与因果推理能力。 📝 详细摘要 昆仑万维在 2026 年世界模型元年集中发布多款模型,包
📅 2026-07-28 13:29 (10 天前) InfoQ 中文 人工智能 1 分鐘 ★ 88
世界模型 具身智能 AI 生成内容 机器人
全新统一流式架构,Vivix 灵动时刻正式发布首个实时互动模型
📌 一句话摘要 Vivix 发布实时交互多模态模型 A1,通过统一流式架构与高效推理优化,使近 30B 参数的模型可在消费级 GPU 上实现低延迟实时视频对话。 📝 详细摘要 文章报道了 Vivix 公司发布的实时交互多模态模型 A1 及配套平台 W1。A1 模型能够让虚拟角色像打视频电话一样与
📅 2026-07-25 11:21 (13 天前) henry 人工智能 1 分鐘 ★ 85
多模态 AI 视频生成 实时交互 模型压缩
能实时改变的剧情、会行动的 AI 角色,Vivix 灵动时刻正式发布首个实时互动模型
📌 一句话摘要 Vivix 发布实时互动多模态模型 A1 和 W1,支持角色全身表演与场景动态变化,端到端延迟低至 1.7 秒。 📝 详细摘要 文章介绍了成立一年多的 AI 公司 Vivix 在 2024 年 7 月 24 日正式发布的两款约 30B 参数的实时交互多模态模型 A1 和 W1。A
📅 2026-07-24 21:32 (13 天前) 极客公园 人工智能 4 分鐘 ★ 78
AI 编程 多模态 AI 实时交互 视频生成
Halliday 发布第二代 AI 眼镜 Halliday G2,AI 功能走向“实时参与会议”
📌 一句话摘要 Halliday 发布第二代 AI 眼镜 G2,以双目光波导显示和 Meeting Flow 实时会议辅助为核心,强调无摄像头设计和自然佩戴体验。 📝 详细摘要 本文报道了 Halliday 第二代 AI 眼镜 G2 的发布。产品核心创新在于 Meeting Flow 体验,将实
📅 2026-07-22 12:10 (16 天前) 量子位的朋友们 人工智能 1 分鐘 ★ 80
AI 硬件 AI 产品与应用 智能眼镜 实时翻译
从生成到行动,生数科技用通用世界模型连接「两个世界」
📌 一句话摘要 生数科技通过通用世界模型,将视频生成、实时交互与机器人行动统一,实现从数字内容生成到物理世界理解、推演与行动的闭环。 📝 详细摘要 文章介绍了生数科技的通用世界模型战略。作者指出,世界模型不仅是视频或语言模型的升级,而是 AI 从“生成内容”迈向“理解世界、推演世界、与世界实时交
📅 2026-07-22 08:48 (16 天前) 雷峰网 人工智能 2 分鐘 ★ 80
世界模型 视频生成 具身智能 机器人控制
快一点!再快一点!快到世界能实时生成|和生数科技张金涛聊:Vidu S1、推理加速、实时交互视频
📌 一句话摘要 对话生数科技张金涛,深度拆解 Vidu S1 实时交互视频模型背后的全栈推理加速技术,以及他对 AI 视频未来趋势与创业管理的思考。 📝 详细摘要 本期节目,26 岁的清华在读博士、生数科技推理加速负责人张金涛,分享了从学术研究(SageAttention)到 Vidu S1 实
📅 2026-07-20 00:00 (18 天前) 十字路口Crossing 人工智能 2 分鐘 ★ 92
视频生成 推理加速 Vidu S1 SageAttention
Wan-Streamer v0.2:响应延迟仅 550ms,让 AI 真正与你"面对面"
📌 一句话摘要 Wan-Streamer v0.2 通过端到端全模态架构实现 550ms 响应延迟,支持高清视觉输出和实时双工交互。 📝 详细摘要 文章介绍了通义实验室最新发布的 Wan-Streamer v0.2,这是一个面向实时双工交互的端到端全模态理解与生成模型。其核心创新在于将听、看、说
📅 2026-07-17 15:14 (20 天前) 通义实验室 人工智能 2 分鐘 ★ 78
AI 模型 实时交互 端到端架构 多模态 AI
PixVerse 29.8 亿融资后,正在押注一个更大的故事
📌 一句话摘要 本文结合对 PixVerse Game 的实测,分析 AI 视频公司集体转向世界模型的逻辑,从融资、产品、技术演进到商业前景,揭示实时视频模型驱动游戏引擎的行业图景。 📝 详细摘要 文章以 PixVerse 完成 29.8 亿元 C 轮融资并发布实时视频模型驱动的游戏引擎 Pix
📅 2026-07-16 17:00 (21 天前) 十字路口Crossing 人工智能 7 分鐘 ★ 87
AI视频生成 世界模型 AI游戏引擎 实时渲染
我和「二次元老公」约上会了!全球首个可以玩的实时交互模型,Xmax X2.0 发布
📌 一句话摘要 Xmax AI 发布全球首个实时交互视频模型 X2.0,支持毫秒级响应的实时换人、异次元召唤与触屏交互,并可在消费级显卡和 iPhone 上本地运行,开放 API 面向电商、虚拟陪伴、直播等行业。 📝 详细摘要 Xmax AI 于今日凌晨全球首发实时交互视频模型 X2.0,主推三
📅 2026-07-15 16:09 (22 天前) Jay 人工智能 2 分鐘 ★ 77
AI视频生成 实时交互 视频模型 AIGC
实测 PixVerse Game:当游戏可以「随玩随做」,是什么体验
📌 一句话摘要 PixVerse Game 通过自然语言实时生成可交互游戏原型,并配备 Game Composer 让创作者即时迭代,实现『创作即游玩』的体验。 📝 详细摘要 文章详细介绍了爱诗科技推出的全球首个实时视频驱动游戏引擎 PixVerse Game。用户只需输入一句话(如「一个小猫在
📅 2026-07-16 02:49 (22 天前) 艾 梵 人工智能 2 分鐘 ★ 87
AI 游戏 实时视频引擎 自然语言交互 游戏原型
又快又聪明,阿里发布 Qwen-Audio-3.0-Realtime:实时语音大模型四项功能升级
📌 一句话摘要 阿里发布 Qwen-Audio-3.0-Realtime 实时语音大模型,在推理、工具调用、共情对话和双工交互四个维度同步升级,并提供更强的 Plus 与更快的 Flash 版本。 📝 详细摘要 本文报道阿里巴巴于 7 月 15 日发布的最新实时语音交互模型 Qwen-Audio
📅 2026-07-15 11:48 (23 天前) 量子位的朋友们 人工智能 2 分鐘 ★ 75
大语言模型 语音AI AI Agent 多模态AI
OpenAI 发布 GPT‑Live 全双工语音模型
📌 一句话摘要 OpenAI 推出 GPT‑Live,采用全双工架构实现更自然的实时人机对话,具备实时翻译和对话人格增强。 📝 详细摘要 该推文引用了 OpenAI 官方公告,介绍了 GPT‑Live 作为新一代语音模型的核心升级:全双工架构使模型能够同时听取和输出语音,无需等待用户说完再响应;
📅 2026-07-09 08:00 (29 天前) Berryxia.AI 人工智能 4 分鐘 ★ 89
GPT‑Live 全双工 语音模型 OpenAI
OpenAI 发布 GPT Live:全双工实时对话模型
📌 一句话摘要 OpenAI 发布 GPT Live,具备全双工架构和超越人类的同传翻译反应速度。 📝 详细摘要 推文宣布 OpenAI 发布 GPT Live 模型,该模型采用全双工架构实现同时听说能力,并在同传翻译场景下展现出超越人类的反应速度,附带了官方演示视频。 📊 文章信息 AI 初
📅 2026-07-09 06:23 (29 天前) Orange AI 人工智能 2 分鐘 ★ 76
OpenAI GPT Live 实时语音 全双工架构
50FPS、成本打掉 70%,魔芯 MoWorld 把世界模型带进产业时代
📌 一句话摘要 魔芯科技发布基于国产 NPU 的实时交互世界模型 MoWorld,推理速度超 50FPS 且成本仅为同规模 GPU 方案的 30%,推动世界模型从能生成向能交互、能部署迈进。 📝 详细摘要 文章介绍魔芯科技联合浙江大学潘云鹤院士、华为等推出的全栈国产 NPU 实时交互世界模型 M
📅 2026-07-08 21:29 (29 天前) 思邈 人工智能 3 分鐘 ★ 81
世界模型 实时交互 国产NPU AI模型
广西南宁通报受灾情况
📌 一句话摘要 本文报道广西南宁市防汛救灾新闻发布会内容,包含水库漫顶、人员伤亡及转移安置数据。 📝 详细摘要 文章转述南宁市防汛救灾新闻发布会信息:7 月 6 日上午,横州市六蓝水库、云表水库出现漫顶及缺口,宾阳县六旺水库出现漫坝。截至目前,全市约 5.5 万人受灾,转移 4.8 万人,死亡
📅 2026-07-06 22:07 (07-06 22:07) 人民网 媒体资讯 5 分鐘 ★ 78
自然灾害 防汛救灾 社会新闻 公共安全