{
    "success": true,
    "msg": "爱范儿",
    "title": "15秒了解全球新鲜事",
    "subtitle": "快讯",
    "update_time": "2026-09-16 02:32:03",
    "total": 20,
    "data": [
        {
            "index": 1,
            "time": "2026-09-15 20:24:41",
            "title": "荣耀运动健康战略升级，旗舰新品荣耀手表6 Pro将在9月28日发布",
            "url": "https://www.ifanr.com/digest/1680257",
            "desc": "9月15日，荣耀在深圳召开了荣耀开发者大会运动健康技术沟通会，宣布荣耀运动健康战略全面升级，进入主动智能健康管理时代，未来将持续以创新技术赋能大健康生态发展，宣布新一代旗舰智能手表荣耀手表6 Pro将于9月28日正式发布，这也标志着荣耀运动健康从“被动记录”迈向“主动守护”的全新阶段。沟通会上，荣耀终端有限公司产品线总裁方飞发表主题演讲，她表示：“运动健康将成为荣耀AI生态的重要战略支点，荣耀将继续聚焦感知技术、健康研究、AI能力与开放生态。”此次战略升级，源自荣耀运动健康十年积淀。自2016年起，荣耀便开始构建运动健康体系，凭借AI技术与专业医疗机构的合作，实现从单一硬件到全场景智慧健康生态的跨越，率先落地心脏停搏预警、血糖、血压等前沿健康数据监测管理功能，推动健康守护从日常监测迈向生命守护。“生命至上，在所有健康风险中，最危险的情况之一就是心脏停搏。”方飞在演讲中强调，心脏停跳4分钟以上即可能造成不可逆的脑损伤。心脏健康监测管理作为荣耀手表的核心优势之一，始终处于行业第一梯队，荣耀手表6 Pro携手知名医疗机构开展联合研究，将行业首发的“心脏停搏预警”功能带入智能手表。该功能通过双波长基准识别、多波长交叉核验、强光终极探查和用户行为识别四个递进阶段进行综合研判，并建立低、中、高、极高风险四级响应机制，一旦检测到心脏骤停即自动触发主动社会求救，率先实现智能穿戴在心脏骤停极境下的主动求救能力。区别于传统智能手表的“心率过低提醒”，荣耀手表6 Pro能够在心脏停搏升至极高风险乃至骤停时自动触发紧急呼救，为佩戴者争取宝贵的抢救时间，手表会立即拨打紧急电话，并启动包含高频声光呼救与屏幕高亮警示的全面提醒，让周边群众快速意识到异常并及时施救，为独居老人、熬夜白领及高强度运动人群牢牢守住黄金4分钟。从日常监测到主动求救，荣耀手表6 Pro实现了从“预警”到“急救”的完整健康守护闭环，也引领智能手表行业从“被动记录提醒”走向“主动社会求救”。“主动健康管理的基石，是高精度的底层感知。没有高质量的数据，再往上的健康管理就会成为空中楼阁。”方飞表示。荣耀自研的灵瞳感知系统历经三代演进，从第一代两通道、三波长升级为第三代九通道、四波长的分布式布局，通过多点布设全面扩容感知信道，达到行业领先的九通道。再结合460纳米蓝光与控光玻璃方案滤除无效光干扰，使底层光学效率提升83%、动态信号质量提升26.9%。依托该系统，荣耀手表在日常运动场景下的心率准确率达到行业领先的99.09%，为血压和脉搏评估奠定了高保真数据基础。除了上述功能外，荣耀手表6 Pro更带来了全面健康监测功能，其搭载防猝筛查、脉搏波房颤及早搏提示、全天HRV监测、ECG心电检测及三甲医院医生人工解读等专业健康功能，并随机附赠全国三甲医院门诊协助挂号服务，实现“手表发现风险，荣耀帮你挂号”，真正做到全天候多维度守护用户的健康。运动健康一直是荣耀手表的强项，荣耀手表6 Pro搭载北极星定位系统，结合GPS波形融合算法、惯性导航纠偏和AI大模型持续学习，支持双频高精度定位，满足户外运动轨迹记录。在专业运动层面，荣耀手表6 Pro内置专业羽毛球、专业足球与越野跑等多种运动模式，覆盖不同运动人群的进阶需求。专业羽毛球模式可精准识别6种挥拍动作，并输出20项运动数据，帮助球友清晰掌握每一次挥拍细节；专业足球模式生成热力图与轨迹图，直观呈现场上跑动表现，为赛后复盘提供数据参考；越野跑模式支持轨迹导入、偏移提醒与循迹返航，结合高精度高度表与气压计，实时呈现累计爬升、坡度变化等关键数据，助力跑者从容应对复杂地形与多变路况。荣耀手表6 Pro以“先锋旗舰质感”为设计原点，融合高级腕表的奢华工艺与现代机能线条，重塑腕间美学。经典圆形表盘配备1.5英寸像素光刻屏，峰值亮度高达5500nits，支持高亮AOD常显，户外强光下依然清晰通透。拥有精钢黑、精钢黄、陶瓷黑、陶瓷棕、陶瓷银五款配色，细节彰显独特品位。荣耀运动健康“战略升级”的发布，标志着荣耀在运动健康领域从“技术创新”到“生态引领”的质变跃迁，以创新技术不断突破行业边界，为用户带来更科学、更精准、更完善的腕上健康守护。在谈及荣耀下一步的探索时，荣耀终端有限公司产品线总裁方飞表示：“可以说，荣耀已经进入了行业无人区。血糖研究现在只是起步。未来，血糖研究将与血压研究一起，为我们打开更大的想象空间。荣耀将携手更多合作伙伴一起不断向前探索。”此次荣耀运动健康战略升级所勾勒的主动健康及运动监测能力，将在9月28日正式发布的新一代旗舰智能手表荣耀手表6 Pro上集中呈现，为每一位用户带来更智能、更全面的健康守护。"
        },
        {
            "index": 2,
            "time": "2026-09-15 20:21:49",
            "title": "全球AI视频榜单第一梯队再添中国力量：智象发布首款物理规律导向视频模型",
            "url": "https://www.ifanr.com/digest/1680259",
            "desc": "智象未来（HiDream.ai）正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0今天，智象未来（HiDream.ai）正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(模型简称 HD-V1）。HD-V1采用智象自研原生全模态架构，支持文本、图片、视频等多种模态输入，可一键直出5–20秒1080p高保真视频，同时 在意图理解、物理规律理解、自主规划叙事、以及音画一体化生成等维度均全面升级，达到全球领先水平。发布同期，HD-V1 在两项国际权威评测榜单中，均位居世界前列。在全球领先的独立 AI 基准测试与分析平台Artificial Analysis Image to Video Leaderboard（With Audio）排行榜上，HD-V1 取得全球排名第四的佳绩。Artificial Analysis 的图生视频榜单以标准化、可复现的基准对全球头部视频生成模型进行系统评测，被视为衡量AI视频模型综合实力的重要标尺。在全球最具影响力的AI 模型盲测评测平台 Arena.ai Image-to-Video 中，HD-V1也取得了第8的优异成绩。Arena.ai Image-to-Video是专注于AI视频生成模型的盲测评测子平台，是目前评估图生视频模型能力的重要第三方参考，被全球国际主流 AI 厂商广泛引用。放在全球 AI 竞争格局中看，这一成绩的意义远超名次本身：多模态是当下全球人工智能的核心战场，图生视频则是其中技术密度最高、竞争最激烈的方向之一。HD-V1 以双榜高位成绩完成全球首次亮相，这标志着中国优秀大模型企业已全面领先，形成全球AI视频模型第一梯队 。智象未来 CTO 姚霆表示：“HiDream-O1-Video-1.0 是智象原生全模态世界模型矩阵的关键组成部分。我们始终相信，视频生成的代际进化不仅仅是像素的提升和时长的延续，而在于模型是否真正理解创作者的意图和真实世界的物理规律。HD-V1从架构设计之初便面向文本、视频与音频的统一表征，原生全模态技术使之从‘看得清、动得顺’，迈向‘听得懂、说得准、演得连贯’。这次在两项国际权威榜单中再次进入第一梯队，是对智象原生全模态技术路线最直接的验证。”01.原生全模态，更懂意图、更懂物理视频生成的难点，往往不在“会不会画”，而在“有没有听懂”。用户输入常常是口语化、碎片化、模糊化的信息。直接输入丢给模型，很容易出现意图漏解、镜头跳戏、人物漂移与音画错位等问题。为此，HD-V1的设计中 前置多模态意图理解模块，借助多模态理解模型的深度理解与思考，对视频内容进行结构化规划。规划内容包括镜头时长、场景地点、画面内容、首帧约束、在场角色、动作与表情、景别构图、运镜焦段、台词与背景声等音效设计等等字段。该模块的存在，保证模型充分理解用户自然语言输入的意图，并转换成模型可接受的专业表达。理解越深，规划越稳；规划越稳，后续联合生成越不容易“跑偏”。理解意图只是第一步，HD-V1的另一重要突破，是“更懂物理”。物体在重力作用下如何落下、碰撞如何反馈、惯性如何延续、光影如何衰减、空间如何保持连续——这些物理规律既被理解，也被写进视频模型的叙事之中，成为画面生成的底层逻辑。当物理规律进入生成逻辑，画面的真实质感得到全面提升。以下三组demo，是在同样的提示词下，三款业内顶级模型生成的视频对比，第三个demo为HD-V1生成（全文均同）。模型一的画面中，双手相向发力，红线产生了向内缩短的“不合理”现象；模型二则突兀地凭空生出一根针。而HD-V1生成的画面截然不同：双手相向发力时，红线自然隆起，与模型一形成鲜明对比；当左手拇指向外轻捻线头，红线便随手的发力顺势延展，张力、走向与形变皆贴合真实物理。而且画面还有着极佳的真实质感，指甲的纹理，针的金属感等都表现得非常真实，甚至从中能感受到线的柔韧。02.画面高保真、叙事连贯性、人物一致性全面升级针对高保真画质、叙事连贯性与人物一致性等关键指标，HD-V1实现了全面优化升级。它不只追求单帧画面的精美，更要让视频内容在整体叙事维度上自洽。当人物、情绪、动机、物理规律，一旦进入连续镜头，就必然互相影响。为此，智象提出了 “先规划、后联合生成、再以多模态 Reward 对齐”的技术思路 ，让模型先在全局层面规划叙事与角色状态，再在联合生成中约束画面、动作和语义，最后用多模态奖励信号对齐画质、连贯性与物理合理性。03.服从叙事内容视频生成时长的逻辑革新多数视频生成时长遵循的是固定提示词路线，比如用户在提示词中输入生成 5 秒，模型只能在这个时间窗口内填充内容，内容叙事“被迫”适应时长。HD-V1的做法，是 把时长决策交还给内容本身 。模型根据事件展开的逻辑、动作完成的周期、叙事推进的节奏，自行规划生成时长。这一能力的关键，不在于简单改变帧数，而在于把时长选择与内容情境绑定，服务用户真正的目标——在连贯叙事中交付合理、真实质感的完整画面。同样是三款模型的真实对比。前两款模型都“机械地”生成了10秒钟画面，但一颗苹果从抛出到接住，本是一个短促的过程，并不需要撑满10秒。于是，模型一在动作完成后，从第三秒起只能让手继续握着苹果，画面停留在无意义的等待里；模型二则用慢放的形式，来填补时长。而HD-V1生成的画面，人物抛出、接住、稳定手持，节奏自然发生。04.文本、视频、音频信号联合建模音画原生一体化生成音画不同步是AI视频生成模型的一个普遍通病。这是因为当前多数视频模型采用的后期拼接技术路线：先逐帧生成画面，再回头配音配效，声音跟画面很难保持一致。HD-V1 采用了原生全模态架构，对文本、视频、音频信号进行联合建模 。三者在同一生成过程中相互约束、相互对齐：画面运动牵引声音节奏，台词与音效反哺镜头情绪，文本条件贯穿始终。这种联合建模，直接服务于音画同步与叙事连贯。镜头切换时，环境声与配乐随之过渡；人物开口时，口型、气口与情绪同频；物理动作发生时，拟音效果与撞击反馈更贴近真实因果。这是一个乒乓球在桌子上弹跳的画面。从三款模型生成的画面来看，只有HD-V1生成的内容，不仅乒乓球掉落的节奏符合物理规律，每次掉落的声音也随着高度的变化而变化，完全符合现实质感。实现真实世界的质感，根源在于模型的技术产品哲学：以人的感受为尺度。为此在后训练阶段，采用 Diffusion Reinforcement Learning，并设计与人工认知对齐的多模态 Reward 模型，对音视频内容进行从画面到声音、从局部到整体的统一评估。05.世界模型闭环成型从单点能力到原生全模态矩阵从今年4月正式发布原生全模态世界模型架构HiDream-O1以来，智象陆续发布了基于同一架构的模型家族，这几款模型也分别在各自赛道上取得国际权威榜单的领先位置。图像生成模型HiDream‑O1‑Image系列 ，其中商用版1.5 版本在国际独立评测平台 Artificial Analysis 文生图榜单中，取得中国第一、全球第二的成绩；开源版本也取得了第二的成绩。交互式世界模型 HiDream‑O1‑World ，名列行业首个交互式世界模型基准 WBench综合总榜第一。具身世界模型 HiDream‑O1‑Embodied ，先后在 RoboColiseum的扰动适应和空间推理子榜单中登顶榜首。随着视频模型正式发布，业内首个原生全模态世界模型闭环就此成型。图像、视频、3D交互与具身动作，在统一原生的世界模型中交汇、共生、循环。智象创始人梅涛博士表示：“基于我们对下一代人工智能技术路线的认知，智象致力于构建 ‘一个原生全模态底座、四大模型同源演进’的模型矩阵。我们所构建的，不是四条彼此独立的能力线，而是一套以统一技术架构为底座、面向世界模型持续进化走向可落地的原生全模态体系。”06.C+轮融资落定，国资产业资本组团再加码在HD-V1发布之际，智象同时宣布完成C+轮融资。本轮投资方为 新微资本、交子资本、工银资本 ，体现了资本市场对公司原生全模态技术路线、世界模型布局及产业化潜力的高度认可。新微资本由上海新微科技集团、上海科创投集团以及管理团队共同发起成立，管理基金规模近百亿元。作为新微集团的CVC，新微资本正持续加强在人工智能赛道的布局，依托新微集团在集成电路特色工艺制造领域的产业基座，构建在AI时代具备持续竞争力的新微产业生态。新微资本表示：“智象未来的原生全模态世界模型矩阵，向上连接算力与AI基础设施，向下延伸至智能终端与行业应用，与新微集团的产业布局高度协同。未来新微将以制造能力支撑算力基建，以产业资源加速模型落地，助力智象未来占据世界模型时代的关键席位。”交子资本是成都交子金控集团旗下全资国有股权投资平台，也是成都建设西部金融中心的重要产业资本载体，管理基金规模超1700亿元。依托成都、辐射西部、链接全国，交子资本聚焦人工智能等硬科技赛道，以长期资本和产业资源推动科技成果转化与产业生态建设。交子资本相关负责人表示：“智象未来持续推动图像、视频、3D交互与具身四大模型同源演进，围绕底层架构持续创新，构建原生全模态世界模型矩阵。这一路线在行业中具有鲜明的稀缺性和领先性。HiDream-O1-Video-1.0的发布补齐了模型矩阵的关键一环，进一步验证了公司技术路线的前瞻性与落地能力。我们期待发挥国有产业资本的长期陪伴与资源协同作用，助力智象未来成长为具有全球竞争力的AI企业，并带动成都、辐射西部人工智能产业生态建设。”随着HD-V1视频模型的发布，从原生全模态通往世界模型，不再只是一张战略蓝图，而是闭环发展、持续演进的现实。"
        },
        {
            "index": 3,
            "time": "2026-09-15 20:14:05",
            "title": "美图：创始人吴欣鸿再增持100万股，其从未出售过公司股份",
            "url": "https://www.ifanr.com/digest/1680255",
            "desc": "9月15日，美图公司（1357.HK）发布公告，宣布美图公司创始人、董事长兼首席执行官吴欣鸿于2026年9月15日以每股平均价3.899港元购入本公司100万股股份。公开信息显示，吴欣鸿自2018年5月10日起多次增持美图公司股份，连同本次增持，已累计购买658万股美图公司股份。本次增持后，吴欣鸿拥有股份占美图公司已发行股本约12.99％。公告表示，针对近日有网络消息称吴欣鸿已出售或拟出售公司持股，美图公司特别澄清，吴欣鸿从未出售公司的任何股份，且无任何计划和意向出售或以其他方式减持其所持的美图公司股份。吴欣鸿进一步表示，美图业务基本面保持强劲，鉴于公司产品创新持续提速且具备长期增长潜力，不排除于适当时候进一步增持美图公司股份。此外，据港交所公告，9月15日，美图公司再回购510万股股票，本次回购金额约2000万港元。"
        },
        {
            "index": 4,
            "time": "2026-09-15 20:12:47",
            "title": "荣耀CEO李健：荣耀把 AI 探索的无人区走成主干道",
            "url": "https://www.ifanr.com/digest/1680252",
            "desc": "9月15日，荣耀CEO李健在MagicOS 11发布会上表示，在与全球用户和开发者的共创中，荣耀正在把 AI 探索的无人区，一步步走成繁华的主干道；把今天看起来不可思议的奇迹，变成明天触手可及的日常。当天，荣耀发布行业首个真正实现系统级Agent Harness商用落地的手机操作系统MagicOS 11。这意味着，荣耀MagicOS 11不仅能精准理解用户的复杂意图，更能深刻记住用户的日常习惯，将“自动执行”与“主动服务”融为一体，开启从单体智能到群体智慧的先河，实现从“会回答”到“会办事”跃迁。李健表示，从2016年荣耀第一代Magic 诞生并推出Magic Live 智慧引擎，到2021年Maigc UI 6.0上发布YOYO建议引领行业首发开启主动服务的先河，MagicOS 7上发布行业首创信任环技术并打破设备、品牌与生态的边界，MagicOS 9将YOYO建议升级为全球首个跨应用开放生态智能体，再到MagicOS 10带来YOYO记忆与YOYO执行并开启多模态全场景自动执行的先河。荣耀AI战略的早期部署和积极探索，引领行业的新一轮人机交互变革，让AI正在跨越屏幕、融入生活，打理人们衣食住行的方方面面。李健强调，AI正在重写手机操作系统的未来，MagicOS 也将从贴心助手逐步进化成一个无处不在、无所不能的智慧伙伴。"
        },
        {
            "index": 5,
            "time": "2026-09-15 16:37:38",
            "title": "阶跃全新发布 StepAudio 3：语音大模型进入“听说想做”阶段",
            "url": "https://www.ifanr.com/digest/1680223",
            "desc": "9月15日，阶跃发布新一代语音大模型 StepAudio 3 系列，一次性推出 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款模型，覆盖实时语音交互、语音识别、真人级语音生成和音乐创作等场景。其中，多款模型在权威第三方 AI 模型评测机构 Artificial Analysis 榜单中位列全球第一。相比过去主要围绕语音识别或语音生成等单项能力展开竞争，StepAudio 3 将能力进一步延伸至语音理解与生成、实时推理、任务执行和音频创作的全栈能力，让 AI 不仅能够“听”和“说”，也能够理解声音背后的语义与情绪，并参与更完整的交互和内容生产过程。其中，面向实时语音交互场景的 StepAudio 3 Realtime 支持原生全双工对话，可以在持续交流过程中判断何时回应、何时等待，并处理临时打断和连续反馈。在 Artificial Analysis Conversational Dynamics 榜单中，该模型以 98.9% 的综合得分排名全球第一。与传统实时语音模型主要追求低延迟和自然对话不同，StepAudio 3 Realtime 还进一步加入了语音推理和任务执行能力。模型能够同时理解语义、语气、情绪及环境声音，并支持推理与语音生成并行；Tool Call 和长任务则可以异步执行，在任务运行期间不打断当前对话。其在 Artificial Analysis Speech Reasoning 榜单中同样位列全球第一。在语音识别方面，StepAudio 3 ASR 将高精度识别与大语言模型的上下文理解和知识能力结合，不仅要解决“听清楚”，也进一步提升对专业术语、人名、地名、方言及复杂上下文的理解能力。该模型支持中文、英文、方言、中英混说、长音频和专业领域等多类场景，并针对低声、快速语音、含糊连读以及背景音乐等复杂输入进行优化。在 Artificial Analysis 非流式语音识别准确性榜单中，StepAudio 3 ASR 的 WER（词错误率）为 1.7%，并列全球第一。WER 越低意味着转写错误越少，该成绩意味着模型在第三方综合测试中的语音识别准确率已处于全球第一梯队。除实时交互和语音识别外，此次发布也进一步拓展了语音生成模型的能力边界。StepAudio 3 TTS 面向真人级语音生成，在音色、语调、节奏、停顿和情绪表达之外，还能够生成笑声、迟疑、重复、改口等真实交流中常见的副语言表现。该模型采用流式生成架构，可实现生成与播放同时进行，满足实时语音应用需求。StepAudio 3 Gen 则进一步将人声、音效、环境声和背景音乐等原本分散的生成环节整合到在一起。用户可以通过自然语言描述角色、场景和剧情，一次生成包含多种声音元素的完整音频，并控制角色音色、情绪以及不同声音出现的时间与顺序，广泛适用于影视、动画、游戏、广播剧、有声书和短视频等内容生产场景。面向音乐创作的 StepAudio 3 Music 不再局限于“一句话生成一首歌”，而是支持歌曲创作、清唱配乐、歌曲翻唱以及基于 ABC 记谱法的多轮交互创作。用户可以通过歌词、清唱、参考歌曲等不同形式与模型共同完成编曲和作品迭代，使 AI 更深入参与实际音乐生产流程。过去一年，语音大模型正从单项的语音识别和生成能力，逐渐走向实时交互、声音理解与内容创作的融合竞争。随着 StepAudio 3 系列发布，阶跃音频模型的产品版图，已经全面覆盖了听、说、理解、推理和创作。目前，StepAudio 3 系列五款模型均已上线阶跃星辰开放平台。"
        },
        {
            "index": 6,
            "time": "2026-09-15 11:23:41",
            "title": "千觉机器人触觉传感器通过六大极端工况测试，多项指标稳居行业前列",
            "url": "https://www.ifanr.com/digest/1680102",
            "desc": "千觉机器人旗下多模态视触觉传感器系列完成全面技术升级。本次升级围绕环境适应性、感知可靠性、长期耐用性三大核心维度展开，并顺利通过六大极端工况测试验证。结果显示，千觉视触觉传感器已成为业内规格最高、最符合工业级量产要求的产品，实现一致性97%的重大突破，千觉成为视触觉领域首个达到这一水平的团队。本次极端工况测试包含防水、微小物体夹取、跨个体一致性、抗磁干扰、柔性层寿命、重复稳定性六大维度。测试结果显示，千觉多项指标达到行业领先水平，部分指标为行业唯一：传感器达到行业内最高标准IP68防水等级；实现行业内最久10天240小时水下连续作业；跨个体一致性达到97%，为行业唯一达到该水平的产品；柔性层接触寿命达500万次，同样处于行业最高水准。依托性能优势，千觉视触觉传感器可为工业制造、物流仓储、食品与农业、具身智能与科研等领域提供触觉感知能力支撑，应用于精密装配与对位、生鲜食品轻柔夹取、异形物体稳定抓取、人形机器人灵巧手感知、触觉世界模型训练等多种落地场景，为机器人在复杂工况下依旧稳定、精准、持久的触觉交互筑牢感知底座。针对产线、物流等工业场景中机器人高频、重复作业带来的传感器磨损与性能衰减问题，千觉通过柔性层材料与工艺优化，提升传感器在长期高强度接触下的耐用性与感知稳定性，保障机器人持续可靠运行。在重复稳定性方面，测试显示，千觉单颗触觉传感器连续触发 500 万次后，力/力矩曲线从第 1 次到第 500 万次保持高度一致，无明显性能衰减或漂移，受力反馈精准稳定，满足工业高频、高强度作业的长期使用需求。在耐磨耐用性方面，千觉通过优化柔性层材料与工艺，针对性解决了传统视触觉传感器硅胶涂层易磨损的痛点。柔性层寿命测试显示，在砂纸表面经历多次反复摩擦，柔性层未出现破损，大幅提升了传感器在高频接触与摩擦场景下的使用寿命。同一传感器在长期使用后，感知输出很容易发生偏移。能否维持高水准的“一致性”，直接决定触觉感知是否稳定可用，也影响触觉数据质量，进而影响机器人模型训练与智能学习水平。千觉视触觉传感器同时实现“空间”、“时间”双维度工业级一致性。空间层面，经多台设备并行对照测试，不同单体传感器输出的六维力 / 力矩曲线高度重合，跨个体一致性达到 97%，为业内唯一实现该指标的产品。时间层面，传感器支持 500 万次连续触发且性能无衰减，保障在长期高频作业下，触觉数据可被精准解读、稳定复现。基于跨个体与重复使用的双重一致性，千觉视触觉传感器在降低客户集成与校准成本的同时，满足产线、物流等高强度、高频作业需求，为机器人全生命周期稳定触觉感知提供保障。面临水下作业、强磁干扰、微小物体精细操作等严苛工况，千觉视触觉传感器依旧能稳定发挥感知性能，支撑高难度机器人交互任务。防水测试展现，千觉传感器拥有顶级 IP68 防水能力，可实现 240 小时连续水下浸泡稳定作业，适配各类潮湿、涉水工业工况。强磁抗干扰测试显示，千觉传感器具备优异的强磁抗干扰性能，可在电机、电磁铁等强磁设备周边持续稳定工作。强磁场极易干扰依赖电容、磁变信号采集的传统触觉方案，而千觉视触觉传感器可完全规避此类干扰，环境适配性更强。此外，微小物体夹取测试显示，千觉传感器依托微米级高精度感知能力，可稳定完成螺丝、螺母、垫片等微小零件的精细抓取与操作。不仅实现精细化作业落地，还能完整捕捉细微交互触觉数据，提高高质量数据生产力，为具身智能算法迭代、触觉模型训练提供核心数据支撑。从极端工况验证到多元化场景落地，千觉机器人触觉传感器已具备工业级可靠性与规模化量产能力。未来，千觉机器人将持续推进触觉感知技术的迭代与突破，以更精准、稳定的触觉能力拓展机器人感知边界，推动触觉技术在更广泛场景加速落地。"
        },
        {
            "index": 7,
            "time": "2026-09-14 17:52:39",
            "title": "中科融合亮相CIOE 2026：以MEMS智能光学连接空间显示与具身智能",
            "url": "https://www.ifanr.com/digest/1680018",
            "desc": "2026年9月9日至11日，第27届中国国际光电博览会（CIOE 2026）在深圳国际会展中心（宝安）举行。中科融合携Iris Green、Iris Color、Iris AR及NANO微小型多模态高速扫描模组亮相2号馆2A157展位，展示自主MEMS智能光学平台在骑行HUD、车载投影、AR近眼显示及机器人3D感知领域的应用成果——以米粒大小的MEMS微振镜为核心器件，将显示与感知能力延伸至骑行、车载、AR与机器人等多元终端。本次参展，中科融合围绕MEMS芯片、光学设计、算法控制与模组集成，呈现从核心器件到应用模组的技术链条。基于同一芯片技术，形成“光显示”与“光感知”两大产品线：四款代表性展品分别面向信息显示与空间感知需求，展现同一MEMS技术平台在不同终端中的延展能力，为汽车、AR、机器人及智能硬件领域的产品开发，提供从核心器件到可量产方案的完整光学解决方案。从车载投影到AR眼镜，拓展MEMS-LBS空间显示应用随着显示功能向汽车、移动设备和可穿戴终端延伸，光机的体积、功耗与集成方式，正在成为产品设计中的关键约束。传统投射方案受制于体积、功耗与户外显示能力，难以满足移动与便携场景的需求。中科融合以自主MEMS微振镜为核心，发展MEMS-LBS（激光束扫描）显示技术，通过控制激光束高速扫描形成图像，将小型化、免调焦与低功耗整合为系统级能力：无需透镜、无需对焦，在任何距离与角度下均可保持画面清晰，为数字信息融入汽车座舱、骑行视野与日常佩戴场景提供显示基础。Iris Green作为面向骑行场景的抬头显示，将导航方向、骑行数据及提醒信息直接投射至骑行者前方路面，采用免调焦显示方式，使骑行者在行进过程中无需转移视线即可获取信息；同时支持车队标识、个性图案等内容的路面投射，为团队骑行提供可视化互动方式。Iris Color面向车载全彩投影应用，凭借贴地安装即可覆盖整车侧身幅面的超宽视场角，实现迎宾光毯、动态地面投影及座舱氛围显示等应用场景，以紧凑型光机与灵活投射能力，适配整车有限安装空间及多样化显示需求。面向AR近眼显示，中科融合持续推进光机微型化：光模组体积约0.9cc，典型入眼亮度达到10000 nits，在正午强光环境下画面依然清晰锐利；在平均画面亮度（APL）为20%的条件下，典型功耗约0.15 W，可显著降低显示系统功耗、缓解整机续航压力。Iris AR以体积、亮度与功耗的综合优势，为轻量化信息显示终端提供可直接集成的微型光机方案，支持导航、提词、消息提示等应用方向的快速开发。从车载投影到骑行HUD，再到AR近眼显示，中科融合持续复用并迭代MEMS扫描、激光控制、算法补偿及光机集成能力，形成覆盖多个终端的统一技术架构。相关MEMS微振镜模组已通过AEC-Q100相关可靠性测试，车规级认证为车载应用的工程化导入提供了器件层面的必要保障。NANO聚焦机器人末端，支撑近距离精细作业在光感知方向，中科融合聚焦具身智能的末端感知需求——头部视觉存在盲区，指尖触觉反馈滞后，在执行操作前对物体细节的实时感知尤为关键。NANO微小型多模态高速扫描模组面向机器人手腕及末端执行器的有限安装空间，以约一部手机重量的轻量形态，将近距离三维视觉部署于更靠近操作对象的位置，为抓取、插接、装配及位姿纠偏等精细任务提供亚毫米级空间数据。NANO基于自主MEMS面阵结构光技术，工作距离覆盖100—400 mm，支持15 fps、每帧30万点或10 fps、每帧130万点的点云输出，并可同步输出三维点云与彩色图像。在机械臂与工件同步运动的动态工况下，系统仍能保持稳定精度：三维点云与2D图像信息相结合，使目标识别、定位与动态作业引导不再依赖静态成像，实现动态环境下的持续感知。针对更复杂的工业作业需求，NANO PRO采用面结构光与线移扫描相结合的双模态方案，可应对高反金属、黑色吸光材料、透明件等常规三维成像难以处理的材质，覆盖焊接引导等高难度作业场景。NANO与NANO PRO分别侧重高帧率动态感知与复杂工况适应，形成面向差异化作业需求的产品组合。在系统集成方面，NANO支持USB 3.1 Gen 1、GMSL2/3及Type-C一线通供电，整机功耗低于5 W。小型化结构、低功耗设计与标准化接口相结合，可有效降低末端视觉的集成与部署难度，推动3D感知从独立设备向整机功能模块演进。以自主MEMS平台推进器件与应用协同光显示与光感知面向两类不同的信息需求：空间显示关注如何将信息自然地呈现于人，机器人视觉关注如何使机器准确获取空间数据。两类应用对输出形式与系统设计的要求各有侧重，同时共享精密光束控制、算法与模组集成等底层能力。中科融合以自主MEMS微振镜为技术底座，协同设计芯片、光学、算法与模组，推动光显示与光感知在统一技术平台上持续演进、相互增益。9月9日下午，中科融合感知智能研究院副总经理程诚博士亮相全球空间计算产业发展论坛，发表《MEMS智能光学技术创新与微型投影应用探索——中科融合的产品布局与产业化实践》主题演讲，分享从核心器件到终端应用的产业化实践，并与产业伙伴深入交流微型光学系统在车载、AR及新型智能终端中的应用方向。此次亮相CIOE 2026，中科融合呈现的不是四件展品，而是一颗自主MEMS微振镜贯穿光显示与光感知两条产品线的平台化能力——从核心器件到终端应用，已在国内率先跑通完整产业化闭环。当海外厂商仍以多套方案分立布局、将不同应用锁定于不同器件时，中科融合将空间显示与三维感知拉回至同一颗芯片、同一套系统架构之内。芯片不自主，光学就永远受制于人——这是中国空间计算与具身智能产业必须跨越的关键门槛。中科融合接下来的目标很明确：沿自主MEMS技术路线持续打通、打深、做透，让每一束从中国自主MEMS微振镜出发的光，都成为国产智能终端在空间计算时代对标全球方案的底气所在。"
        },
        {
            "index": 8,
            "time": "2026-09-14 11:28:03",
            "title": "蚂蚁阿宝三大车载AI能力亮相2026外滩大会",
            "url": "https://www.ifanr.com/digest/1679978",
            "desc": "9月9日至12日，2026 Inclusion·外滩大会在上海举办。大会集中展示AI智能体从技术创新走向规模化民生商用的最新成果，在智能座舱板块，支付宝重磅发布三大全新产品能力，让车内AI服务从“基础交互”迈入“全场景可交易、全链路能办事”的新阶段。此前，支付宝发布AHA多智能体跨端互联协议体系，打通跨设备、跨品牌的智能服务壁垒，推动“蚂蚁阿宝”车载服务规模化落地。对超级服务智能体 &#8220;阿宝&#8221; 而言，手机是其原生核心服务屏，而智能座舱正成为除手机之外第二个重要的服务终端。依托蚂蚁阿宝生态中万余项AI化适配的生活服务资源，服务能力实现从手机屏向车机屏的多端复用。商家完成一次服务适配，即可通过阿宝分发至手机、车机、AI眼镜等多个终端，把完整的生活办事能力延伸至出行场景。目前相关服务已覆盖17家主流车企、超1600万辆智能汽车，新增60余家定点合作车企，覆盖场景包括缴停车费、买电影票、点咖啡等高频用车需求，坐进车内，通过车载语音助手说一句 &#8220;帮我缴停车费&#8221;&#8221;帮我买张电影票&#8221;，蚂蚁阿宝即可调起服务完成履约，构建起成熟的车载AI服务生态底座。立足扎实的生态基础，本届外滩大会蚂蚁阿宝座舱业务聚焦车主高频刚需，全新上线高速手机+、车载电影票智能下单、座舱一键加油三大能力，实现车载服务场景的精准扩容与体验升级。针对多终端协同使用痛点，支付宝实现手机与座舱的无缝跨端联动服务。依托AHA协议的安全互联能力，用户出行途中未完成的服务任务，下车后可在手机端继续办结，真正实现跨终端服务无断点、体验一体化。全新上线的座舱电影票服务补齐了车载影音休闲交易短板。车主无需手动操作手机、跳转小程序，仅通过语音唤醒蚂蚁阿宝智能体，即可一键完成影片筛选、影院定位、场次选择、在线支付全流程操作，让车内休闲服务实现“开口即办、即时成交”。针对车主高频用车刚需，支付宝落地座舱一键加油能力，用户在车内即可通过语音指令唤醒服务，自动匹配就近油站、完成核销与支付，全程无需下车、无需手动操作，大幅提升自驾出行效率，打造轻量化、无接触的智慧加油新体验。在高速场景，结合高速手机+无卡畅行模式的落地推广，支付宝打造高速通行座舱新体验，用户不仅可实现座舱一键开通绑定，还可实现高速出口不用开车窗、不用取还卡、不用掏手机，座舱语音操作直接支付高速费，秒抬杆、快通行。本次外滩大会的能力升级，进一步完善了支付宝车载智能服务体系。未来，支付宝将持续开放AHA跨端协议与智能体技术能力，深化与各大车企的生态合作，迭代车载专属服务场景，落地轻量化、可商用、高安全的座舱AI解决方案，推动汽车智能服务从功能智能化，迈向交易智能化、服务生态化的全新阶段。"
        },
        {
            "index": 9,
            "time": "2026-09-13 16:02:45",
            "title": "华硕灵耀携手Intel首登北京时装周，以高定秀场叙事重塑时尚精品美学",
            "url": "https://www.ifanr.com/digest/1679924",
            "desc": "SS2027北京时装周启幕，华硕灵耀作为首个登上北京时装周T台的笔记本电脑品牌，以AI PC承载时尚态度，让内敛、精致、恒久的灵耀美学，成为都市精英人群的质感生活符号。9月12日，华硕灵耀x Intel携手北京时装周特约设计师WOAVE品牌创始人 王冬 联合发布「光耀新生 A Light Within」专场定制秀，多套限定时尚造型将灵耀系列AI PC融入秀场叙事，开创科技与时尚共生的全新美学范式。当科技材质的触感与天然面料的肌理彼此映照，在北京时装周秀场之上，华硕灵耀大“秀”时尚精品美学，灵感、科技与时尚活力融合绽放。模特接连登场、踏光而至，步履穿行于光影之间，手持华硕灵耀系列笔记本，生动诠释「光耀新生 A Light Within」的秀场主题。现场，华硕上海设计中心设计总监 黄圣杰 与设计师 王冬 展开深度对谈，为到场嘉宾、媒体解析「光耀新生 A Light Within」跨界合作的内核共鸣。本次定制秀场的联合呈现，并非一次简单的跨界联动，而是两者设计理念、审美追求、价值表达的高度契合与双向成就。“WOAVE”坚持工匠精神与当代设计并行，通过编织、拼接、解构及非遗手工技艺，赋予厚重、成熟和季节化的传统材质拥有轻盈、流动、立体且富有建筑感的廓形表达。华硕灵耀以科技器物承载时尚态度，依托材质创新、性能突破、前沿AI应用，演绎着功能与美学的完美平衡。实现高级极简审美传递，凭借内敛、精致、恒久的灵耀美学，成为新时代精英人群的质感生活符号。对谈中，王冬提及,“基于与华硕灵耀的设计理念共鸣，我们共同探索了关于高端材料、精密制造与创造力的全新边界，完成了一场精彩的时尚秀场。”WOAVE时装与华硕灵耀高科技陶瓷铝机身所体现的轻薄、温润、耐磨与精密制造形成巧妙呼应，时装的松弛高级氛围与灵耀内敛轻奢的美学底蕴高度统一。科技与时尚不再是跨界碰撞，而是同频美学的双向共生表达。而本次专场定制秀的主题立意，则根植于华硕灵耀全新迭代的新时代品牌内核。黄圣杰强调，“「光耀新生 A Light Within」是华硕灵耀的新时代品牌内核，光，既象征华硕灵耀与Intel带来的科技能量，也代表创作者内心持续生长的灵感；新生，则意味着材料与传统工艺在当代语境中的重新觉醒”。华硕灵耀秉承“以人为本”的初心，以材质创新、性能突破、AI进化迭代产品，鼓舞精英阶层拥有高效生产力装备，在喧嚣世界守住内心秩序，于平衡专注中积蓄力量、突破自我。从轻薄设计到高端材质，从创新科技到创作体验，华硕灵耀以精密工艺重塑美学温度，以AI科技赋能当代生活，这场与WOAVE的美学共创，全维揭开灵耀的时尚精品美学内涵，让到场观众亲眼见证科技硬件的时尚艺术张力，切身感受工艺、美学与性能的共生之美。不止于秀场的视觉美学演绎，秀场外华硕灵耀携手Intel特设品牌独立时尚精品美学展区，线下展陈全新华硕灵耀14 2026 AI超轻薄本、灵耀精品美学周边，让参展观众实现从“看见灵耀美学”到“体验灵耀实力”的完整感知。华硕灵耀14 2026整机轻约1.2kg、薄至13.9mm，机身A面采用华硕创新高科技陶瓷铝材质，兼具轻薄随行的便携体验、细腻温润的独特触感与坚固耐磨的精密品质，搭配北极蓝、珊瑚粉、茶釉棕三款自然灵感配色，将山川风物的自然意境凝于机身方寸之间，极简线条克制高级，尽显恒久耐看的轻奢质感。机身内置70Wh长寿大电池，可实现长达29.6小时的持久续航，满足适配移动办公、差旅出行、户外创作等多元场景。搭载14英寸2.8K 120Hz OLED华硕好屏，专业级色彩表现全面赋能视觉创作、审美品鉴。它搭载第三代英特尔® 酷睿™ Ultra 7处理器，带来至高49 TOPS NPU AI算力，实现本地化、高效率的AI创作赋能。搭配“小硕知道”AI智能助手、StoryCube一站式工作智能媒体中心等本地AI应用，一键解锁文案梳理、图像创作、素材整理等智能操作，大幅降低创作门槛、提升办公效率。新增专属联名AI工具“小硕 x WorkBuddy”，华硕账号一键互通，华硕渠道注册的WorkBuddy新用户可领取200专属积分。从T台秀场的美学共生，到线下展区的性能体验，华硕灵耀以首登北京时装周的跨圈共创，深度链接科技、时尚与艺术，完成AI PC时尚美学的一大探索。华硕灵耀x Intel品牌独立时尚精品美学展区（北京东城区王府井大街北街）将持续开放至9月17日，欢迎广大时尚爱好者、创作者与科技用户亲临现场，亲身解锁灵耀美学与实力兼具的时尚精品内核。"
        },
        {
            "index": 10,
            "time": "2026-09-11 19:25:47",
            "title": "像素蛋糕PC端10.0、iPad版和手机版亮相、像素芝士、像素吐司同步推出",
            "url": "https://www.ifanr.com/digest/1679793",
            "desc": "2026年9月10日，像素系列秋季发布会在厦门康莱德酒店如期而至。五年前，像素蛋糕发布滑杆式可视化修图，诞生于一个追问：“能不能让专业的后期创作，更简单一点？”；五年后，从“操作标准”到“批量时代”，从“效果可视化”到“全链提效”，再从“智能体”到“AI点修”，答案正变得愈发清晰。伴随像素蛋糕PC端10.0、像素蛋糕iPad版、像素蛋糕手机版、像素芝士、像素吐司产品集中亮相，像素系列以“新起点”重构，完成从“单点提效”到“流程焕新”的系统性衍进，以产品生态矩阵重新定义影像创作全链路。从桌面端到移动端，从静态图像到动态影像，从个人创作者到团体机构——像素系列正以产品分层布局的方式，完成对影像创作生态的全方位渗透。像素蛋糕作为行业领先支持端侧计算的可视化编辑工具，本次更新至10.0版本，以“与‘十’俱进的创作新起点”完成人像、色彩、创意三大方向的体系化升级。像素蛋糕iPad版为行业移动端修图工作站，焕新后定位“旅拍神器”与“一平米创作台”，一次拍摄即是一次专业服务，打通“拍—修—看—取”的完整闭环。像素芝士定位景区出片中台，依托景区共研大模型提供面向景区、整场活动的全链路影像生态服务，并以“像素芝士×百城点位”计划助力100个点位焕新，推动建设数字景区旅拍服务。像素蛋糕手机版聚焦移动端专业影像创作，以“零帧起手，定格生活中的创作多面手”回应更广泛的摄影兴趣人群。像素吐司作为视频精修产品线，以达芬奇/PR内嵌模式、剪辑精修丝滑接力的方式，把一次拍摄变成更多内容产品，赋能创作者实现动态影像的产品创收。像素系列核心产品线既保持独立定位，又形成协同效应。品牌正以生态化布局，构筑起覆盖从拍摄到交付、从静态到动态的全链路影像基础设施。如果说像素系列产品线的布局是横向的生态扩张，那么像素蛋糕10.0的此次升级则是纵向的技术穿透。本次10.0版本正式推出五大维度的技术迭代，覆盖人像精修、创意生成、色彩科学、宠物精修和AI点修五个领域。针对应季旅拍场景，推出多项人像精修功能，祛汗珠、衣服祛汗渍、AI祛体毛、闭眼修复、AI加腹肌、AI瘦手臂、面部提拉……几乎囊括人像修图的核心刚需。针对婚纱摄影高频痛点，发布裙摆平整、裙子蓬松、鞋子祛污、AI换天空等功能的一键调用。同时，在色彩科学层面完成体系化升级，搭载16bit•AI Raw引擎，升级AI局部追色与质感色彩配置文件，调色性能优化40%+。行业首创AI点修重磅发布，标志着修图进入点修时代，既能一点自动关联功能，也能自动调用像素助手执行复杂任务；像素助手即日起全面公测，创成式填充支持一句话秒改画面，重新定义了AI时代的图像创作方式。同时，首次将宠物修图纳入专业流程。宠物亮眼、宠物眼神光、宠物祛碎毛三项功能，配合“宠物一生”全周期6大必拍套系将宠物棚拍、爱宠上门、宠物街拍三大应用场景全部打通。知名摄影嘉宾现场以“第二增长曲线”为题分享——“换一条赛道，不换掉你的本事”，为从业者带来诸多启发与灵感。布局已成，纵深已就，所有能力的最终指向，是场景——是那些真实发生的拍摄现场、是每一位创作者的日常。像素蛋糕10.0面向婚纱摄影、主题写真、全家福、儿童摄影、证件照等棚内场景，也覆盖旅拍、目的地婚礼、活动拍摄、婚礼跟拍、街拍等户外现场。像素芝士延伸至企业活动、婚礼婚庆、文旅景区、体育赛事、演出活动等现场影像服务场景——在台州神仙居，像素芝士深度绑定爆款打卡位，让游客拍摄率和客单实现大幅提升，让每一处创作现场，成为新业务的起点。像素蛋糕手机版以不同场景下的专业色彩表现，回应更广泛人群的兴趣拍摄。“随时精致的活人感”面向出游与扫街，“破框而出的CG感”聚焦二次元展会，“零帧起手的现场感”切入音乐现场。追星族、Coser、旅行家、运动选手、扫街达人、户外咖等，正在被逐一触达。从专业现场到街头日常，从商业摄影到兴趣表达——“你在哪里，哪里就是创作的起点。”这句话，正是像素系列场景版图的最佳注脚。像素系列五年衍进，以“从单点提效到流程焕新”为内核，共同构成影像创作AI时代的全新底座。"
        },
        {
            "index": 11,
            "time": "2026-09-11 18:21:30",
            "title": "WPS AI获得国际表格AI评测全球第一",
            "url": "https://www.ifanr.com/digest/1679790",
            "desc": "近日，国际表格AI评测SpreadsheetBench更新V2 Full榜单，WPS AI以50.86%的综合成绩排名第一，并通过官方Verified验证，综合成绩高于Claude Opus 4.6、GPT-5.2、Gemini 3.1 Pro等国际主流AI模型。V2共包含321项任务，平均每项任务涉及11.8个工作表、593.5个单元格修改，考察AI对复杂表格的整体处理能力。同一时期，金山办公在学术侧也有新进展。8月30日至9月4日，2026年国际文档分析与识别会议（ICDAR 2026）在奥地利维也纳举行，同期举办的DAS 2026上，金山办公一项面向复杂办公图像处理的研究成果获正式收录并现场展示，聚焦AI生成文档图像、手机截图等素材的文字识别和文档还原。一个验证了AI执行复杂办公任务的能力，一个夯实了底层文档处理技术——两项进展分别来自第三方评测和国际学术评审，共同指向金山办公在办公领域的长期积累。"
        },
        {
            "index": 12,
            "time": "2026-09-11 14:44:34",
            "title": "迈向原生世界状态的统一多模态世界模型，大晓机器人联合南洋理工大学S-Lab发布Puffin-World",
            "url": "https://www.ifanr.com/digest/1679731",
            "desc": "近日，大晓机器人联合南洋理工大学S-Lab等机构发布并开源统一多模态世界模型框架Puffin-World。作为面向空间智能与具身智能的成果，Puffin-World首次在一个统一多模态框架中，将物理、几何和外观定义为三种原生的三维世界状态，并贯通重力场感知、自由视点空间仿真、三维世界生成与重建以及闭环探索，预测机器人行动后世界将处于什么状态。Puffin-World同步开源代码、模型和Puffin-16M数据集，包括1500万组视觉—语言—相机三元组和100万条具有挑战性的旋转轨迹，并开放覆盖28个公开数据集、约4450万张图像的绝对相机位姿标注，为机器人仿真、合成数据生产与具身智能训练提供可复现、可扩展的技术底座。针对机器人训练来说，需要的并不是一段视觉上逼真的视频，而是能够支撑感知、定位、规划和行动的环境信息：当前相机处于什么姿态，重力方向是否稳定，场景结构如何延续，机器人移动后将看到什么。图像只是世界状态的一部分，物理方向、空间几何和视觉外观共同构成机器人真正需要的训练环境。统一构建三种原生状态——物理、几何与外观Puffin-World从三维世界状态本身出发，将其建模为三种相互关联的原生状态：三种状态共同构成从“世界如何存在”到“世界如何被交互”的完整表达。模型生成新视角时，不仅要回答画面应该是什么样，还要保证该画面在物理方向和三维结构上成立。为统一绝对方向和跨视角运动，Puffin-World提出Omni-Camera相机表示，将重力锚定的绝对相机信息与基于射线的相对几何结合起来。模型先从参考图像中精确理解相机的横滚角、俯仰角和视场角，再通过物理传播机制，将参考视角中的重力信息传递至后续视角。即使相机经历连续旋转和长轨迹移动，整个生成过程也拥有一个稳定的物理参照系。地平线不会随意漂移，场景的上下关系不会在运动中失真，生成视角与目标相机轨迹也能保持一致。Puffin-World还在同一次生成过程中联合输出RGB外观和深度几何，使生成结果能够直接用于三维重建，而不必在视频生成之后再依赖独立的深度估计模块补充空间结构。由此，世界生成与世界重建不再是前后割裂的两个步骤，而成为同一个状态预测过程。一个模型完成四件事，从理解世界走向闭环探索Puffin-World可以在一个模型中统一四类过去往往需要不同系统分别完成的任务。第一，单图理解相机物理信息。输入一张图片，模型能够结合地平线、垂直结构和场景构图进行空间推理，预测相机相对于真实物理世界的横滚角、俯仰角和垂直视场角，同时生成场景语义描述。模型不仅识别“图中有什么”，还理解“当前视角以怎样的姿态看到了它”。第二，自由视点空间仿真。除文字描述外，用户还可以明确指定相机方向和视场角。模型据此生成符合目标机位的画面，使文生图从内容控制进一步走向精确的空间控制。第三，三维世界生成与重建。模型可以从文字、单张图像或少量参考图像出发，按照指定相机轨迹生成多个新视角，并同步预测每个视角的外观和深度。不同视角随后可以汇聚为具有一致空间结构的三维世界。第四，闭环自校准探索。当相机姿态偏离重力方向时，模型可以先感知当前物理状态，再推理需要执行的修正动作，并生成动作执行后的目标观察，由此形成“状态感知—动作预测—结果生成—再次校准”的闭环，高效扮演World Action Model (WAM）角色。技术报告还展示了模仿式世界探索能力，即从同一初始视角出发，按照给定相机轨迹扩展并探索新的三维世界。这四类能力并非四个模型的简单拼接，而是由同一套视觉、语言、相机和世界状态表征共同支撑。任务的变化不再依赖切换系统，而由输入内容、相机条件和视图角色决定。这种统一性，使Puffin-World更接近机器人从感知、推理到行动的完整工作链路。1600万核心数据与4450万开放标注，扩大世界模型训练底座世界模型能否理解复杂空间，很大程度上取决于训练数据是否同时具备视觉内容、场景语义、绝对相机信息和多样化运动。为此，团队构建了Puffin-16M数据集，包含两个组成部分。Puffin-Cam-15M提供1500万组视觉—语言—相机三元组，覆盖室内、室外、真实和合成等多种场景，并包含不同分辨率、宽高比、相机姿态和视场角。它不仅告诉模型图像中有什么，还告诉模型这张图像是在怎样的相机观测条件下形成的。Puffin-Traj-1M则提供100万条具有挑战性的旋转轨迹，覆盖连续俯仰、横滚、偏航、复合运动以及360度环视等复杂情况，重点补足传统三维数据集在大幅旋转和长轨迹探索方面的不足。与主要描述视角之间相对变化的数据不同，Puffin-16M进一步引入相机相对于重力和真实世界的绝对方向。模型不仅学习“相机从上一帧移动了多少”，还要理解“相机当前在世界中处于什么方向”。除自建数据集外，团队还利用Puffin-World精准的物理世界感知能力为28个公开数据集补充绝对相机位姿标注，覆盖约4450万张图片，包括ImageNet、CC12M、Objects365、ScanNet、DL3DV和GPIC等。标注内容包括横滚角、俯仰角和视场角，可用于研究不同视觉数据中的机位偏差，也可为相机条件生成、物理世界理解和空间智能训练提供大规模监督。更重要的是，Puffin-World同步开放代码、模型和数据集。开源的不只是一个算法实现，而是一套从数据、标注、训练到评测的完整技术链路，使研究机构和产业开发者可以围绕机器人仿真、合成数据、虚拟现实、三维内容生产与具身智能开展后续开发。四项SOTA，从相机理解到三维生成Puffin-World的统一能力在四项Benchmark中取得SOTA成绩。在相机到真实世界理解任务上，Puffin-World在Stanford2D3D、MegaDepth、TartanAir和LaMAR四个公开基准上取得最佳或并列最佳的中位误差，并在大多数AUC指标上领先。其中，在Stanford2D3D上，Puffin-World对横滚角、俯仰角和垂直视场角的中位误差分别为0.29度、0.53度和1.62度，显示出较强的绝对相机理解能力。在相机可控生成基准Puffin-Cam-Bench上，模型生成结果的上方向、纬度和重力方向中位误差分别为0.84度、1.26度和0.79度，FID为75.93，均优于参与比较的通用图像生成模型和已有相机可控生成方法。这意味着Puffin-World不仅能够生成质量较高的图像，还能让生成画面准确服从指定的相机状态。在Puffin-Traj-Bench上，Puffin-World取得18.00的PSNR、0.613的SSIM和0.288的LPIPS；生成轨迹的横滚角、俯仰角和视场角中位误差分别为0.80度、1.10度和2.96度。其中，PSNR、LPIPS以及三项相机控制误差均取得最优结果。在RealEstate10K三维世界生成测试中，Puffin-World取得17.22的PSNR、0.595的SSIM和0.318的LPIPS，三项视觉一致性指标均优于对比方法。这些结果表明，Puffin-World并非只在单一任务上提高图像质量，而是在相机物理理解、灵活空间控制、几何一致性生成和三维重建之间建立了相互支撑的统一能力。从“生成一段看起来合理的视频”，到“预测一个具有物理、几何和外观一致性的世界状态”，Puffin-World推动世界模型从视觉内容生成进一步走向可感知、可校准、可探索和可重建的三维环境。这也是世界模型真正进入机器人训练与具身智能应用所需要完成的一次范式转变。"
        },
        {
            "index": 13,
            "time": "2026-09-10 16:44:31",
            "title": "面壁智能 MiniCPM5-2B 模型登顶 Hugging Face Trending Top 1",
            "url": "https://www.ifanr.com/digest/1679609",
            "desc": "面壁智能 MiniCPM5-2B 模型登顶 Hugging Face Trending Top 1，AA 综合 23 分居全球 4B 以下开源模型第一。本 2B 参数量即可完成工具调用、深度搜索、代码生成等智能体任务，端侧通用 Agent 雏形初现。"
        },
        {
            "index": 14,
            "time": "2026-09-10 16:20:45",
            "title": "蚂蚁集团CEO韩歆毅：8小时之外的智能体爆发是必然趋势",
            "url": "https://www.ifanr.com/digest/1679607",
            "desc": "在2026 Inclusion外滩大会上，为加快智能服务生态发展，支付宝宣布设立“智能体涌现奖”，每年投入1000万，寻找有用、有趣的生活智能服务，年度大奖奖金100万元。9月10日起，在支付宝内右滑对阿宝说“智能体涌现奖”，即可了解赛事、报名参赛，普通用户也可参与“许愿”想要的智能服务。开发者作品入围后不仅可获得现金奖励，适合面向市场的成熟作品还可接入阿宝，为10亿用户提供服务，开展持续经营。蚂蚁集团CEO韩歆毅认为，8小时之外的智能体爆发是必然趋势。支付宝表示希望通过智能体涌现奖，促成以“智能服务供给”满足“碎片化生活需求”的供需循环，在小程序生态之外，构建面向AI时代的智能体生态。"
        },
        {
            "index": 15,
            "time": "2026-09-10 13:14:58",
            "title": "QQ音乐推出星悦会员，全新权益聚焦线下音乐娱乐生活全场景",
            "url": "https://www.ifanr.com/digest/1679582",
            "desc": "近日，QQ音乐宣布正式推出全新会员权益体系——星悦会员。该会员体系不同于已有的线上音乐会员，将会更多专注在线下音乐娱乐生活全场景，为用户提供更多专属、优质、优先的音娱生活权益，包括但不限于：演唱会专属区域、稀有演出专享购门票、线上演出专属弹幕、演唱会专属折扣、线下活动会员专场以及在QQ音乐上结合当期线下活动的bubble、装扮等尊享权益。此次星悦会员的推出，使得QQ音乐会员体系在此前进一步丰富线上音乐体验的同时，更完善了线下娱乐生活场景下的权益。既为用户带来全方位的视听感受，也进一步丰富了用户的音乐娱乐全场景和综合体验。近年来，腾讯音乐持续强化以IP为核心的多元内容生态建设，在深化战略合作的同时持续提升内容自制与艺人培养能力，让乐迷感受更丰富的音乐魅力。此外，还持续将优质IP价值从线上延伸至线下，举办音乐会、音乐节、粉丝见面会等大型现场活动。具体落到QQ音乐平台上，像QQ音乐超级巅峰之夜这样结合了线上音乐榜单与线下演出活动的大型演艺IP已连续多年举办，受到了广大乐迷的欢迎。包括还举办了像王安宇“宇你相见”粉丝见面会等结合音乐与流行的线下活动，也给乐迷带来更多与明星艺人近距离相聚的专享机会。未来，在星悦会员将线下演出、艺人周边、活动专场等场景纳入会员权益体系后，平台不仅能够为用户提供更多可玩性，更能将线上玩法实实在在地转化为线下驱动力，实现平台IP价值的最大化释放。在用户需求日益多元、线下演出市场持续火爆的背景下，这是QQ音乐在音乐娱乐服务场景上的进一步探索，这一模式也有望为业内打开新的增长空间。"
        },
        {
            "index": 16,
            "time": "2026-09-10 13:01:47",
            "title": "索尼正式发布首款全画幅鱼眼变焦G镜头FE 8-14mm F3.5 Fisheye G",
            "url": "https://www.ifanr.com/digest/1679568",
            "desc": "2026年9月8日，索尼（中国）有限公司正式发布首款全画幅鱼眼变焦G镜头FE 8-14mm F3.5 Fisheye G（SEL814G）。一支镜头可呈现两种不同类型的鱼眼视角：8mm 端圆形鱼眼视角，变焦至14mm则切换为对角线鱼眼视角；在约314克的紧凑镜身中实现索尼G镜头的高分辨率影像表现，具备双线性马达的快速精准自动对焦以及专业镜身操控设计，适用于风光、建筑、人像及水下摄影等多元题材。还可搭配索尼电影摄影机CineAltaV 2分体拓展系统组成双镜头配置，支持3D VR内容创作。FE 8-14mm F3.5 Fisheye G镜头将E卡口原厂镜头群的广角端拓展至8mm，填补了索尼全画幅鱼眼镜头的产品空白。从鱼眼超广角到超远摄长焦，索尼E卡口镜头焦段覆盖更加完整，为影像创作者提供更丰富多元的产品选择。FE 8-14mm F3.5 Fisheye G从圆形鱼眼到对角线鱼眼，一支镜头覆盖丰富视角相较其他鱼眼镜头，FE 8-14mm F3.5 Fisheye G可呈现两种鱼眼视角。搭配全画幅机身拍摄时，在8mm端，可以180°视角拍摄全画幅圆形鱼眼影像；在14mm端，可以覆盖全画幅180°对角线鱼眼影像。用户可结合拍摄主体与创作意图，灵活切换视角、调整构图，满足风光、建筑、人像、水下等多元题材的创作需求。支持两种鱼眼模式丰富的创作题材 – 风光丰富的创作题材 – 建筑丰富的创作题材 – 水下轻巧机身，兼顾便携性与空间内容创作FE 8-14mm F3.5 Fisheye G镜头直径约63.1毫米，长度约82.8毫米，重量仅约314克，无论手持拍摄还是搭配稳定器使用，均拥有出色的便携性。镜头采用内变焦结构，可最大程度减少变焦过程中重心的偏移。搭配两套索尼电影摄影机CineAltaV 2 分体系统2拍摄时，两枚镜头的光轴间距约为64毫米，接近人眼平均瞳距，可支持包括VR在内的空间内容创作，呈现自然的纵深感与距离感。出色的便携性G镜头品质，全焦段高解析力表现镜头搭载了4枚ED（低色散）镜片、1枚ED（低色散）非球面镜片及2枚非球面镜片，能有效抑制画面范围内的色差及多种像差，在整个变焦范围内保持优秀的高解析力表现。镜头最近对焦距离约0.15米，长焦端最大放大倍率约0.22倍，可呈现极具张力的鱼眼近摄视角。全焦段优秀的高解析力表现最近对焦距离约为0.15米自动对焦性能与操控设计，照片视频皆从容FE 8-14mm F3.5 Fisheye G搭载了两个线性马达，搭配Alpha 9 III等索尼微单™相机时，可实现最高120张/秒高速连拍，同时支持自动对焦与自动曝光跟踪，在人像、水下、视频等场景下可高效完成创意拍摄。操控性方面，针对鱼眼拍摄优化改进，配备对焦环、变焦环、光圈环三环独立操控结构，同时提供变焦及对焦锁定设置，防止误操作。镜头具备防尘防潮设计，前端镜片具备氟涂层，可从容应对户外拍摄环境。优异的自动对焦性能及操控设计价格与上市时间FE 8-14mm F3.5 Fisheye G（SEL814G）将于2026年9月中旬上市，建议零售价为9,999元。"
        },
        {
            "index": 17,
            "time": "2026-09-09 19:27:25",
            "title": "荣耀Magic9 系列定档9月28日：“苔青”配色亮相，携手ARRI打造“掌中电影机”",
            "url": "https://www.ifanr.com/digest/1679526",
            "desc": "9月9日，荣耀正式宣布，全新年度旗舰荣耀Magic9 系列将于9月28日正式发布。作为荣耀品牌焕新后的首款旗舰系列力作，荣耀Magic9 系列秉承“敢想敢不同”的品牌态度，承接荣耀Magic系列十年技术沉淀，致敬创造者，将在外观、影像、AI及操作系统等方面迎来全面焕新与进化。荣耀Magic9 Pro Max汲取早期电影工业的经典色调，带来极具辨识度的全新配色——“苔青”。在设计上，新机镜头模组深度汲取了传奇电影机 ARRIFLEX 系列的设计精髓，将经典的“三镜头转塔”系统融入背部架构，三颗正圆摄像头呈标志性的“1+2”三角排布，复刻纯正的电影机械秩序。整机采用 Unibody 全金属机身与无缝拼接工艺，金属触感与深邃的“苔青”色彩交融，散发出电影工业独有的扎实高级质感，整机握持手感与精致度迎来全面跃升。在硬核细节上，荣耀Magic9 Pro Max以精细打磨工艺打造出极窄平行双轨微缝天线，不仅在视觉上做到了工业级的纯粹规整，更在天线极致收窄的同时，依然保持了顶级的稳定信号表现，真正做到了从内到外、由表及里的纯正电影工业与高端旗舰质感。影像配置方面，荣耀Magic9 Pro Max带来“双两亿”影像方案，搭载2亿阿莱云台级主摄、1/1.28英寸超大底传感器，与2亿阿莱超夜神长焦、1/1.4英寸超大底传感器，在解析力与光学防抖上实现跨越式升级。同时，新机深度延续与百年电影巨头ARRI的联合研发，全链路贯穿光学、底层算法与经典色彩科学，引入专业影视工业标杆ARRI LogC3曲线，保留丰富的光影与色彩信息，让移动影像真正拥有电影级质感，无缝接入专业电影工作流。为了进一步拓宽移动影像的专业创作边界，荣耀Magic9 系列同步推出了两款全新“拇指增距镜”、“巨炮增距镜”—— 荣耀长焦增距镜G200与荣耀长焦增距镜G500。其中，荣耀长焦增距G200（200mm）主打极致小巧，为当前行业内200mm等效焦距体积最轻量便携的增距镜方案；荣耀长焦增距G500（500mm）则主攻极限远摄，是目前手机行业焦段最长的外接增距镜，让移动长焦探索更远距离。荣耀CEO李健表示：“荣耀Magic系列，为创造而生，致敬创造者”。荣耀Magic9 系列是一次涵盖设计美学、极致影像、底层系统的全维度重构与突破，也是荣耀“敢想，敢不同”给出的全新答案。新机不仅迎来了辨识度极高的设计焕新与领先的影像系统突破，更将首发搭载全新荣耀MagicOS 11，以 Agentic OS 打开主动智能与想象的边界，开启人机交互的新范式。与此同时，结合当前行业爆料信息，荣耀Magic9 系列还将带来跨越式电池续航表现，并有望首发安卓阵营首个方形前摄等极具前瞻性的创新设计。"
        },
        {
            "index": 18,
            "time": "2026-09-09 19:22:09",
            "title": "荣耀Robot Phone亮相威尼斯：开启影像创作的电影化未来",
            "url": "https://www.ifanr.com/digest/1679522",
            "desc": "荣耀作为威尼斯国际电影节“华语电影全球推广系列活动”官方影像战略伙伴，继戛纳国际电影节、上海国际电影节之后，第三次登上国际A类电影节舞台。电影节期间，荣耀全球首台掌上电影机Robot Phone再度亮相，荣耀Magic9全新配色苔青迎来全球首次曝光，获得影视与科技圈层的广泛讨论。面对复杂多变的拍摄环境，普通手机往往难以实现专业级的稳定运镜，而荣耀Robot Phone的硬件创新恰好能解决创作者的这一真实痛点。Robot Phone采用钛合金机械云台架构，可实现多轴运动，支持拍摄主体自动追踪，让手机首次拥有机器人级4DoF自由度。此外，面对旗舰手机寸土寸金的内部空间，荣耀的云台架构不仅将加工精度推进至±0.005mm，更让整体尺寸大幅缩减65%。对于威尼斯电影节这类大型活动现场，这套硬件方案意味着创作者不必携带笨重的专业设备，就能够从普通快照直接切换至电影级运镜效果，印证了移动终端也可以承载片场级别的动态影像创作需求。荣耀Robot Phone凭借在移动影像领域的实际表现，在威尼斯国际电影节现场得到了海外主流媒体的关注与认可。根据以摄影见长的《名利场》（Vanity Fair）报道指出，Robot Phone的产品实力不只体现在纸面参数，更落地于真实的拍摄场景。在电影节现场，Robot Phone既能跟随嘉宾踏上红毯，也能深入活动幕后，捕捉官方镜头常常忽略的人物神态与细节，还原威尼斯独有的氛围感。可见，Robot Phone的出现，让手机不再仅仅是记录画面的工具，更如同口袋中的摄像助理，可实实在在的拓宽影像创作边界。除了硬件及设计上的创新外，让智能手机掌握电影级的表达语言，也是Robot Phone的另一大核心看点。作为荣耀与全球电影工业标杆阿莱（ARRI）合作落地的首款产品，Robot Phone将阿莱的影像科学与专业工作流融入其中，搭载2亿像素主摄可录制阿莱LogC3格式，兼容阿莱广色域与阿莱风格色彩，调色工作流高度对齐专业电影工业标准。现场实测中，环境光线剧烈变化时，设备可以维持稳定可控的画面表现。威尼斯本身光线环境复杂，从潟湖强烈日光转入室内，从建筑阴影切换到水面反光，在这类复杂场景下，这套影像技术不再停留于概念宣传，真正成为创作者手中可用的工具。此外据了解，荣耀与阿莱联合打造的影像技术将全面应用于Magic9系列。中国科技凭借硬核创新收获海外业界点赞，而在本届电影节中，华语创作者也带着本土故事与创作思考站上世界光影舞台，蓝鸿春导演的《给阿嬷的情书》便是其中代表。该影片在拍摄过程中大量启用非职业演员，蓝鸿春在开拍前会花费大量时间与演员相处磨合，建立深厚情感羁绊，消解表演紧张感，让演员自然流露真实情绪。在面对海外媒体专访时，蓝鸿春也分享了影片的创作理念与幕后故事。他表示，尽管是首次到访意大利，内心却倍感亲切。意大利电影深刻影响着自己的创作，《偷自行车的人》所代表的新现实主义创作理念，也投射到这部作品当中，坚持将镜头对准普通人的生活。这部扎根潮汕土地的故事，让潮汕乡土故事与遥远的威尼斯产生奇妙联结。故事地域背景虽遥远，但传递的情感具备共通性，能够引发全球观众的共情。一边是中国科技以技术突破重构移动影像的创作边界，一边是华语电影以本土叙事传递普世的人文温度。在第83届威尼斯国际电影节的舞台上，硬核科技力量与动人的东方故事交相辉映，中国科技与华语电影双双闪耀水城威尼斯。科技工具赋能艺术表达，人文故事赋予技术温度，二者并肩出海，也让世界看见来自中国的影像力量，为全球影视行业带来全新的想象空间。"
        },
        {
            "index": 19,
            "time": "2026-09-09 09:05:38",
            "title": "MiniMax H3会员限时免费无限用！SkyProduction限免活动第二弹来了",
            "url": "https://www.ifanr.com/digest/1679386",
            "desc": "8月28日-9月1日，SkyProduction（天工工作台）联合阿里巴巴通义万相，推出了Wan 3.0模型限时免费活动，时长反响热烈。无论是Wan 3.0的30s视频指出、多模态参考、精准修改能力，还是SkyProduction（天工工作台）的资产管理、无限画布、团队协作，都广受用户好评。而今天，SkyProduction的限免活动迎来了第二弹：Minimax H3模型，也要在SkyProduction产品上限时免费、无限使用了！相比libTV、oiioii等类似产品，您将在SkyProduction（天工工作台）上，获得最实惠的Minimax H3模型的使用权限！活动时间：9月9日-9月14日活动产品：SkyProduction中国大陆版，网址：https://skyproduction.cn对于短剧、漫剧、短片和广告创作者来说，同一个动作往往要试几种表演，同一场戏也需要比较不同的画面方案。最宠创作者的SkyProduction，希望通过本次活动减轻大家反复生成的积分成本，让创作者有更多空间试镜头、挑结果、打磨作品！一、首日会员免费用，新开会员、充值积分再享加赠本次限免活动，分“9月9日当日”和“9月10-14日”两个阶段。9月9日当日，无论此前已购买会员，还是当天首次开通会员，均可享受H3限免！ 在限免权益内，使用指定H3模型生成视频不消耗积分，创作者可以把待测试的提示词和参考素材拿出来，多试几版。9月10日至14日，活动转入消费加赠阶段，具体分为两种方式：首先，对于“首次开通会员”的用户，按购买的会员类型获赠限免天数。 赠送天数由会员档位、个人或团队类型，以及月付、季付、年付周期共同决定。具体详见下表：参考会员价格：此项权益仅适用于“首次”开通会员的用户，升级会员不加赠，也不补赠档位之间的天数差。例如，首次购买旗舰版个人会员（月付）获赠3天，随后升级为至尊版个人会员（季付），通过购买会员获得的加赠总计仍为3天。第二，“已经是会员的用户”购买积分，也可按充值档位获赠限免！ 购买积分额度和获得限免天数的关系如下：每位用户在本次活动中，每个充值档位仅可获得一次加赠，不同档位可叠加。例如，用户先充值¥800，获赠1天；再次充值¥800，不再加赠；但用户之后再充值¥2,000，可再获赠3天，累计获赠4天。9月14日是购买获赠的截止日，已获得的权益可以继续使用。 9月15日起，新购买会员或积分不再加赠，但此前获得的限免天数不会因活动结束而清零。例如，某用户在9月14日首次开通至尊版团队会员（年付），获赠7天限免，则限免可以使用到9月21日。本次限免仅限MiniMax H3 768P模型。权益期间须保持有效会员身份，工作室的权益由团队所有成员共享。二、MiniMax H3：把创作要求带进画面与声音之所以选择对Minimax H3模型限免，是因为这款模型确实有其独特优势：它是一款通用多模态生成模型，能够理解不同素材之间的关联，执行创作指令，并联合生成视频与原生立体声。对影视创作者而言，这些能力对应着几项具体需求：首先，把动作、场景和镜头要求一起交给模型。 创作者可以在提示词中描述人物如何行动、场景呈现什么氛围，以及镜头怎样观察人物，让一次生成承载更完整的拍摄意图。例如，同样是人物走进房间，可以分别尝试紧张、迟疑或轻松的表演方向，再挑选符合剧情的结果。第二，Minimax H3模型可以让多模态参考素材参与创作。 文字之外，还可以上传参考图片、参考视频和参考音频。创作者可以围绕同一组素材调整动作与镜头描述，比较不同表达方式，为后续制作积累候选方案。第三，用音画配合丰富叙事。 H3原生音画生成的能力，使对白、环境声、音效与画面可以共同参与内容表达。一段短视频里的脚步声、环境变化和人物反应，都能成为传递情绪与节奏的元素。SkyProduction本次开放的是自部署H3 768P版本，支持文生视频及当前开放的参考生成方式。创作者可结合实际生成结果，判断它适合承担哪些镜头任务，并在限免权益内继续尝试和调整。三、从内容出海到镜头精修，SkyProduction让创作进一步落地Minimax H3限免，让会员有机会把更多创意拿出来试。而真正投入短剧制作，还需要知道哪些情节值得拍、哪些片段需要改，以及怎样为不同市场制作版本。围绕这些具体需求，SkyProduction把剧本生成、剧本翻译、出海改编、镜头精修、长视频生成放进同一套工作台，让创作者能够继续打磨作品。生成之前，先把故事准备好对于AI短剧，剧本质量决定了后面每一步会不会返工。SkyProduction（天工工作台）把小说转剧本、剧本评分和剧本翻译放在同一条创作链路里，帮你生成能打的剧本。对于手中已有小说的创作者，“小说转剧本”可以把叙述、心理活动和关键情节整理成人物、场景、动作与对白，形成适合继续修改的剧本框架。“剧本评分”则从故事结构、人物设定、冲突推进和节奏等方面提供评价与修改建议，帮助创作者找到值得优先打磨的内容。先把故事理顺，再进入镜头测试，后续制作也更有方向。同一个故事，继续制作海外版本对于想要做出海短剧的生产者而言，外语不好、不懂对方文化，是很令人头疼的问题。SkyProduction的一系列功能就是为解决这个问题而生的。“剧本本地化翻译”结合角色名、人物关系、术语和上下文处理目标语言表达，把对白翻成更自然的目标语言，同时保留原剧本的场景、动作和格式。对于已有短剧的团队，平台还提供“短剧出海转绘”。你可以上传原短剧，直接进入海外改编制作流程。从剧本阶段的语言处理，到已有作品的版本改编，创作者可以根据需求选择相应的工具！从镜头规划到长视频成片，再逐段打磨上传一份完整剧本后，SkyProduction（天工工作台）的导演级Agent，就开始自动操作了！它会先帮你把人物、场景和道具找出来，分析剧情关系，再继续推进资产生成、分镜拆解和视频镜头制作。在Agent流程里，可以选择Seedance 2.0“智能创作”或“智能分镜”模式。想快速出片，可以走更精简的路径；想让人物站位和镜头关系更稳，可以使用站位图锁定，再进入分镜脚本、线稿图和视频镜头生成。如果你觉得还不够，那么“3D导演台”可以让镜头规划更具体：人物站在哪里、面向哪个方向、摄影机从什么角度拍摄，都可以先在三维空间里调整，再将选定视角截图用于后续创作。遇到双人对话、多人同框等场景，也能提前梳理人物之间的空间关系，把拍摄意图表达清楚。进入生成阶段，平台提供“直出10分钟视频”能力，为完整场景和较长篇幅的故事提供创作空间。创作者可以围绕一段情节展开人物互动、动作变化与节奏安排，再从整体效果中判断哪些段落值得保留、哪些地方需要继续打磨。成片后的修改同样有工具承接。如果某一段动作不自然、表情不合适，或台词表现未达到预期，可以通过“片段重拍”针对选定部分重新生成，保留其他可用内容，减少整段返工。“视频裁剪”则用于截取需要的片段，整理可用素材，为后续剪辑做好准备。从提前规划镜头，到生成较长内容，再到逐段修改，SkyProduction（天工工作台）让创作者能够把精力落到每一个具体的画面和表演上，让作品更可控，更能逐步接近导演脑海中的预期。最后，大家不要忘了我们的活动时间：9月9日，会员可进入SkyProduction体验H3限免；9月10日至14日，符合条件的新开会员和积分充值继续享受加赠。带上正在打磨的故事、参考素材和你激动的心，让下一次视频创作从天工工作台开始！SkyProduction（天工工作台）官网：www.skyproduction.cn"
        },
        {
            "index": 20,
            "time": "2026-09-08 23:55:45",
            "title": "从 15 秒到5 分钟，AI 视频创作进入单反级交付时代",
            "url": "https://www.ifanr.com/digest/1679330",
            "desc": "2026年9月8日，智象未来（HiDream.ai）旗下内容创作智能体vivago R1全球上线，国内版本「够搭」全新升级发布。今年7月，vivago R1 于 WAIC 2026 首次亮相。作为全球首个无限时长内容创作智能体，R1 引起 AI 视频领域广泛关注。今天，R1正式面向全球用户开放。vivago R1 的核心突破，在于实现了从一句成片时代的 “生成片段” 到 “完全交付作品” 的范式跃迁。它依托智象“基础模型 + 智能体”双轮驱动技术战略，让创作者以自然语言对话的方式，即可完成从创意表达到高质量成片交付的完整创作流程。R1的上线，标志着AI视频创作进入“单反级交付时代”。每一位普通创作者，都能独立完成专业团队级的品质大片。01 从Sora的15秒，到R1的五分钟Sora 用15秒视频惊艳世界，成为 AI 视频生成的重要转折点。但时至今日，15-30秒的片段式生成依然是行业主流。R1 的突破在于，能够一次性稳定输出5分钟高质量视频，并支持无限次多轮延长。长视频的难点，不只是把时长拉长，而是让故事在多镜头、多角色、多场景之间持续成立。R1 通过 Agent 系统对长任务进行规划与调度：主 Agent 拆解创意，子 Agent 协同完成脚本、分镜、角色、场景与音效，确保角色形象、场景风格和叙事节奏在多段落中保持一致。同时，依托智象自研 HD-AgentOS 的全流程调度与治理能力，R1 内容有效可用成功率提升至85%，显著降低“抽卡”概率，让视频创作更具确定性。R1 还优化了跨镜头角色一致性和场景过渡自然度，弱化 AI 视频常见的“塑料感”和“瞬移感”，实现更自然的运镜衔接与音画对齐，让长视频更接近实拍质感。02 Chat-First （对话优先）：让创作回到表达本身好的创作工具，应当顺应人的表达本能。对于视频创作而言，起点不应是节点、画布和参数，而应是创作者想要表达的内容。R1因此选择 Chat-First （对话优先）路线。因为对话是人类最自然的表达方式，也是 AI 最友好的创作入口。当前 AI 视频工具大致有两条路线：一类是画布式、节点式工作流，将模型、工具和参数交给用户自行连接和调试，自由度高，但门槛也高；另一类是 R1 的对话式路线，用户只需用自然语言描述需求，R1 即可自动生成视频，并支持在对话中持续调整和迭代。这种体验背后，是“做后”与“做厚”两条原则。“做后”，是把专业创作者的判断、审美和经验编码进 Agent 编排能力，形成强大的中后台；“做厚”，是构建 SkillHub，将抽象 AI 能力转译为产品广告、角色视频、故事短片、品牌内容等真实创作场景，让用户更容易理解能做什么、如何开始。在完整流程中，用户只需表达目标，Agent 负责拆解和执行，SkillHub 则作为翻译层，自动匹配并编排所需 Skill 组合，将用户意图转化为可执行任务序列。R1 的对话式创作，不是把复杂消灭，而是把复杂藏在简单背后。它让创作从“灵感闪现”到“进入执行”，缩短到只剩一句话。03 原生全模态基础架构，让 AI创作走向项目制视频生成的另一大挑战，是一致性：同一个角色、同一种声音，如何在数十个镜头、多次生成转换中始终如一。智象未来的解法，是以基础模型与智能体系统双轮驱动，共同支撑复杂视频创作。一方面，智象自研的原生全模态世界模型技术理念，为 R1 提供多模态理解与生成基础能力。它能将文本、图片、视频、参考资产、文档说明和历史创作结果纳入同一任务语境，让 Agent 理解“任务全貌”，而非单点指令。另一方面，智能体系统负责将模型能力组织为可持续推进的创作流程，在脚本、分镜、角色、场景、镜头和音效之间进行规划与调度，确保复杂叙事中的角色形象、声音特征和风格前后一致。这让创作不再是一次次孤立生成，而是围绕同一项目持续推进。用户可以“说不清的直接给”，R1 则在统一上下文中理解、组织、执行并持续迭代。同时，R1 推出资产库功能，沉淀用户生成、筛选并认可的内容，并可在后续创作中复用。一次创作不再只是一次性输出，而会成为下一次创作的素材基础。基础模型决定能力上限，智能体系统负责把能力转化为稳定、可控、可复用的作品交付。04 全球创作者用作品说话：R1 让表达成为生产力在今天举办的vivago R1「够搭」沉浸式工作坊活动上，来自全球不同领域的创作者们，采用线上和线下的方式，分享R1的使用心得，并展示他们制作的作品。近期，AI 版《西游记》上线后引发热议。活动现场，一位创作者也用 R1 尝试了这一经典题材的再创作，并生成近 5 分钟西游题材作品。从角色造型、场景氛围到东方奇幻质感，R1 对经典文本的视觉转译能力得到直观呈现。在真人质感上，R1 同样表现出色。另一位创作者带来一支励志短片，讲述体育老师周岚从迟疑到重新出发的过程。画面中，奔跑时的肌肉震颤、汗水光泽，以及脚步压过塑胶跑道的颗粒质感都被细腻还原，让人物情绪更具真实感。提示词：体育老师周岚在训练与接力比赛中面对自己的迟疑。来到第二道弯，她一度想停下，却继续迈步，坚持跑向终点。次日清晨，她主动再次接过接力棒。影片将人物转变放进呼吸、步伐与交接棒等具体动作，以持续奔跑呈现重新出发的过程。提交提示词后，R1 会自动理解人物关系、情绪转折与动作节奏，生成对应角色、场景与关键画面。创作者无需复杂操作，只需通过对话补充想法，即可推进内容生成。在商业广告片制作上，R1 也展现出较强适配能力。现场一位 AI 创作者分享了红色折叠手机广告案例。R1 根据提示词理解产品、人物与场景关系，生成手机多视图、女设计师造型、工作室与户外生活场景，以及包袋、色卡、草图等视觉资产，呈现从创作、出行到回归设计的日常灵感流动。提示词：一位年轻女设计师在一天中穿梭工作室、城市街道、咖啡馆和海边，用红色折叠手机记录色彩、构图与生活中的灵感，再将所见带回工作台。影片围绕手机开合、拍照和查看素材的使用动作，串联从创作到出行、再回到设计的日常。现场之外，多位海外创作者也通过线上连线分享创作体验。一位创作者表示：“视频创作的终点，就是一次表达。”这也道出了许多体验 R1 用户的共同感受：当复杂流程被隐藏在对话之后，创作者可以更专注于表达本身。05 开创视频Agent新标准：CHATSR1的实践充分表明，当产品真正进入专业场景，行业需要的就不再是零散的能力清单，而是一套可衡量、可依赖的交付标准。智象提炼出一套面向视频 Agent 的评估框架——CHATS，用于衡量一个视频 Agent 是否具备真正的作品交付能力：C（Consistency）一致性：角色、场景、风格在多镜头中保持稳定；H（Human Intent）意图理解：准确理解用户创意，并能在多轮对话中持续推进；A（Audio &amp; Visual）视听完整度：不仅生成画面，也能组织声音、节奏与整体视听体验；T（Timeline &amp; Tale）时间线与叙事：让故事在多个镜头、多个段落中持续成立；S（Stability）稳定交付：降低反复生成和返工成本，提高内容可用率。这五个维度，不是实验室里的理想指标，而是 R1 在真实创作内测场景中被众多内测用户反复验证过的能力边界。智象希望通过构建一个用户视角的标准，推动AI Agent产品的更好发展。2024年5月，vivago.ai 上线，成为全球最早一批公开可用的 AI 视频生成产品；今年5月，vivago.ai登顶Product Hunt日榜第一；今天，vivago.ai全球用户突破7000万。两年时间，智象从“第一个可用”走到第一个“单反级交付”。这就是 vivago R1 中 “R” 所承载的意义：一面是 Reasoning，用深度推理把灵感变成作品；一面是 Rock，致敬 “The Show Must Go On” 的创作精神——无论如何，创作终将继续。在AI视频时代，vivago R1 希望让创作从一次生成，变成持续对话：The CHATS must go on。只要对话继续，故事就不会停下。立即体验vivago.ai够搭 goudaai.com够搭，你的 AI 创意好搭子。"
        }
    ],
    "copyright": "娱乐范——聚合热搜榜"
}