公众号:卡尔的AI沃茨
LibTV推出Agent功能并内置Skill Hub,提供100多个覆盖武侠电影、皮克斯动画广告、电商口播等类型的视频Skill。用户输入想法后,Agent会分析需求并询问方向,自动生成视频分镜并串联成完整节点工作流,每个节点可查看和修改提示语。生成后LibTV会启动自查机制,自动检测并返修有问题的镜头。故事板视图提供图片与视频资产总览,支持在成片中直接打开剪辑时间线进行精细调整。用户还可自行创建Skill,上传三个文件即可,无需编程。实测中,Agent能输出剧情连贯、带粤语配音的成片,并支持双语字幕生成。
Hacker News 热门(buzzing.cc 中文翻译)
用户可通过 Claude 的 MessageDisplay Hook 机制自定义词汇替换。编写 Python 脚本,将“seam”替换为“whatchamacallit”、“you're absolutely right”替换为“I'm a complete clown”、“honest take”替换为“spicy doodad”、“load-bearing”替换为“cooked”,保存为 `~/.claude/hooks/wordswap.sh` 并赋予执行权限,再在 `~/.claude/settings.json` 的 hooks 块中配置该命令。Hook 在启动时加载,新会话即生效。
X:Demis Hassabis (@demishassabis)
Google DeepMind 联合创始人 Demis Hassabis 发文称,AGI 可能仅需数年即可实现,其影响将达工业革命的10倍且速度更快。他指出,前沿模型在网络安全、核与生物风险方面已构成挑战,未来需对日益智能体化、递归自我改进的系统建立稳健防护。Hassabis 呼吁美国率先建立类似 FINRA 的前沿AI标准机构,采用联邦监督下的公私合作或自律组织模式,由独立技术专家和开源代表组成董事会,资金主要来自行业以吸引顶尖人才和算力。他强调,当前商业与地缘竞赛导致技术进步快于理解,需以谨慎乐观态度推进公共政策,兼顾创新与安全。
公众号:面壁智能(MiniCPM)
面壁智能CTO曾国洋指出,端侧模型是AI落地的关键路径。其原创方法论“模型风洞”可在小规模实验中预测完整训练效果,并基于“知识密度”提出“面壁定律”:知识密度每3.5个月翻一番。2B参数的MiniCPM表现优于同期8B竞品。面壁已完成高通、联发科、英特尔、英伟达、AMD等芯片适配,新发布的BitCPM-CANN模型系列可在华为昇腾芯片上让同一内存多装约6倍模型。全双工全模态模型MiniCPM-o4.5支持实时打断与情绪调整。团队开发了全球首个完全由AI编写的生产级训练框架ForgeTrain,并引入行为模式库实现无需开口的“默契系统”。
LMSYS:Blog(Chatbot Arena 团队)
LMSYS 与 SGLang 团队针对智谱 GLM-5.2 NVFP4 模型在 Grace Blackwell 硬件上推出多项优化。运行时方面,Spec V2 重叠调度消除 GPU 气泡,端到端 TPS 提升 11%;IndexShare MTP 在 draft 步骤间复用 DSA indexer 的 top-k,长上下文下 draft 步骤成本降低约 1.9 倍。内核方面,TopK-V2 将 TopK 视为选择问题,80K ISL 下平均延迟从 40.7 µs 降至 17.5 µs(2.33× 加速),1M ISL 下从 372.1 µs 降至 36.6 µs(10.17× 加速)。优化后 8×B300 单 batch 解码吞吐超…
Suno:Blog(网页)
洛杉矶唱作人 sad alex 分享她如何将 Suno 用作创意草稿本:解决人声转换、乐器采样或 demo 搭建等具体问题,且仅用于自己 100% 拥有版权的歌曲。她认为 AI 本质上是“向后看”的,而人类创作是“向前看”的,因此 Suno 不会取代作者的个人表达。面对紧迫截止日期或缺乏预算与合作者时,Suno 可以充当临时助手,帮助创作者更快完成制作、完善想法,从而获得更大的创作自主权。
Apple Machine Learning Research(RSS)
Apple 机器学习研究团队为 Apple Music 搜索引入多语言语义检索系统,覆盖 150 多个国家及地区的数十种语言。该系统利用多语言嵌入向量模型,将用户查询与歌曲等内容的语义表示映射到同一向量空间,实现跨语言匹配。检索准确率较此前基于关键词的系统提升 30% 以上,同时保持毫秒级响应延迟。