01 小龙虾:OpenClaw 2.0正式发布,开源智能体框架迎来重大版本更新
02 大模型:Google Research发布TimesFM-3,单次前向实现高精度多变量时间序列预测;RedNote开源模型dots3-note预览版发布,参数达2800亿支持文本视觉音频,专注长时任务
03 工具:Grok Bot推出Templates模板分享:一键打包技能记忆,支持团队内部分享;Kiso开源出版引擎发布:内置MCP服务器,静态网站面向人类与AI代理
04 编码:Anthropic为Claude Code桌面版开发本地沙箱,隔离终端命令执行;VS Code八月更新:Agent会话新增并排聊天、侧聊与提示时间线
05 智能体:OpenClaw 2.0正式发布:超1.6万PR,支持云会话与实时协作;Hermes Agent新增真实Chrome配置浏览:一行配置接管登录状态
06 技术:AI研究者Sander Dieleman发文探讨连续深度语言模型引发热议;论文《代码即世界》:让智能体自动发现可执行世界表征用于物理推理
07 本地部署:llama.cpp自适应KV流式传输项目开源,提升长上下文推理效率;Artificial Analysis发布手机端侧推理硬件栈分析报告,获开发者关注
08 评测:VGI-Bench基准发布:27个任务探测视频生成模型的视觉推理能力;小模型智能体能力天梯出炉:Qwen3.8-27B量化版表现最佳
09 安全:欧盟将ChatGPT归类为超大型搜索引擎 OpenAI须在四个月内合规;Cloudflare推出Adaptive Intelligence检测引擎:以持续变化抬高机器人攻击成本
10 具身智能:Microduck年化收入达25亿美元 每5秒售出一台;Gradio上线Microduck语音文本交互 支持运行全部9个RL策略
11 硬件:台积电高管:硅光子成主流,2027年市占率将超50%;英伟达联发科深化AI工厂合作 联发科采用NVLink Fusion
12 训练:Tinker微调Inkling:25-100小时专用音频即可登顶语音细节还原;开发者用trl和openenv训练自有模型,将开源全部训练工件
13 提示词:开源结构化提示模板,用于Claude Code等AI工具实现MVP快速交付
14 视频:开发者用Grok Bot一键生成赤壁之战电影预告片,马斯克转发;LTX Ripple:高效IC LoRA视频编辑法,首帧编辑涟漪扩散至全片
15 音频:VoxCPM开源实时语音克隆:免分词连续空间建模突破传统TTS瓶颈;VoiceStudio开源发布:本地语音克隆与配音工具支持646种语言
16 活动:EverMind将在杭州办EverMe内测体验会:AI记忆成Agent共同底座;AI Colony学院9月4日线上直播:探讨2026年如何高效学习AI技能
17 案例:小马智行联手韩国FutureLink:200台第七代Robotaxi剑指2028首尔全无人运营;马斯克转发Grok Bot实测:用户组建四人助手团队打理日常事务
18 资源:开源科学Agent技能库发布:163个工作流覆盖癌症基因组学与药物发现;Kuleshov团队发布教程:手把手构建扩散语言模型
19 分享:Uber工程团队公开Agent软件工厂实践:六因子成本方程与多维度优化策略;GitLab团队详解上下文驱动AI开发工作流:效率瓶颈从工具转向上下文
20 观点:SpaceX自产涡轮叶片 缓解AI数据中心电力设备瓶颈;黄仁勋称AI正将制造业带回美国,六个月内4000亿美元投向AI初创
21 其他:Thinking Machines扩充评估团队:专注模型实用性评测与可定制基准;Cymela发布'同类首创'研究文章,技术社区获3评分
OpenClaw 2.0正式发布,开源智能体框架迎来重大版本更新【8.0分】
OpenClaw 2.0正式发布。OpenClaw官方账号宣布了这一消息,并同步放出博客链接介绍新版内容。OpenClaw是当前备受关注的开源智能体框架,从个人工具迅速发展为全球热门开源项目,已聚集近3000名贡献者,社区活跃度极高。此次2.0版本发布是该项目发展的重要里程碑,博客地址中带有'accidentally'字样,具体更新说明可前往官网博客查看。
相关链接:https://openclaw.ai/blog/openclaw-2-accidentally
Google Research发布TimesFM-3,单次前向实现高精度多变量时间序列预测【8.2分】
Google Research正式发布TimesFM-3,一款先进的时间序列基础模型,能在单次前向传播中完成多变量时间序列预测,在主要基准测试上显著超越其他预测模型。这一能力让金融、能源、制造等依赖多维时序数据的行业,能够以更高效率获得精准预测结果。官方博客已发布详细技术介绍,TimesFM-3代表了谷歌在时序预测领域的最新成果。
RedNote开源模型dots3-note预览版发布,参数达2800亿支持文本视觉音频,专注长时任务【7.8分】
RedNote发布了开源权重多模态模型dots3-note预览版,参数规模达280B(2800亿),同时支持文本、视觉与音频输入。据介绍,dots3-note专为需要数小时而非数秒完成的任务设计,主打长时任务处理能力,与常见的短时响应模型形成差异化定位。此次发布标志着RedNote正式以开源方式进入大模型竞争,目前以预览形态开放,280B参数体量与多模态能力成为核心看点。
相关链接:https://x.com/heyshrutimishra/status/2094271226592088365
Hugging Face发布TimesFM 3.0:3.3亿参数开源时间序列预测模型【7.6分】
Hugging Face正式发布TimesFM 3.0,一款用于时间序列预测的开源基础模型。该模型参数规模为3.3亿,支持复杂多元场景下的零样本预测。模型已通过Hugging Face平台开放,开发者可直接获取并使用。Hugging Face团队在发布中表示,对这项研究以及由此解锁的新用例感到兴奋。此次发布属于开放基础模型,为时间序列预测任务提供新的基础能力。
相关链接:https://x.com/huggingface/status/2094503440554590352
谷歌发布TimesFM-3:零样本多元时间序列预测模型【7.4分】
谷歌研究院发布TimesFM-3,一款用于多元时间序列预测的零样本基础模型。新模型可在不针对特定任务训练的情况下,直接对多变量时序数据进行预测,延续了TimesFM系列在零样本预测方向的探索。官方博客已公开模型介绍,技术社区同步分享了相关链接。TimesFM-3的推出,进一步丰富了谷歌在时序基础模型领域的产品线,为多元预测任务提供了新的可选项。
相关链接:https://research.google/blog/timesfm-3-a-zero-shot-foundation-model-for-multivariate-forecasting/
Grok Bot推出Templates模板分享:一键打包技能记忆,支持团队内部分享【7.8分】
Grok Bot正式推出Templates模板分享功能,用户可将机器人配置打包为模板对外分享。开发者matt palmer用7分钟视频详解流程:点击“分享为模板”会生成未发布且已脱敏的草稿,只保留对他人有用的技能、选中的记忆、官方插件与日常流程,密钥、私有记忆、自定义MCP、脚本和会话历史均不包含。模板发布范围仅限公开或仅团队两档。
相关链接:https://x.com/shao__meng/status/2094073021573259281
Kiso开源出版引擎发布:内置MCP服务器,静态网站面向人类与AI代理【7.2分】
作者发布开源出版引擎Kiso,在最新版本中新增了MCP服务器支持。Kiso专为开放知识格式(OKF)设计,核心理念是让企业拥有一份可同时被人类与AI代理消费的权威知识源。用户和AI代理共同编写Markdown文件,Kiso会将其发布为静态网站:人类可以浏览网页版本,AI代理直接读取Markdown原文。Kiso不引入数据库或专有知识存储,生成的纯静态站点可直接部署到GitHub Pages上。
相关链接:https://oak-invest.github.io/kiso/examples/kb-acme-example/
TablePro发布轻量数据库客户端:冷启动低于1秒,内置AI聊天并支持MCP【7.1分】
TablePro是一款面向开发者的全新数据库客户端工具,通过原生驱动连接所有主流SQL与NoSQL数据库,覆盖常见的关系型与非关系型数据源。产品主打轻量高效,冷启动时间不足1秒,空闲状态下内存占用仅为80MB。TablePro内置AI聊天功能,并支持MCP协议,可与Cursor、Raycast等AI编程工具集成使用,为开发者提供数据库操作与AI辅助一体的工作体验。
相关链接:https://github.com/TableProApp/TablePro
开源写作技能sepia:30项结构诊断去除AI写作痕迹【7.0分】
开源写作技能sepia近日发布,针对AI生成文本提供识别与改写方案。项目团队以六万多篇小说为对照样本,发现仅凭叙事结构即可识别AI写作,识别率高达93.2%;单纯改写表面词句几乎不影响识别,因此sepia转向结构层处理,提供主题表达、因果链松紧等30项诊断。该技能能识别Claude、ChatGPT、Gemini、DeepSeek、Kimi等模型的写作指纹。
相关链接:http://github.com/Nanako0129/sepia
Anthropic为Claude Code桌面版开发本地沙箱,隔离终端命令执行【7.5分】
Anthropic正在为Claude Code桌面版开发本地沙箱运行选项,可将Claude Code执行的命令隔离在独立沙箱中运行,对新会话生效。同时提供严格沙箱模式,直接阻止无法在沙箱内运行的命令(如ssh),而不是在沙箱外执行或征求用户同意。沙箱设置适用于本机所有Claude Code会话(含终端),除非项目自身配置覆盖。这一安全机制有助于降低恶意或异常命令对开发环境的破坏风险。
相关链接:https://x.com/testingcatalog/status/2094194068351758567
VS Code八月更新:Agent会话新增并排聊天、侧聊与提示时间线【7.2分】
GitHub博客发布VS Code八月版本更新日志,涵盖1.132至1.135版本。本次更新重点增强Agent会话组织:支持并排排列多个聊天、通过/btw开启共享上下文的侧聊、使用提示时间线快速定位对话与文件变更;Agent窗口还可安装符合1.0标准的插件、在Anthropic与Copilot订阅间切换模型,并可从会话列表继续其他应用中的Agent会话。
相关链接:https://aka.ms/VSCode/Release
GitHub Copilot宣布计费与政策调整 涉及订阅方案与使用规则【6.4分】
GitHub在官方博客发布更新日志,预告GitHub Copilot即将迎来计费与政策调整。公告明确这是即将到来的变更,涉及订阅方案与使用政策相关条款,官方提前公开以便个人开发者与企业团队评估影响、规划过渡。作为AI编程助手领域的头部产品,Copilot的计费结构变动预计会影响大量开发团队的采购与使用决策,GitHub选择在正式生效前发布预告,为开发者留出缓冲时间。
相关链接:https://github.blog/changelog/2026-08-28-upcoming-changes-to-github-copilot-policies-and-billing/
Replit CEO分享实测:免费模式在四年前旧iPhone上解锁6个并行任务【5.3分】
Replit首席执行官Amjad Masad分享了用户Brett的实测:在一台使用了近四年的旧iPhone上,Replit免费模式已能同时运行6个活跃任务。据介绍,这一并行限额最初为2个,随后提升至4个,如今已解锁到6个。对用户而言,最大的好处在于触及使用上限后,无需反复等待审批新任务,可节省数小时等待时间。
相关链接:https://x.com/amasad/status/2094463277086732341
OpenClaw 2.0正式发布:超1.6万PR,支持云会话与实时协作【8.2分】
OpenClaw基金会正式发布开源AI平台2.0版本,这是该项目迄今最大的一次版本更新,累计合并超过1.6万个拉取请求。新版本引入多项重要功能:支持在租用机器上运行云会话、提供实时协作能力,以及完全重建的浏览器应用。此外,安装配置流程大幅简化,软件能够自动检测已有的API密钥和AI订阅等资源。此次更新标志着OpenClaw从个人工具向成熟开源平台的进一步演进。
相关链接:https://the-decoder.com/openclaw-2-0-brings-simplified-setup-a-rebuilt-browser-app-and-multiplayer-sessions/
Hermes Agent新增真实Chrome配置浏览:一行配置接管登录状态【7.0分】
开发者Shubham Saboo公开介绍了Hermes Agent的一项新能力:现在它可以直接使用用户真实的Chrome配置文件浏览网页。用户只需在配置中写入一行设置,代理便会自动启用日常使用的Chrome个人资料,继承已经登录的各类网站状态,从而免去重复登录的繁琐操作。这并非复杂的插件或替代方案,而仅仅是Hermes内置的一个开关。
相关链接:https://x.com/unwind_ai_/status/2093398591297700163
开源工具Squad:终端中协调多个AI代理【6.6分】
Squad是一个开源的AI代理协调工具,近日在GitHub上发布。它允许开发者在终端中借助shell命令和SQLite来协调多个AI代理的运作,将多代理管理与终端环境相结合。Squad由mco-org推出,代码仓库为mco-org/squad,为需要在本地处理多个代理任务的用户提供了一种新的命令行选择。Squad利用shell命令与SQLite作为协调基础,在终端中实现多个AI代理的协同工作。
相关链接:https://github.com/mco-org/squad
AI研究者Sander Dieleman发文探讨连续深度语言模型引发热议【5.5分】
AI研究者Sander Dieleman在其个人博客发表技术文章,围绕连续深度语言模型(Continuous DLMs)展开探讨。该文章被分享至技术社区后引发关注,获得113个点赞和36条评论,成为当日热门技术话题。社区讨论热度表明,这一技术方向引起了不少开发者和研究者的兴趣,围绕连续型语言模型的技术演进讨论仍在继续。
相关链接:https://sander.ai/2026/08/24/continuous-dlms.html
论文《代码即世界》:让智能体自动发现可执行世界表征用于物理推理【4.5分】
一篇题为《代码即世界:面向物理推理的可执行世界表征智能体发现》的论文在 Hugging Face 论文平台公开。研究提出让智能体以“代码即世界”的方式,自主发现以可执行代码形式呈现的世界模型,并基于这些代码化表征完成物理推理任务。物理推理要求模型理解物体运动、碰撞等基本规律,而该工作把世界建模转化为程序化表征的自动发现过程,为这一关键问题提供新的研究视角。
相关链接:https://huggingface.co/papers/2608.27549
llama.cpp自适应KV流式传输项目开源,提升长上下文推理效率【6.8分】
开发者RaymondHuang210129在GitHub开源了llama.cpp自适应KV流式传输项目,旨在优化长上下文场景下的推理效率。该项目通过动态调整KV缓存流式传输策略,减少显存占用并提升处理速度,为本地大模型推理提供了一种新的优化思路。相关代码已在技术社区引发讨论,目前获得4分评价,有2条评论参与探讨。
相关链接:https://github.com/RaymondHuang210129/llama.cpp-adaptive-kv-streaming
Artificial Analysis发布手机端侧推理硬件栈分析报告,获开发者关注【6.6分】
人工智能分析机构Artificial Analysis发布了手机端侧推理硬件栈分析页面,聚焦智能手机芯片在本地运行大语言模型时的推理性能、硬件配置与架构方案。这份分析在技术社区引发讨论,获得82次点赞和17条评论,反映出开发者对移动端本地推理硬件方案的关注。页面内容涵盖手机端运行大模型的硬件选型、芯片算力与能效表现评估。
相关链接:https://artificialanalysis.ai/hardware-inference-stack/mobile-phones
VGI-Bench基准发布:27个任务探测视频生成模型的视觉推理能力【7.3分】
研究团队公开了视频生成模型视觉智能基准VGI-Bench。随着视频生成模型逐渐成为世界动作模型的骨干,VGI-Bench专门用于探测这些模型在27个任务、810个实例上编码的推理与动作相关先验。论文已上传HuggingFace,项目主页同步公开。VGI-Bench从推理和动作两个维度对视频生成模型进行系统评估,为衡量视频生成模型的视觉智能提供了统一测试方法。
相关链接:http://hexuan21.github.io/VGI-Bench/
小模型智能体能力天梯出炉:Qwen3.8-27B量化版表现最佳【6.8分】
一位开发者发布了小模型智能体能力测试排行榜,测试多款小模型在智能体任务中的表现。其中Qwen3.8-27B的UD-Q4_K_XL量化版本最值得使用,智能体任务建议将推理力度设为低,代码任务则调到中或高。全部测试统一在单卡H100 NVL上用llama.cpp最新版本完成。作者表示,Mac用户更推荐使用MLX框架,实测其开启MTP后速度优于llama.cpp,同时还在征集下一批想评测的模型。
相关链接:https://x.com/karminski3/status/2094341123124985991
欧盟将ChatGPT归类为超大型搜索引擎 OpenAI须在四个月内合规【8.3分】
欧盟依据《数字服务法》将ChatGPT归类为超大型搜索引擎,原因是其在欧盟的月活跃用户超过4500万。纳入该级别后,ChatGPT将受到与谷歌同等级别的数字安全审查。欧盟认定ChatGPT属于搜索引擎而非平台,因为它能通过联网搜索回答用户问题。OpenAI须在四个月内完成欧盟对超大型搜索引擎的全部合规要求,包括安全措施、隐私保护和未成年人保护等。
相关链接:https://x.com/gaganghotra_/status/2094457698414944443
Cloudflare推出Adaptive Intelligence检测引擎:以持续变化抬高机器人攻击成本【7.8分】
Cloudflare宣布推出全新机器人检测引擎Adaptive Intelligence。与传统'筑墙拦截'思路相反,该引擎预设攻击者终将突破,转而让每次入侵尝试都变得缓慢且成本高昂,直至攻击不再划算。引擎包含三个组件:持续自我重训、一次性规则生成、从所保护流量中学习。首个组件今日上线,支撑机器人评分的机器学习模型改为在实时流量上持续重训,能当周识别新出现的绕过手法,另两个组件将陆续推出。
相关链接:https://blog.cloudflare.com/introducing-precursor/
欧盟AI法案首次执法启动 安全信息请求成监管切入点【7.0分】
欧盟《人工智能法案》迎来首次执法行动,监管机构围绕安全合规向AI企业发出信息请求(RFI)。tokenstead.ai发布指南文章,解读本次执法的背景、安全要求及企业的应对思路。文章在技术社区引发讨论,获得26条评分与23条评论。此次执法标志着欧盟AI监管进入实质执行阶段,AI服务提供商的安全合规要求随之提高。
相关链接:https://tokenstead.ai/guides/eu-ai-act-first-enforcement-security-rfis
Figma官方博客:如何用智能体守护内部系统安全【6.8分】
Figma在官方博客发布文章,标题为《如何用智能体保护Figma内部系统》,分享了将AI智能体(agents)应用于内部系统安全防护的实践经验。文章以内部系统为场景,探讨了智能体在安全防护中的价值,并介绍了Figma在此方向上的思路与做法。作为一家设计协作平台,Figma将AI安全实践公开,为其他企业利用智能体提升安全运营效率提供了参考。
相关链接:https://www.figma.com/blog/how-we-secure-figmas-internal-systems-with-agents/
Microduck年化收入达25亿美元 每5秒售出一台【7.8分】
Leandro von Werra与Thomas Wolf在公开内容中相继提到,开源机器人Microduck当前年化收入已达25亿美元,平均每5秒售出一台。两人披露的这组销售数据表明,Microduck自开售以来市场热度持续处于高位,购买需求旺盛,商业化进展迅速。该机器人已成为近期硬件领域受关注度较高的产品,销售表现延续了开售以来的强劲势头。
相关链接:https://x.com/_akhaliq/status/2093151603733774826
Gradio上线Microduck语音文本交互 支持运行全部9个RL策略【6.9分】
Gradio宣布支持通过语音与文本方式操控Microduck机器人,用户可运行Microduck实际发布的全部9个强化学习策略,只需下达指令,机器人即可执行翻滚、穿上溜冰鞋、踢腿等动作,并忠实遵循所有命令。此前Microduck开售24小时销售额突破250万美元,成为近期最成功的机器人发布之一,此次Gradio交互功能的上线进一步丰富了Microduck的使用体验。
相关链接:https://x.com/_akhaliq/status/2094277992705147059
Microduck发售24小时销售额破250万美元 成最成功机器人发布之一【6.8分】
Microduck机器人在发售后的首个24小时内销售额突破250万美元。Remi Fabre公开宣布了这一成绩,称赞及团队完成了惊人成就,并提问这能否称得上是历史上最成功的机器人发布之一。此番销售数字来自团队口径,意味着Microduck在消费市场迎来强劲开局。若数据得到验证,其将成为近期商业表现最亮眼的机器人产品之一,也引发了对机器人硬件商业化潜力的讨论。
相关链接:https://x.com/huggingface/status/2094173413602398494
Hugging Face机器人Microduck首日订单超260万美元【5.5分】
Hugging Face开源双足机器人Microduck销售表现强劲。Thomas Wolf透露,Microduck开售24小时订单总额已超过260万美元,其早些时候宣布累计销售额突破100万美元后又快速攀升。这一首日成绩颇受关注,开源硬件与AI强化学习结合的路线正获得市场认可,社区对后续补货和开源资料落地也高度关注。
相关链接:https://x.com/_akhaliq/status/2093308610319159381
台积电高管:硅光子成主流,2027年市占率将超50%【7.6分】
台积电先进封装技术发展副总经理徐国晋表示,光收发器架构正经历结构性转变,硅光子已成主流,预估2027年市占率将超过50%。硅光子最终形态为共同封装光学(CPO),今年下半年将有厂商开始量产。他指出,AI呈指数级成长,网络逼近物理极限,计算单元已从单一服务器扩展至整个数据中心,光学成为数据中心的神经系统。
相关链接:https://x.com/dnystedt/status/2094437553185357858
英伟达联发科深化AI工厂合作 联发科采用NVLink Fusion【7.6分】
英伟达与联发科宣布深化合作,覆盖云端AI工厂、本地AI计算及汽车领域。联发科将采用英伟达NVLink Fusion技术,帮助客户将定制XPU接入NVLink连接的机架级AI工厂,从而增强AI算力基础设施的灵活性与扩展性。此举旨在推动定制芯片更顺畅地融入英伟达的AI工厂生态,进一步巩固双方在AI芯片和算力市场的协同布局。
相关链接:https://x.com/dnystedt/status/2094410950854197717
英伟达RTX Spark芯片催热AI PC市场,华硕微星预售告罄急追加订单【7.5分】
英伟达以全新RTX Spark处理器启动AI PC市场。华硕与微星首批搭载该处理器的AI PC在预售阶段即全部售罄,两家厂商均已向英伟达追加芯片订单,以应对市场需求。RTX Spark芯片采用台积电3nm工艺制造,共包含两款主要型号:面向主流AI PC的N1与面向高端机型的N1x。此举显示AI PC需求正在快速升温。
相关链接:https://money.udn.com/money/story/5612/9723531?from=edn_maintab_index&dark_mode=1
华为等发布FLINT论文:高带宽闪存为LLM推理扩容【7.5分】
华为、苏黎世联邦理工学院及华中科技大学联合发表论文《FLINT》,提出以高带宽闪存(HBF)作为大模型推理的容量扩展层。论文指出,LLM推理日益受限于加速器内存容量而非计算吞吐,单加速器和小型节点场景尤为突出。FLINT提出三项机制:硬件突发缓冲控制器动态合并并流水化HBF读取;幻影平面刷新机制把刷新操作移出推理关键路径;只读FTL以紧凑映射表替代SSD级任意写支持,映射逻辑权重突发到物理位置。
相关链接:https://arxiv.org/abs/2608.25062
Tinker微调Inkling:25-100小时专用音频即可登顶语音细节还原【7.2分】
Tinker宣布其微调版Inkling在语音细节还原任务上表现突出,仅需25至100小时的专业音频数据即可达到顶尖水平。该微调工作由besimple_ai完成,此前团队公布了Inkling在Voice Code Bench上的表现,随后尝试对其微调。Inkling的核心优势在于模型体积小、鲁棒性强,适合作为领域专用微调的基础模型。这一成果展示了小模型结合针对性微调在语音领域的潜力。
相关链接:https://x.com/miramurati/status/2094515221398425831
开发者用trl和openenv训练自有模型,将开源全部训练工件【6.0分】
开发者Sergio Paniego分享了使用trl和openenv训练自有模型的实践,并预告将发布配套博客,完整开放代码、模型、数据集和强化学习环境等训练工件。另一位开发者Surya表示,通过强化学习可以直接让编码模型学会用JavaScript作画。这次分享展示了trl与openenv在自定义训练流程中的应用方式,相关工件将随博客一并公开。
相关链接:https://x.com/huggingface/status/2094401894680588703
开源结构化提示模板,用于Claude Code等AI工具实现MVP快速交付【6.4分】
开发者开源了一款结构化提示模板,用于在Claude Code、Cursor和VS Code等AI辅助工作流中快速交付最小可行产品(MVP)。模板将vibe coding的松散流程转化为可复用的标准步骤,帮助开发者更稳定地借助AI编码工具完成从需求到成品的全过程。项目以GitHub仓库形式公开,任何开发者都可以直接复制使用,用于快速验证产品想法并交付可演示的MVP版本。
相关链接:https://github.com/KhazP/vibe-coding-prompt-template
开发者用Grok Bot一键生成赤壁之战电影预告片,马斯克转发【7.1分】
开发者Yun-Ta Tsai公布了一段用Grok Bot自动生成的赤壁之战电影预告片,马斯克转发演示。两个月前他曾用Grok Imagine制作公元208年赤壁之战的名场面,如今Grok Bot可同时调度导演、编剧、音乐制作人与摄影师等角色,仅凭一条提示词即可一次性产出电影级预告片,其余环节全部自主完成。这一创作展示了Grok Bot在多智能体协作创作与视频内容生成方向的进阶能力。
相关链接:https://x.com/elonmusk/status/2094532280840503629
LTX Ripple:高效IC LoRA视频编辑法,首帧编辑涟漪扩散至全片【6.8分】
LTX Ripple是一种基于LTX 2.5模型构建的高效IC LoRA视频编辑方法,相关演示已对外公开。其核心特点是用户只需编辑视频的第一帧,编辑效果便会自动涟漪式扩散至后续所有帧,实现整段视频的一致修改,大幅简化传统逐帧编辑流程。据介绍,该方法能够精准达成预期编辑目标,且处理速度非常快。目前在线演示已部署在Hugging Face空间,用户可直接上手体验。
相关链接:https://huggingface.co/spaces/WepeNerd/ltx-ripple-demo
AI短片《INCUBUS》亮相Higgsfield电影节 作者称酝酿11年的故事终于拍出【6.8分】
电影制作人Julien Prevost日前公开介绍了自己耗时两周完成的6分钟AI短片《INCUBUS》。他表示,这部讲述一个男人能离开身体、进入他人身体生活的故事,在他脑中酝酿了11年,此前一直被认为无法拍成电影,直到Higgsfield发起的电影节提供了实现的契机。Prevost在分享中感谢Higgsfield带来的创作能量,称每天都能在这里发现才华横溢的创作者。
相关链接:https://x.com/EHuanglu/status/2094523581585862947
James Russo用Codex和fal H3 Max数小时构建无限滚动视频App【6.4分】
开发者James Russo近日介绍,他借助OpenAI Codex和fal的H3 Max模型,仅用数小时就构建了一款无限滚动的短视频应用,形态类似TikTok。该应用在滚动过程中实时生成视频内容,并能在观看时将视频继续延长,最长可达30秒。值得注意的是,从代码编写到演示录屏生成,整个过程均由Codex全自动完成。这次实践展示了AI编程代理与视频生成模型结合后,能够快速搭建出完整可交互的产品原型。
相关链接:https://x.com/gaganghotra_/status/2094299477515665514
VoxCPM开源实时语音克隆:免分词连续空间建模突破传统TTS瓶颈【7.8分】
VoxCPM是一款开源的文本转语音系统,采用端到端扩散自回归架构,基于MiniCPM-4构建,直接在连续空间中建模语音,完全跳过分词步骤。传统TTS系统需先将语音转为离散词元,虽稳定但会损失呼吸声、音色等声学细节。VoxCPM通过分层语言建模解决:文本语义语言模型捕捉韵律,残差声学模型恢复精细声学细节。
相关链接:https://x.com/shao__meng/status/2094073632142319685
VoiceStudio开源发布:本地语音克隆与配音工具支持646种语言【5.5分】
Tom Dörr公开介绍了开源项目VoiceStudio。该工具可在本地完成语音克隆、配音、听写及长音频生成,整合16个TTS语音合成引擎和11个ASR语音识别引擎,覆盖646种语言。项目代码已在GitHub开源,用户可通过多引擎组合获得灵活的语音处理能力。VoiceStudio降低了语音合成与克隆的本地使用门槛,为多语言内容创作、影视配音和语音转写等场景提供了新的可选方案。
相关链接:https://github.com/debpalash/VoiceStudio
EverMind将在杭州办EverMe内测体验会:AI记忆成Agent共同底座【6.0分】
EverMind宣布将于9月6日14:00至18:00在杭州余杭区恒生科技园举办EverMe线下产品体验会,免费但需审核。EverMe希望将用户记忆沉淀为所有AI Agent可调用的共同底座,让AI在一次次协作中逐渐理解用户。活动邀请AI Agent重度用户、创业者、产品经理、内容创作者和开发者,现场可优先体验EverMe、与团队面对面交流,并带着真实场景参与测试与反馈。
相关链接:https://x.com/elliotchen100/status/2094271028700893380
AI Colony学院9月4日线上直播:探讨2026年如何高效学习AI技能【5.2分】
AI Colony学院(The AI Colony Academy)发布活动预告,将于2026年9月4日下午6点(西非时间)在社交平台举办一场线上语音直播,主题聚焦'如何在2026年学习AI技能而不被海量信息淹没'。直播将围绕如何在高噪声的AI资讯环境中筛选有效内容展开讨论,并开放提问环节,参与者可带着问题前来交流。
相关链接:https://x.com/TheAIColony/status/2093377293016014972
小马智行联手韩国FutureLink:200台第七代Robotaxi剑指2028首尔全无人运营【7.3分】
中国自动驾驶企业小马智行与韩国FutureLink于8月28日在首尔汝矣岛康莱德酒店签署战略合作,计划引入200辆第七代Robotaxi,目标2028年前在首尔实现完全无人驾驶运营。小马智行联合创始人兼CEO彭军与FutureLink董事长南景弼、CEO车斗元共同出席签约仪式。此次合作是中国自动驾驶企业进军韩国市场的重要一步,当地Robotaxi产业尚未完全跨越商业化门槛。
相关链接:https://www.digitimes.com/news/a20260831VL203/pony.ai-autonomous-driving-commercial-market-technology.html
马斯克转发Grok Bot实测:用户组建四人助手团队打理日常事务【6.7分】
马斯克转发了一位用户关于Grok Bot的实测分享。该用户展示了由四个私人助理机器人组成的Bot Crew:幕僚长Cosie负责统筹,Maisie处理邮件,Weary帮忙整理每日穿搭,Poshy则在Poshmark上转卖闲置衣物,覆盖工作、通讯、穿搭与二手交易等多个生活场景。她感叹拥有Grok Bot前后的生活截然不同,称这套组合"改变了生活"、"仿佛置身天堂"。
相关链接:https://x.com/elonmusk/status/2094244975651209265
谷歌力推AI工具进军好莱坞 影视行业成AI落地新战场【6.0分】
谷歌正积极争取好莱坞影视行业采用其AI工具。报道聚焦谷歌与影视制作公司、工作室之间的互动,展示科技巨头向娱乐产业推介AI技术、推动其在内容创作与制片流程中落地的策略。谷歌希望通过影视行业的合作案例,扩大AI工具在创意产业的应用版图。这一动向反映出大型科技公司与传统影视行业在AI应用上的持续磨合,也引发外界对AI介入内容创作方式的关注与讨论。
相关链接:https://www.latimes.com/entertainment-arts/business/story/2026-08-31/how-google-is-courting-hollywood-to-use-its-ai-tools
开发者演示Grok几秒为视频加字幕,称或不再需要Photoshop和CapCut【5.8分】
一则演示显示,开发者让Grok为视频添加字幕,几秒内即完成处理。该开发者表示,以后这类操作或许不再需要Photoshop或CapCut。演示视频记录了Grok自动为视频叠加字幕的过程,操作门槛明显降低。这一案例展示了Grok在视频后期处理场景中的实际应用能力。
相关链接:https://x.com/elonmusk/status/2094259860976103823
开源科学Agent技能库发布:163个工作流覆盖癌症基因组学与药物发现【6.9分】
K-Dense-AI发布了开源科学智能体技能库claude-scientific-skills,包含163个面向科研领域的工作流,覆盖癌症基因组学、药物发现与临床研究。技能库以开源方式托管于GitHub,科研人员可将这些技能用于生物医学研究与分析流程。这些技能以Agent技能形式组织,便于在智能体环境中直接调用。
相关链接:https://github.com/K-Dense-AI/claude-scientific-skills
Kuleshov团队发布教程:手把手构建扩散语言模型【6.8分】
康奈尔大学Kuleshov团队发布技术博客,详细讲解如何构建扩散语言模型。教程以循序渐进的方式展开,既介绍扩散模型在文本生成中的基本原理,也涉及实际的建模与训练流程,帮助研究者和开发者理解这一不同于传统自回归方式的新范式。内容在技术社区受到一定关注,目前获得20个点赞和2条评论,适合对生成式模型前沿方向感兴趣、希望上手实践的读者作为入门参考。
相关链接:https://kuleshov-group.github.io/blog/blog/2026/how-to-build-a-diffusion-language-model/
开源项目为AI智能体配备818项网络安全技能 映射6大行业框架【6.5分】
开发者近日分享了开源项目Anthropic-Cybersecurity-Skills,为AI智能体配备818项网络安全技能,并将这些技能映射到6个行业框架。项目已在GitHub公开发布,技能与框架的对应关系以结构化方式呈列,开发者可将这些技能接入智能体系统,帮助AI在网络安全场景下具备更系统的知识基础。
相关链接:https://github.com/mukul975/Anthropic-Cybersecurity-Skills
开源项目all-agentic-architectures以可运行类实现35种智能体AI架构并附对比基准【6.2分】
开发者FareedKhan-dev在GitHub开源了all-agentic-architectures,将35种生产级智能体AI架构实现为可直接运行的类,并附有对比基准测试。仓库以统一代码形式呈现多种智能体架构设计,开发者可直接运行各类架构并横向对比其表现。相比论文或架构示意图,代码化实现降低了理解与迁移成本;对于搭建智能体系统或进行架构选型的开发者。
相关链接:https://github.com/FareedKhan-dev/all-agentic-architectures
Uber工程团队公开Agent软件工厂实践:六因子成本方程与多维度优化策略【8.0分】
Uber工程团队发布博客,分享全公司落地AI编程Agent的运营体系。数据显示,过去半年超七成代码合并请求由Agent完成,自建3600个技能、每天执行3万次,周活跃用户增长7倍,总AI支出基本持平。文章提出六因子成本方程,将会话成本分解为用户数、请求量、输入输出Token及单价,并介绍模型选型、Token压缩、上下文工程等优化手段。
相关链接:https://www.uber.com/us/en/blog/efficient-software-factory/
GitLab团队详解上下文驱动AI开发工作流:效率瓶颈从工具转向上下文【7.8分】
GitLab团队在官方博客分享上下文驱动的AI开发工作流实践,提出AI时代开发效率的瓶颈已从工具能力转向上下文。其工作流包括:会话启动时AI自动加载活跃任务与阻塞项,碎片时间即可开工;通过git worktree和认领机制实现多AI会话并行推进MR;重复任务程序化,并自建本地MCP服务器,让工具做数据收集、LLM只做推理。
相关链接:https://about.gitlab.com/blog/building-an-ai-dev-workflow/
Shubham Saboo公开一人智能体组织运营法:Hermes四支柱架构【7.2分】
Shubham Saboo公开介绍其为2026年设计的一人智能体组织运行方式:基于Hermes搭建自改进体系,并以四支柱架构为核心。方向层面由他本人设定目标、审批方案并在必要时纠偏;执行层面由Hermes担任参谋长,各领域专家智能体分管业务,命令行工具执行具体动作;学习层面通过Skills技能模块保留有效做法,Memory承担记忆存储职责。
相关链接:https://x.com/unwind_ai_/status/2094196120788640027
Replit工程主管分享AI应用商业化经验:三天构建两月创收18万美元【6.8分】
Replit产品工程主管Amol Jain近日分享了将AI生成(vibe-coded)产品转化为真实业务的实践经验。他列举了三个由非程序员构建的应用案例,其中一个在开发者三天内完成端到端搭建后,前两个月便创收18万美元。他还提出将AI应用从原型推进到生产环境的四个步骤,并强调安全环节不可或缺。他同时指出,当代码可免费生成时,企业的核心竞争力应转向专业知识、判断力、分发渠道等差异化能力。
相关链接:https://youtu.be/JAh8Wv1lQrw
SpaceX自产涡轮叶片 缓解AI数据中心电力设备瓶颈【7.5分】
SpaceX正计划内部制造涡轮叶片,以缓解AI基础设施领域的全球性瓶颈。当前电力设备的供应紧张程度已与芯片相当,成为制约数据中心建设的关键短板。若该计划成功,将有望加快数据中心建设进度、重塑相关供应链,并增强马斯克对新增能源产能投产节奏的掌控力。分析认为,在AI算力需求快速扩张的背景下,电力设备供应已成为行业关注焦点。
相关链接:https://www.digitimes.com/news/a20260831VL204/spacex-data-center-infrastructure-texas-demand.html
黄仁勋称AI正将制造业带回美国,六个月内4000亿美元投向AI初创【7.4分】
英伟达CEO黄仁勋近日发表观点,认为AI正在催生新的公司和行业,并将制造业带回美国,推动国家再工业化。他表示,过去六个月已有4000亿美元投资涌入AI初创企业,并强调建设者必须与社区合作、赢得信任并创造本地价值。黄仁勋还指出,AI带来的需求正在驱动对老化电网和可持续能源的投资,且这一进程由市场力量而非补贴推动。他相信AI能帮助美国引领下一次工业革命。
相关链接:https://x.com/dnystedt/status/2094196247196537013
OpenRouter数据验证Jevons悖论:token降价后使用量暴增13.8倍【7.3分】
Aaron Levie分享了对AI token消费的观察:企业有大量任务希望自动化,但每项任务是否值得投入取决于自动化成本,包括设置时间和变更管理。随着token价格下降,更多工作可纳入自动化范围,如处理合同、阅读日志、监控数据流及后台智能体执行工作流。他表示,token价格即使下降50%,这类工作负载的token使用量也可能增长5倍。
相关链接:https://x.com/paulg/status/2094233112599208188
Gavin Baker:AI推动美国再工业化,半年4000亿美元涌入AI初创【7.3分】
Gavin Baker回应Jensen Huang的观点称,AI正推动美国再工业化,制造业自数十年离岸外包后回流美国;AI创造的需求带动对老旧电网和可持续能源的投资,且由市场力量而非补贴驱动。他还指出AI正在能源、芯片制造和数据中心领域创造就业,过去六个月已有4000亿美元投入AI初创公司。随后他为自己昨日关于数据中心的言论致歉,表示约18个月前公众对水资源、税收、就业、电价和环境的担忧是合理的。
相关链接:https://x.com/heyshrutimishra/status/2094277280973652322
1. Thinking Machines宣布扩充评估团队,专注检验模型实际效用与评测方法质量,使其能作为扩展研究的衡量基准。团队将负责构建具备信号价值的内部评测以支持预测性扩展,将真实用户反馈与产品流程转化为评测以弥合可用性差距,并审计评分器与评测框架,同时开发面向可定制性的新基准。相关招聘信息已公开,欢迎研究者申请。
相关链接:
https://jobs.ashbyhq.com/ThinkingMachines/602f2a99-34eb-4fde-9eec-b4945ee4aab6
2. 本文报道了Cymela研究专栏发布的一篇题为'同类首创'的文章。该文章链接已在技术社区被分享,目前获得3个评分,评论区暂无发言。文章标题显示其内容具有首创性质,但摘要中未提供任何具体的技术细节或数据。作为研究类内容,这篇文章可能涉及某领域的创新突破,但具体方向尚不明确。读者可通过原文链接了解详细内容,并通过社区评论链接参与讨论。该文章当前关注度较低,后续进展值得留意。
相关链接:https://cymela.com/research/first-of-its-kind
截至发稿共收录154条AI资讯,本期早报精选63条。以上为果比AI早报精选,更多AI资讯请移步www.guobi.ai