社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  chatgpt

2026.09.01 果比AI早报 — 欧盟将ChatGPT归类为超大型搜索引擎 OpenAI须在四个月内合规

果比AI • 2 周前 • 126 次点击  

- 导读 -

01 小龙虾:OpenClaw 2.0正式发布,开源智能体框架迎来重大版本更新
02 大模型:Google Research发布TimesFM-3,单次前向实现高精度多变量时间序列预测;RedNote开源模型dots3-note预览版发布,参数达2800亿支持文本视觉音频,专注长时任务
03 工具:Grok Bot推出Templates模板分享:一键打包技能记忆,支持团队内部分享;Kiso开源出版引擎发布:内置MCP服务器,静态网站面向人类与AI代理
04 编码:Anthropic为Claude Code桌面版开发本地沙箱,隔离终端命令执行;VS Code八月更新:Agent会话新增并排聊天、侧聊与提示时间线
05 智能体:OpenClaw 2.0正式发布:超1.6万PR,支持云会话与实时协作;Hermes Agent新增真实Chrome配置浏览:一行配置接管登录状态
06 技术:AI研究者Sander Dieleman发文探讨连续深度语言模型引发热议;论文《代码即世界》:让智能体自动发现可执行世界表征用于物理推理
07 本地部署:llama.cpp自适应KV流式传输项目开源,提升长上下文推理效率;Artificial Analysis发布手机端侧推理硬件栈分析报告,获开发者关注
08 评测:VGI-Bench基准发布:27个任务探测视频生成模型的视觉推理能力;小模型智能体能力天梯出炉:Qwen3.8-27B量化版表现最佳
09 安全:欧盟将ChatGPT归类为超大型搜索引擎 OpenAI须在四个月内合规;Cloudflare推出Adaptive Intelligence检测引擎:以持续变化抬高机器人攻击成本
10 具身智能:Microduck年化收入达25亿美元 每5秒售出一台;Gradio上线Microduck语音文本交互 支持运行全部9个RL策略
11 硬件:台积电高管:硅光子成主流,2027年市占率将超50%;英伟达联发科深化AI工厂合作 联发科采用NVLink Fusion
12 训练:Tinker微调Inkling:25-100小时专用音频即可登顶语音细节还原;开发者用trl和openenv训练自有模型,将开源全部训练工件
13 提示词:开源结构化提示模板,用于Claude Code等AI工具实现MVP快速交付
14 视频:开发者用Grok Bot一键生成赤壁之战电影预告片,马斯克转发;LTX Ripple:高效IC LoRA视频编辑法,首帧编辑涟漪扩散至全片
15 音频:VoxCPM开源实时语音克隆:免分词连续空间建模突破传统TTS瓶颈;VoiceStudio开源发布:本地语音克隆与配音工具支持646种语言
16 活动:EverMind将在杭州办EverMe内测体验会:AI记忆成Agent共同底座;AI Colony学院9月4日线上直播:探讨2026年如何高效学习AI技能
17 案例:小马智行联手韩国FutureLink:200台第七代Robotaxi剑指2028首尔全无人运营;马斯克转发Grok Bot实测:用户组建四人助手团队打理日常事务
18 资源:开源科学Agent技能库发布:163个工作流覆盖癌症基因组学与药物发现;Kuleshov团队发布教程:手把手构建扩散语言模型
19 分享:Uber工程团队公开Agent软件工厂实践:六因子成本方程与多维度优化策略;GitLab团队详解上下文驱动AI开发工作流:效率瓶颈从工具转向上下文
20 观点:SpaceX自产涡轮叶片 缓解AI数据中心电力设备瓶颈;黄仁勋称AI正将制造业带回美国,六个月内4000亿美元投向AI初创
21 其他:Thinking Machines扩充评估团队:专注模型实用性评测与可定制基准;Cymela发布'同类首创'研究文章,技术社区获3评分

- 01 小龙虾 -

OpenClaw 2.0正式发布,开源智能体框架迎来重大版本更新【8.0分】

OpenClaw 2.0正式发布。OpenClaw官方账号宣布了这一消息,并同步放出博客链接介绍新版内容。OpenClaw是当前备受关注的开源智能体框架,从个人工具迅速发展为全球热门开源项目,已聚集近3000名贡献者,社区活跃度极高。此次2.0版本发布是该项目发展的重要里程碑,博客地址中带有'accidentally'字样,具体更新说明可前往官网博客查看。

相关链接:https://openclaw.ai/blog/openclaw-2-accidentally

- 02 大模型(展示4/10条) -

Google Research发布TimesFM-3,单次前向实现高精度多变量时间序列预测【8.2分】

Google Research正式发布TimesFM-3,一款先进的时间序列基础模型,能在单次前向传播中完成多变量时间序列预测,在主要基准测试上显著超越其他预测模型。这一能力让金融、能源、制造等依赖多维时序数据的行业,能够以更高效率获得精准预测结果。官方博客已发布详细技术介绍,TimesFM-3代表了谷歌在时序预测领域的最新成果。

RedNote开源模型dots3-note预览版发布,参数达2800亿支持文本视觉音频,专注长时任务【7.8分】

RedNote发布了开源权重多模态模型dots3-note预览版,参数规模达280B(2800亿),同时支持文本、视觉与音频输入。据介绍,dots3-note专为需要数小时而非数秒完成的任务设计,主打长时任务处理能力,与常见的短时响应模型形成差异化定位。此次发布标志着RedNote正式以开源方式进入大模型竞争,目前以预览形态开放,280B参数体量与多模态能力成为核心看点。

相关链接:https://x.com/heyshrutimishra/status/2094271226592088365

Hugging Face发布TimesFM 3.0:3.3亿参数开源时间序列预测模型【7.6分】

Hugging Face正式发布TimesFM 3.0,一款用于时间序列预测的开源基础模型。该模型参数规模为3.3亿,支持复杂多元场景下的零样本预测。模型已通过Hugging Face平台开放,开发者可直接获取并使用。Hugging Face团队在发布中表示,对这项研究以及由此解锁的新用例感到兴奋。此次发布属于开放基础模型,为时间序列预测任务提供新的基础能力。

相关链接:https://x.com/huggingface/status/2094503440554590352

谷歌发布TimesFM-3:零样本多元时间序列预测模型【7.4分】

谷歌研究院发布TimesFM-3,一款用于多元时间序列预测的零样本基础模型。新模型可在不针对特定任务训练的情况下,直接对多变量时序数据进行预测,延续了TimesFM系列在零样本预测方向的探索。官方博客已公开模型介绍,技术社区同步分享了相关链接。TimesFM-3的推出,进一步丰富了谷歌在时序基础模型领域的产品线,为多元预测任务提供了新的可选项。

相关链接:https://research.google/blog/timesfm-3-a-zero-shot-foundation-model-for-multivariate-forecasting/

- 03 工具(展示4/18条) -

Grok Bot推出Templates模板分享:一键打包技能记忆,支持团队内部分享【7.8分】

Grok Bot正式推出Templates模板分享功能,用户可将机器人配置打包为模板对外分享。开发者matt palmer用7分钟视频详解流程:点击“分享为模板”会生成未发布且已脱敏的草稿,只保留对他人有用的技能、选中的记忆、官方插件与日常流程,密钥、私有记忆、自定义MCP、脚本和会话历史均不包含。模板发布范围仅限公开或仅团队两档。

相关链接:https://x.com/shao__meng/status/2094073021573259281

Kiso开源出版引擎发布:内置MCP服务器,静态网站面向人类与AI代理【7.2分】

作者发布开源出版引擎Kiso,在最新版本中新增了MCP服务器支持。Kiso专为开放知识格式(OKF)设计,核心理念是让企业拥有一份可同时被人类与AI代理消费的权威知识源。用户和AI代理共同编写Markdown文件,Kiso会将其发布为静态网站:人类可以浏览网页版本,AI代理直接读取Markdown原文。Kiso不引入数据库或专有知识存储,生成的纯静态站点可直接部署到GitHub Pages上。

相关链接:https://oak-invest.github.io/kiso/examples/kb-acme-example/

TablePro发布轻量数据库客户端:冷启动低于1秒,内置AI聊天并支持MCP【7.1分】

TablePro是一款面向开发者的全新数据库客户端工具,通过原生驱动连接所有主流SQL与NoSQL数据库,覆盖常见的关系型与非关系型数据源。产品主打轻量高效,冷启动时间不足1秒,空闲状态下内存占用仅为80MB。TablePro内置AI聊天功能,并支持MCP协议,可与Cursor、Raycast等AI编程工具集成使用,为开发者提供数据库操作与AI辅助一体的工作体验。

相关链接:https://github.com/TableProApp/TablePro

开源写作技能sepia:30项结构诊断去除AI写作痕迹【7.0分】

开源写作技能sepia近日发布,针对AI生成文本提供识别与改写方案。项目团队以六万多篇小说为对照样本,发现仅凭叙事结构即可识别AI写作,识别率高达93.2%;单纯改写表面词句几乎不影响识别,因此sepia转向结构层处理,提供主题表达、因果链松紧等30项诊断。该技能能识别Claude、ChatGPT、Gemini、DeepSeek、Kimi等模型的写作指纹。

相关链接:http://github.com/Nanako0129/sepia

- 04 编码(展示4/7条) -

Anthropic为Claude Code桌面版开发本地沙箱,隔离终端命令执行【7.5分】

Anthropic正在为Claude Code桌面版开发本地沙箱运行选项,可将Claude Code执行的命令隔离在独立沙箱中运行,对新会话生效。同时提供严格沙箱模式,直接阻止无法在沙箱内运行的命令(如ssh),而不是在沙箱外执行或征求用户同意。沙箱设置适用于本机所有Claude Code会话(含终端),除非项目自身配置覆盖。这一安全机制有助于降低恶意或异常命令对开发环境的破坏风险。

相关链接:https://x.com/testingcatalog/status/2094194068351758567

VS Code八月更新:Agent会话新增并排聊天、侧聊与提示时间线【7.2分】

GitHub博客发布VS Code八月版本更新日志,涵盖1.132至1.135版本。本次更新重点增强Agent会话组织:支持并排排列多个聊天、通过/btw开启共享上下文的侧聊、使用提示时间线快速定位对话与文件变更;Agent窗口还可安装符合1.0标准的插件、在Anthropic与Copilot订阅间切换模型,并可从会话列表继续其他应用中的Agent会话。

相关链接:https://aka.ms/VSCode/Release

GitHub Copilot宣布计费与政策调整 涉及订阅方案与使用规则【6.4分】

GitHub在官方博客发布更新日志,预告GitHub Copilot即将迎来计费与政策调整。公告明确这是即将到来的变更,涉及订阅方案与使用政策相关条款,官方提前公开以便个人开发者与企业团队评估影响、规划过渡。作为AI编程助手领域的头部产品,Copilot的计费结构变动预计会影响大量开发团队的采购与使用决策,GitHub选择在正式生效前发布预告,为开发者留出缓冲时间。

相关链接:https://github.blog/changelog/2026-08-28-upcoming-changes-to-github-copilot-policies-and-billing/

Replit CEO分享实测:免费模式在四年前旧iPhone上解锁6个并行任务【5.3分】

Replit首席执行官Amjad Masad分享了用户Brett的实测:在一台使用了近四年的旧iPhone上,Replit免费模式已能同时运行6个活跃任务。据介绍,这一并行限额最初为2个,随后提升至4个,如今已解锁到6个。对用户而言,最大的好处在于触及使用上限后,无需反复等待审批新任务,可节省数小时等待时间。

相关链接:https://x.com/amasad/status/2094463277086732341

- 05 智能体 -

OpenClaw 2.0正式发布:超1.6万PR,支持云会话与实时协作【8.2分】

OpenClaw基金会正式发布开源AI平台2.0版本,这是该项目迄今最大的一次版本更新,累计合并超过1.6万个拉取请求。新版本引入多项重要功能:支持在租用机器上运行云会话、提供实时协作能力,以及完全重建的浏览器应用。此外,安装配置流程大幅简化,软件能够自动检测已有的API密钥和AI订阅等资源。此次更新标志着OpenClaw从个人工具向成熟开源平台的进一步演进。

相关链接:https://the-decoder.com/openclaw-2-0-brings-simplified-setup-a-rebuilt-browser-app-and-multiplayer-sessions/

Hermes Agent新增真实Chrome配置浏览:一行配置接管登录状态【7.0分】

开发者Shubham Saboo公开介绍了Hermes Agent的一项新能力:现在它可以直接使用用户真实的Chrome配置文件浏览网页。用户只需在配置中写入一行设置,代理便会自动启用日常使用的Chrome个人资料,继承已经登录的各类网站状态,从而免去重复登录的繁琐操作。这并非复杂的插件或替代方案,而仅仅是Hermes内置的一个开关。

相关链接:https://x.com/unwind_ai_/status/2093398591297700163

开源工具Squad:终端中协调多个AI代理【6.6分】

Squad是一个开源的AI代理协调工具,近日在GitHub上发布。它允许开发者在终端中借助shell命令和SQLite来协调多个AI代理的运作,将多代理管理与终端环境相结合。Squad由mco-org推出,代码仓库为mco-org/squad,为需要在本地处理多个代理任务的用户提供了一种新的命令行选择。Squad利用shell命令与SQLite作为协调基础,在终端中实现多个AI代理的协同工作。

相关链接:https://github.com/mco-org/squad

- 06 技术 -

AI研究者Sander Dieleman发文探讨连续深度语言模型引发热议【5.5分】

AI研究者Sander Dieleman在其个人博客发表技术文章,围绕连续深度语言模型(Continuous DLMs)展开探讨。该文章被分享至技术社区后引发关注,获得113个点赞和36条评论,成为当日热门技术话题。社区讨论热度表明,这一技术方向引起了不少开发者和研究者的兴趣,围绕连续型语言模型的技术演进讨论仍在继续。

相关链接:https://sander.ai/2026/08/24/continuous-dlms.html

论文《代码即世界》:让智能体自动发现可执行世界表征用于物理推理【4.5分】

一篇题为《代码即世界:面向物理推理的可执行世界表征智能体发现》的论文在 Hugging Face 论文平台公开。研究提出让智能体以“代码即世界”的方式,自主发现以可执行代码形式呈现的世界模型,并基于这些代码化表征完成物理推理任务。物理推理要求模型理解物体运动、碰撞等基本规律,而该工作把世界建模转化为程序化表征的自动发现过程,为这一关键问题提供新的研究视角。

相关链接:https://huggingface.co/papers/2608.27549

- 07 本地部署 -

llama.cpp自适应KV流式传输项目开源,提升长上下文推理效率【6.8分】

开发者RaymondHuang210129在GitHub开源了llama.cpp自适应KV流式传输项目,旨在优化长上下文场景下的推理效率。该项目通过动态调整KV缓存流式传输策略,减少显存占用并提升处理速度,为本地大模型推理提供了一种新的优化思路。相关代码已在技术社区引发讨论,目前获得4分评价,有2条评论参与探讨。

相关链接:https://github.com/RaymondHuang210129/llama.cpp-adaptive-kv-streaming

Artificial Analysis发布手机端侧推理硬件栈分析报告,获开发者关注【6.6分】

人工智能分析机构Artificial Analysis发布了手机端侧推理硬件栈分析页面,聚焦智能手机芯片在本地运行大语言模型时的推理性能、硬件配置与架构方案。这份分析在技术社区引发讨论,获得82次点赞和17条评论,反映出开发者对移动端本地推理硬件方案的关注。页面内容涵盖手机端运行大模型的硬件选型、芯片算力与能效表现评估。

相关链接:https://artificialanalysis.ai/hardware-inference-stack/mobile-phones

- 08 评测 -

VGI-Bench基准发布:27个任务探测视频生成模型的视觉推理能力【7.3分】

研究团队公开了视频生成模型视觉智能基准VGI-Bench。随着视频生成模型逐渐成为世界动作模型的骨干,VGI-Bench专门用于探测这些模型在27个任务、810个实例上编码的推理与动作相关先验。论文已上传HuggingFace,项目主页同步公开。VGI-Bench从推理和动作两个维度对视频生成模型进行系统评估,为衡量视频生成模型的视觉智能提供了统一测试方法。

相关链接:http://hexuan21.github.io/VGI-Bench/

小模型智能体能力天梯出炉:Qwen3.8-27B量化版表现最佳【6.8分】

一位开发者发布了小模型智能体能力测试排行榜,测试多款小模型在智能体任务中的表现。其中Qwen3.8-27B的UD-Q4_K_XL量化版本最值得使用,智能体任务建议将推理力度设为低,代码任务则调到中或高。全部测试统一在单卡H100 NVL上用llama.cpp最新版本完成。作者表示,Mac用户更推荐使用MLX框架,实测其开启MTP后速度优于llama.cpp,同时还在征集下一批想评测的模型。

Image

相关链接:https://x.com/karminski3/status/2094341123124985991

- 09 安全(展示4/12条) -

欧盟将ChatGPT归类为超大型搜索引擎 OpenAI须在四个月内合规【8.3分】

欧盟依据《数字服务法》将ChatGPT归类为超大型搜索引擎,原因是其在欧盟的月活跃用户超过4500万。纳入该级别后,ChatGPT将受到与谷歌同等级别的数字安全审查。欧盟认定ChatGPT属于搜索引擎而非平台,因为它能通过联网搜索回答用户问题。OpenAI须在四个月内完成欧盟对超大型搜索引擎的全部合规要求,包括安全措施、隐私保护和未成年人保护等。

相关链接:https://x.com/gaganghotra_/status/2094457698414944443

Cloudflare推出Adaptive Intelligence检测引擎:以持续变化抬高机器人攻击成本【7.8分】

Cloudflare宣布推出全新机器人检测引擎Adaptive Intelligence。与传统'筑墙拦截'思路相反,该引擎预设攻击者终将突破,转而让每次入侵尝试都变得缓慢且成本高昂,直至攻击不再划算。引擎包含三个组件:持续自我重训、一次性规则生成、从所保护流量中学习。首个组件今日上线,支撑机器人评分的机器学习模型改为在实时流量上持续重训,能当周识别新出现的绕过手法,另两个组件将陆续推出。

相关链接:https://blog.cloudflare.com/introducing-precursor/

欧盟AI法案首次执法启动 安全信息请求成监管切入点【7.0分】

欧盟《人工智能法案》迎来首次执法行动,监管机构围绕安全合规向AI企业发出信息请求(RFI)。tokenstead.ai发布指南文章,解读本次执法的背景、安全要求及企业的应对思路。文章在技术社区引发讨论,获得26条评分与23条评论。此次执法标志着欧盟AI监管进入实质执行阶段,AI服务提供商的安全合规要求随之提高。

相关链接:https://tokenstead.ai/guides/eu-ai-act-first-enforcement-security-rfis

Figma官方博客:如何用智能体守护内部系统安全【6.8分】

Figma在官方博客发布文章,标题为《如何用智能体保护Figma内部系统》,分享了将AI智能体(agents)应用于内部系统安全防护的实践经验。文章以内部系统为场景,探讨了智能体在安全防护中的价值,并介绍了Figma在此方向上的思路与做法。作为一家设计协作平台,Figma将AI安全实践公开,为其他企业利用智能体提升安全运营效率提供了参考。

相关链接:https://www.figma.com/blog/how-we-secure-figmas-internal-systems-with-agents/

- 10 具身智能(展示4/8条) -

Microduck年化收入达25亿美元 每5秒售出一台【7.8分】

Leandro von Werra与Thomas Wolf在公开内容中相继提到,开源机器人Microduck当前年化收入已达25亿美元,平均每5秒售出一台。两人披露的这组销售数据表明,Microduck自开售以来市场热度持续处于高位,购买需求旺盛,商业化进展迅速。该机器人已成为近期硬件领域受关注度较高的产品,销售表现延续了开售以来的强劲势头。

相关链接:https://x.com/_akhaliq/status/2093151603733774826

Gradio上线Microduck语音文本交互 支持运行全部9个RL策略【6.9分】

Gradio宣布支持通过语音与文本方式操控Microduck机器人,用户可运行Microduck实际发布的全部9个强化学习策略,只需下达指令,机器人即可执行翻滚、穿上溜冰鞋、踢腿等动作,并忠实遵循所有命令。此前Microduck开售24小时销售额突破250万美元,成为近期最成功的机器人发布之一,此次Gradio交互功能的上线进一步丰富了Microduck的使用体验。

相关链接:https://x.com/_akhaliq/status/2094277992705147059

Microduck发售24小时销售额破250万美元 成最成功机器人发布之一【6.8分】

Microduck机器人在发售后的首个24小时内销售额突破250万美元。Remi Fabre公开宣布了这一成绩,称赞及团队完成了惊人成就,并提问这能否称得上是历史上最成功的机器人发布之一。此番销售数字来自团队口径,意味着Microduck在消费市场迎来强劲开局。若数据得到验证,其将成为近期商业表现最亮眼的机器人产品之一,也引发了对机器人硬件商业化潜力的讨论。

Image

相关链接:https://x.com/huggingface/status/2094173413602398494

Hugging Face机器人Microduck首日订单超260万美元【5.5分】

Hugging Face开源双足机器人Microduck销售表现强劲。Thomas Wolf透露,Microduck开售24小时订单总额已超过260万美元,其早些时候宣布累计销售额突破100万美元后又快速攀升。这一首日成绩颇受关注,开源硬件与AI强化学习结合的路线正获得市场认可,社区对后续补货和开源资料落地也高度关注。

相关链接:https://x.com/_akhaliq/status/2093308610319159381

- 11 硬件(展示4/16条) -

台积电高管:硅光子成主流,2027年市占率将超50%【7.6分】

台积电先进封装技术发展副总经理徐国晋表示,光收发器架构正经历结构性转变,硅光子已成主流,预估2027年市占率将超过50%。硅光子最终形态为共同封装光学(CPO),今年下半年将有厂商开始量产。他指出,AI呈指数级成长,网络逼近物理极限,计算单元已从单一服务器扩展至整个数据中心,光学成为数据中心的神经系统。

相关链接:https://x.com/dnystedt/status/2094437553185357858

英伟达联发科深化AI工厂合作 联发科采用NVLink Fusion【7.6分】

英伟达与联发科宣布深化合作,覆盖云端AI工厂、本地AI计算及汽车领域。联发科将采用英伟达NVLink Fusion技术,帮助客户将定制XPU接入NVLink连接的机架级AI工厂,从而增强AI算力基础设施的灵活性与扩展性。此举旨在推动定制芯片更顺畅地融入英伟达的AI工厂生态,进一步巩固双方在AI芯片和算力市场的协同布局。

相关链接:https://x.com/dnystedt/status/2094410950854197717

英伟达RTX Spark芯片催热AI PC市场,华硕微星预售告罄急追加订单【7.5分】

英伟达以全新RTX Spark处理器启动AI PC市场。华硕与微星首批搭载该处理器的AI PC在预售阶段即全部售罄,两家厂商均已向英伟达追加芯片订单,以应对市场需求。RTX Spark芯片采用台积电3nm工艺制造,共包含两款主要型号:面向主流AI PC的N1与面向高端机型的N1x。此举显示AI PC需求正在快速升温。

相关链接:https://money.udn.com/money/story/5612/9723531?from=edn_maintab_index&dark_mode=1

华为等发布FLINT论文:高带宽闪存为LLM推理扩容【7.5分】

华为、苏黎世联邦理工学院及华中科技大学联合发表论文《FLINT》,提出以高带宽闪存(HBF)作为大模型推理的容量扩展层。论文指出,LLM推理日益受限于加速器内存容量而非计算吞吐,单加速器和小型节点场景尤为突出。FLINT提出三项机制:硬件突发缓冲控制器动态合并并流水化HBF读取;幻影平面刷新机制把刷新操作移出推理关键路径;只读FTL以紧凑映射表替代SSD级任意写支持,映射逻辑权重突发到物理位置。

相关链接:https://arxiv.org/abs/2608.25062

- 12 训练 -

Tinker微调Inkling:25-100小时专用音频即可登顶语音细节还原【7.2分】

Tinker宣布其微调版Inkling在语音细节还原任务上表现突出,仅需25至100小时的专业音频数据即可达到顶尖水平。该微调工作由besimple_ai完成,此前团队公布了Inkling在Voice Code Bench上的表现,随后尝试对其微调。Inkling的核心优势在于模型体积小、鲁棒性强,适合作为领域专用微调的基础模型。这一成果展示了小模型结合针对性微调在语音领域的潜力。

相关链接:https://x.com/miramurati/status/2094515221398425831

开发者用trl和openenv训练自有模型,将开源全部训练工件【6.0分】

开发者Sergio Paniego分享了使用trl和openenv训练自有模型的实践,并预告将发布配套博客,完整开放代码、模型、数据集和强化学习环境等训练工件。另一位开发者Surya表示,通过强化学习可以直接让编码模型学会用JavaScript作画。这次分享展示了trl与openenv在自定义训练流程中的应用方式,相关工件将随博客一并公开。

相关链接:https://x.com/huggingface/status/2094401894680588703

- 13 提示词 -

开源结构化提示模板,用于Claude Code等AI工具实现MVP快速交付【6.4分】

开发者开源了一款结构化提示模板,用于在Claude Code、Cursor和VS Code等AI辅助工作流中快速交付最小可行产品(MVP)。模板将vibe coding的松散流程转化为可复用的标准步骤,帮助开发者更稳定地借助AI编码工具完成从需求到成品的全过程。项目以GitHub仓库形式公开,任何开发者都可以直接复制使用,用于快速验证产品想法并交付可演示的MVP版本。

Image

相关链接:https://github.com/KhazP/vibe-coding-prompt-template

- 14 视频(展示4/5条) -

开发者用Grok Bot一键生成赤壁之战电影预告片,马斯克转发【7.1分】

开发者Yun-Ta Tsai公布了一段用Grok Bot自动生成的赤壁之战电影预告片,马斯克转发演示。两个月前他曾用Grok Imagine制作公元208年赤壁之战的名场面,如今Grok Bot可同时调度导演、编剧、音乐制作人与摄影师等角色,仅凭一条提示词即可一次性产出电影级预告片,其余环节全部自主完成。这一创作展示了Grok Bot在多智能体协作创作与视频内容生成方向的进阶能力。

相关链接:https://x.com/elonmusk/status/2094532280840503629

LTX Ripple:高效IC LoRA视频编辑法,首帧编辑涟漪扩散至全片【6.8分】

LTX Ripple是一种基于LTX 2.5模型构建的高效IC LoRA视频编辑方法,相关演示已对外公开。其核心特点是用户只需编辑视频的第一帧,编辑效果便会自动涟漪式扩散至后续所有帧,实现整段视频的一致修改,大幅简化传统逐帧编辑流程。据介绍,该方法能够精准达成预期编辑目标,且处理速度非常快。目前在线演示已部署在Hugging Face空间,用户可直接上手体验。

相关链接:https://huggingface.co/spaces/WepeNerd/ltx-ripple-demo

AI短片《INCUBUS》亮相Higgsfield电影节 作者称酝酿11年的故事终于拍出【6.8分】

电影制作人Julien Prevost日前公开介绍了自己耗时两周完成的6分钟AI短片《INCUBUS》。他表示,这部讲述一个男人能离开身体、进入他人身体生活的故事,在他脑中酝酿了11年,此前一直被认为无法拍成电影,直到Higgsfield发起的电影节提供了实现的契机。Prevost在分享中感谢Higgsfield带来的创作能量,称每天都能在这里发现才华横溢的创作者。

相关链接:https://x.com/EHuanglu/status/2094523581585862947

James Russo用Codex和fal H3 Max数小时构建无限滚动视频App【6.4分】

开发者James Russo近日介绍,他借助OpenAI Codex和fal的H3 Max模型,仅用数小时就构建了一款无限滚动的短视频应用,形态类似TikTok。该应用在滚动过程中实时生成视频内容,并能在观看时将视频继续延长,最长可达30秒。值得注意的是,从代码编写到演示录屏生成,整个过程均由Codex全自动完成。这次实践展示了AI编程代理与视频生成模型结合后,能够快速搭建出完整可交互的产品原型。

相关链接:https://x.com/gaganghotra_/status/2094299477515665514

- 15 音频 -

VoxCPM开源实时语音克隆:免分词连续空间建模突破传统TTS瓶颈【7.8分】

VoxCPM是一款开源的文本转语音系统,采用端到端扩散自回归架构,基于MiniCPM-4构建,直接在连续空间中建模语音,完全跳过分词步骤。传统TTS系统需先将语音转为离散词元,虽稳定但会损失呼吸声、音色等声学细节。VoxCPM通过分层语言建模解决:文本语义语言模型捕捉韵律,残差声学模型恢复精细声学细节。

相关链接:https://x.com/shao__meng/status/2094073632142319685

VoiceStudio开源发布:本地语音克隆与配音工具支持646种语言【5.5分】

Tom Dörr公开介绍了开源项目VoiceStudio。该工具可在本地完成语音克隆、配音、听写及长音频生成,整合16个TTS语音合成引擎和11个ASR语音识别引擎,覆盖646种语言。项目代码已在GitHub开源,用户可通过多引擎组合获得灵活的语音处理能力。VoiceStudio降低了语音合成与克隆的本地使用门槛,为多语言内容创作、影视配音和语音转写等场景提供了新的可选方案。

相关链接:https://github.com/debpalash/VoiceStudio

- 16 活动 -

EverMind将在杭州办EverMe内测体验会:AI记忆成Agent共同底座【6.0分】

EverMind宣布将于9月6日14:00至18:00在杭州余杭区恒生科技园举办EverMe线下产品体验会,免费但需审核。EverMe希望将用户记忆沉淀为所有AI Agent可调用的共同底座,让AI在一次次协作中逐渐理解用户。活动邀请AI Agent重度用户、创业者、产品经理、内容创作者和开发者,现场可优先体验EverMe、与团队面对面交流,并带着真实场景参与测试与反馈。

相关链接:https://x.com/elliotchen100/status/2094271028700893380

AI Colony学院9月4日线上直播:探讨2026年如何高效学习AI技能【5.2分】

AI Colony学院(The AI Colony Academy)发布活动预告,将于2026年9月4日下午6点(西非时间)在社交平台举办一场线上语音直播,主题聚焦'如何在2026年学习AI技能而不被海量信息淹没'。直播将围绕如何在高噪声的AI资讯环境中筛选有效内容展开讨论,并开放提问环节,参与者可带着问题前来交流。

相关链接:https://x.com/TheAIColony/status/2093377293016014972

- 17 案例(展示4/6条) -

小马智行联手韩国FutureLink:200台第七代Robotaxi剑指2028首尔全无人运营【7.3分】

中国自动驾驶企业小马智行与韩国FutureLink于8月28日在首尔汝矣岛康莱德酒店签署战略合作,计划引入200辆第七代Robotaxi,目标2028年前在首尔实现完全无人驾驶运营。小马智行联合创始人兼CEO彭军与FutureLink董事长南景弼、CEO车斗元共同出席签约仪式。此次合作是中国自动驾驶企业进军韩国市场的重要一步,当地Robotaxi产业尚未完全跨越商业化门槛。

相关链接:https://www.digitimes.com/news/a20260831VL203/pony.ai-autonomous-driving-commercial-market-technology.html

马斯克转发Grok Bot实测:用户组建四人助手团队打理日常事务【6.7分】

马斯克转发了一位用户关于Grok Bot的实测分享。该用户展示了由四个私人助理机器人组成的Bot Crew:幕僚长Cosie负责统筹,Maisie处理邮件,Weary帮忙整理每日穿搭,Poshy则在Poshmark上转卖闲置衣物,覆盖工作、通讯、穿搭与二手交易等多个生活场景。她感叹拥有Grok Bot前后的生活截然不同,称这套组合"改变了生活"、"仿佛置身天堂"。

Image

相关链接:https://x.com/elonmusk/status/2094244975651209265

谷歌力推AI工具进军好莱坞 影视行业成AI落地新战场【6.0分】

谷歌正积极争取好莱坞影视行业采用其AI工具。报道聚焦谷歌与影视制作公司、工作室之间的互动,展示科技巨头向娱乐产业推介AI技术、推动其在内容创作与制片流程中落地的策略。谷歌希望通过影视行业的合作案例,扩大AI工具在创意产业的应用版图。这一动向反映出大型科技公司与传统影视行业在AI应用上的持续磨合,也引发外界对AI介入内容创作方式的关注与讨论。

相关链接:https://www.latimes.com/entertainment-arts/business/story/2026-08-31/how-google-is-courting-hollywood-to-use-its-ai-tools

开发者演示Grok几秒为视频加字幕,称或不再需要Photoshop和CapCut【5.8分】

一则演示显示,开发者让Grok为视频添加字幕,几秒内即完成处理。该开发者表示,以后这类操作或许不再需要Photoshop或CapCut。演示视频记录了Grok自动为视频叠加字幕的过程,操作门槛明显降低。这一案例展示了Grok在视频后期处理场景中的实际应用能力。

相关链接:https://x.com/elonmusk/status/2094259860976103823

- 18 资源(展示4/6条) -

开源科学Agent技能库发布:163个工作流覆盖癌症基因组学与药物发现【6.9分】

K-Dense-AI发布了开源科学智能体技能库claude-scientific-skills,包含163个面向科研领域的工作流,覆盖癌症基因组学、药物发现与临床研究。技能库以开源方式托管于GitHub,科研人员可将这些技能用于生物医学研究与分析流程。这些技能以Agent技能形式组织,便于在智能体环境中直接调用。

相关链接:https://github.com/K-Dense-AI/claude-scientific-skills

Kuleshov团队发布教程:手把手构建扩散语言模型【6.8分】

康奈尔大学Kuleshov团队发布技术博客,详细讲解如何构建扩散语言模型。教程以循序渐进的方式展开,既介绍扩散模型在文本生成中的基本原理,也涉及实际的建模与训练流程,帮助研究者和开发者理解这一不同于传统自回归方式的新范式。内容在技术社区受到一定关注,目前获得20个点赞和2条评论,适合对生成式模型前沿方向感兴趣、希望上手实践的读者作为入门参考。

相关链接:https://kuleshov-group.github.io/blog/blog/2026/how-to-build-a-diffusion-language-model/

开源项目为AI智能体配备818项网络安全技能 映射6大行业框架【6.5分】

开发者近日分享了开源项目Anthropic-Cybersecurity-Skills,为AI智能体配备818项网络安全技能,并将这些技能映射到6个行业框架。项目已在GitHub公开发布,技能与框架的对应关系以结构化方式呈列,开发者可将这些技能接入智能体系统,帮助AI在网络安全场景下具备更系统的知识基础。

相关链接:https://github.com/mukul975/Anthropic-Cybersecurity-Skills

开源项目all-agentic-architectures以可运行类实现35种智能体AI架构并附对比基准【6.2分】

开发者FareedKhan-dev在GitHub开源了all-agentic-architectures,将35种生产级智能体AI架构实现为可直接运行的类,并附有对比基准测试。仓库以统一代码形式呈现多种智能体架构设计,开发者可直接运行各类架构并横向对比其表现。相比论文或架构示意图,代码化实现降低了理解与迁移成本;对于搭建智能体系统或进行架构选型的开发者。

相关链接:https://github.com/FareedKhan-dev/all-agentic-architectures

- 19 分享(展示4/7条) -

Uber工程团队公开Agent软件工厂实践:六因子成本方程与多维度优化策略【8.0分】

Uber工程团队发布博客,分享全公司落地AI编程Agent的运营体系。数据显示,过去半年超七成代码合并请求由Agent完成,自建3600个技能、每天执行3万次,周活跃用户增长7倍,总AI支出基本持平。文章提出六因子成本方程,将会话成本分解为用户数、请求量、输入输出Token及单价,并介绍模型选型、Token压缩、上下文工程等优化手段。

相关链接:https://www.uber.com/us/en/blog/efficient-software-factory/

GitLab团队详解上下文驱动AI开发工作流:效率瓶颈从工具转向上下文【7.8分】

GitLab团队在官方博客分享上下文驱动的AI开发工作流实践,提出AI时代开发效率的瓶颈已从工具能力转向上下文。其工作流包括:会话启动时AI自动加载活跃任务与阻塞项,碎片时间即可开工;通过git worktree和认领机制实现多AI会话并行推进MR;重复任务程序化,并自建本地MCP服务器,让工具做数据收集、LLM只做推理。

相关链接:https://about.gitlab.com/blog/building-an-ai-dev-workflow/

Shubham Saboo公开一人智能体组织运营法:Hermes四支柱架构【7.2分】

Shubham Saboo公开介绍其为2026年设计的一人智能体组织运行方式:基于Hermes搭建自改进体系,并以四支柱架构为核心。方向层面由他本人设定目标、审批方案并在必要时纠偏;执行层面由Hermes担任参谋长,各领域专家智能体分管业务,命令行工具执行具体动作;学习层面通过Skills技能模块保留有效做法,Memory承担记忆存储职责。

相关链接:https://x.com/unwind_ai_/status/2094196120788640027

Replit工程主管分享AI应用商业化经验:三天构建两月创收18万美元【6.8分】

Replit产品工程主管Amol Jain近日分享了将AI生成(vibe-coded)产品转化为真实业务的实践经验。他列举了三个由非程序员构建的应用案例,其中一个在开发者三天内完成端到端搭建后,前两个月便创收18万美元。他还提出将AI应用从原型推进到生产环境的四个步骤,并强调安全环节不可或缺。他同时指出,当代码可免费生成时,企业的核心竞争力应转向专业知识、判断力、分发渠道等差异化能力。

相关链接:https://youtu.be/JAh8Wv1lQrw

- 20 观点(展示4/40条) -

SpaceX自产涡轮叶片 缓解AI数据中心电力设备瓶颈【7.5分】

SpaceX正计划内部制造涡轮叶片,以缓解AI基础设施领域的全球性瓶颈。当前电力设备的供应紧张程度已与芯片相当,成为制约数据中心建设的关键短板。若该计划成功,将有望加快数据中心建设进度、重塑相关供应链,并增强马斯克对新增能源产能投产节奏的掌控力。分析认为,在AI算力需求快速扩张的背景下,电力设备供应已成为行业关注焦点。

相关链接:https://www.digitimes.com/news/a20260831VL204/spacex-data-center-infrastructure-texas-demand.html

黄仁勋称AI正将制造业带回美国,六个月内4000亿美元投向AI初创【7.4分】

英伟达CEO黄仁勋近日发表观点,认为AI正在催生新的公司和行业,并将制造业带回美国,推动国家再工业化。他表示,过去六个月已有4000亿美元投资涌入AI初创企业,并强调建设者必须与社区合作、赢得信任并创造本地价值。黄仁勋还指出,AI带来的需求正在驱动对老化电网和可持续能源的投资,且这一进程由市场力量而非补贴推动。他相信AI能帮助美国引领下一次工业革命。

相关链接:https://x.com/dnystedt/status/2094196247196537013

OpenRouter数据验证Jevons悖论:token降价后使用量暴增13.8倍【7.3分】

Aaron Levie分享了对AI token消费的观察:企业有大量任务希望自动化,但每项任务是否值得投入取决于自动化成本,包括设置时间和变更管理。随着token价格下降,更多工作可纳入自动化范围,如处理合同、阅读日志、监控数据流及后台智能体执行工作流。他表示,token价格即使下降50%,这类工作负载的token使用量也可能增长5倍。

相关链接:https://x.com/paulg/status/2094233112599208188

Gavin Baker:AI推动美国再工业化,半年4000亿美元涌入AI初创【7.3分】

Gavin Baker回应Jensen Huang的观点称,AI正推动美国再工业化,制造业自数十年离岸外包后回流美国;AI创造的需求带动对老旧电网和可持续能源的投资,且由市场力量而非补贴驱动。他还指出AI正在能源、芯片制造和数据中心领域创造就业,过去六个月已有4000亿美元投入AI初创公司。随后他为自己昨日关于数据中心的言论致歉,表示约18个月前公众对水资源、税收、就业、电价和环境的担忧是合理的。

相关链接:https://x.com/heyshrutimishra/status/2094277280973652322

- 21 其他 -

1. Thinking Machines宣布扩充评估团队,专注检验模型实际效用与评测方法质量,使其能作为扩展研究的衡量基准。团队将负责构建具备信号价值的内部评测以支持预测性扩展,将真实用户反馈与产品流程转化为评测以弥合可用性差距,并审计评分器与评测框架,同时开发面向可定制性的新基准。相关招聘信息已公开,欢迎研究者申请。

相关链接: https://jobs.ashbyhq.com/ThinkingMachines/602f2a99-34eb-4fde-9eec-b4945ee4aab6

2. 本文报道了Cymela研究专栏发布的一篇题为'同类首创'的文章。该文章链接已在技术社区被分享,目前获得3个评分,评论区暂无发言。文章标题显示其内容具有首创性质,但摘要中未提供任何具体的技术细节或数据。作为研究类内容,这篇文章可能涉及某领域的创新突破,但具体方向尚不明确。读者可通过原文链接了解详细内容,并通过社区评论链接参与讨论。该文章当前关注度较低,后续进展值得留意。

相关链接:https://cymela.com/research/first-of-its-kind

- 结语 -

截至发稿共收录154条AI资讯,本期早报精选63条。以上为果比AI早报精选,更多AI资讯请移步www.guobi.ai

Image
Image


Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/200471