据彭博社记者马克 · 古尔曼昨日透露,苹果近期针对 Vision Pro 部门相关员工实行的裁员,规模比此前报道更大。
古尔曼曾在上个月透露,苹果视觉产品团队(IT之家注:Vision Products Group)裁员约 100 人,主要集中在头显游戏、沉浸式视频团队。
如今古尔曼表示,这波裁员的范围实际上还波及其他负责 Vision Pro 的员工,包括设备安全、音频工程、Siri 集成、visionOS 等部门。
据悉,Vision Pro 团队曾花费数月时间游说苹果新 CEO 约翰 · 特努斯,希望公司继续坚持 Vision Pro 发展路线,尽管该产品销售表现仍低于预期。
曾与特努斯讨论过这款头显的员工表示,他从一开始就对 Vision Pro 持怀疑态度,认为这款产品过于笨重且售价过高,难以触达大众市场。
同时,由于苹果即将推出的智能眼镜同样运行 visionOS,因此本次裁员也影响到了两条产品线共享的软件开发工作,而不只是 Vision Pro 头显本身。
此外,当前仍有传闻称特努斯支持内部代号为 N50 的智能眼镜项目,该产品计划明年推出。
但古尔曼认为,如果苹果的头戴式设备始终无法获得消费者认可,那么特努斯可能考虑让苹果彻底退出这一市场。(IT之家)任天堂旗下 Switch 2 游戏机港版、美版、欧版、加拿大版现已涨价。
任天堂此前表示,本次调整价格的主要原因是市场状况发生变化。
实际上今年 5 月日版 Switch 2 游戏机已涨价,包括初代 Switch、Switch OLED、Switch Lite 等。但 Switch 2 多语言版暂不受影响。(IT之家) OpenAI 否认窃取苹果商业机密:自己一手造成的还想赖别人据路透社报道,OpenAI 当地时间周一否认了苹果关于其窃取商业机密的指控,称这家 iPhone 制造商未能证明任何机密信息被离职员工带走。
“这场纠纷完全是苹果自己造成的一团糟,而苹果现在正试图把责任推给其他所有人。”OpenAI 在周一晚间向美国加利福尼亚州圣何塞联邦地区法院提交的文件中表示。
据了解,苹果今年 7 月起诉 OpenAI 以及两名前苹果员工 Tang Tan 和 Chang Liu,指控他们侵占了与硬件设计、制造和供应链运营相关的商业机密。当时,OpenAI 正在积极进军面向消费者的硬件设备市场。
由 CEO 萨姆 · 奥尔特曼领导的 OpenAI 则认为,苹果提起这场诉讼的目的,是为了拖慢潜在竞争对手的发展,并阻止更多员工离职。
根据双方此前提交的法庭文件,OpenAI 已经从苹果招募了约 400 名员工参与其硬件项目。
OpenAI 指出,根据加州法律,员工可以自由选择在竞争企业之间流动。
这起诉讼也标志着两家公司之间的矛盾明显升级。就在两年前,OpenAI 与苹果还曾建立合作关系,双方希望借此扩大 ChatGPT 的影响力,同时帮助苹果在人工智能领域获得更稳固的地位。
不过,随着 AI 行业竞争迅速加剧,两家公司的关系很快恶化。(IT之家)A 股“人形机器人第一股”宇树科技股价腰斩
IT之家 9 月 2 日消息,A 股“人形机器人第一股”宇树科技今日股价跌超 4%,截至IT之家发文,宇树科技每股已跌至 550 元以下,相比首日开盘最高 1,100 元 / 股已经股价腰斩。
宇树科技于 8 月 19 日上市,该股发行价为 150.80 元 / 股,开盘即报 1,100 元 / 股,较发行价大涨 629.44%,总市值一度站上 4,449 亿元。但首日即回落至 845 元收盘,全天换手 85.28%,231 亿成交。此后宇树科技股价连续多日下挫。
宇树科技是全球高性能通用机器人行业引领者,四足机器人、人形机器人两大品类出货量均位居全球第一。宇树科技 2026 上半年实现营业收入 11.52 亿元,同比增长 48.54%;扣非归母净利润 2.44 亿元,同比下滑 19.34%。(IT之家)
Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写
IT之家 9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe,这是其首个实时音频感知模型。
开发者可通过 Meta Model API 调用该能力,定价为每 1000 分钟音频 3 美元(现汇率约合 20.2 元人民币),等同每小时 0.18 美元(现汇率约合 1.2 元人民币)。
该模型在同一流程中整合流式自动语音识别、说话人分离与端点检测,用户说话时,系统可同步输出文字,无需等待完整录音结束后再单独处理。
IT之家注:“流式”就是边说边转写,模型不必等整段音频说完才出结果,而是会一小段一小段持续输出文字,所以延迟更低,适合实时听写、会议记录、通话字幕。
Muse Voice Transcribe 可在包含 20 余名说话者的录音中分离不同发言者,还能识别说话是否结束,从而自动确定一段输入的边界。
模型训练覆盖 70 余种语言,其中 25 种语言在发布时完成验证。该模型支持长度超过 1 小时的音频,也支持句内或句间的自然语言切换。开发者还可通过语言、关键词和上下文偏置,提高特定语言、术语或场景下的识别效果。
在技术方面,Meta 为兼顾实时响应和识别准确度,引入名为自适应延迟(adaptive delay)的动态决策机制。系统不会为所有词语采用固定的速度与准确度取舍,而是针对每个词判断需要额外接收多少音频后再输出识别结果。
对于较容易识别的语音,系统可更快提交转写结果。对于发音不清、术语较多或语境复杂的词语,系统会调用更多前后文音频信息。这种机制旨在兼顾。
Meta 称,截至 2026 年 9 月 1 日,Muse Voice Transcribe 位列 Artificial Analysis 流式语音转文本排行榜第 1 名。(IT之家)
马斯克:预计 AI 将令全球经济规模增加约 20%-30%
IT之家 9 月 1 日消息,马斯克今天(1 日)晚间在 G20 会议上发表演讲称,预计 AI 将使全球经济规模增加约 20%-30%,即每年增加约 20 万亿至 30 万亿美元(IT之家注:现汇率约合 134.72 万亿至 202.09 万亿元人民币)。
此外,马斯克预计到 2027 年底,AI 将能够完成所有数字领域的工作,即不需要人工直接操纵完成的工作。软件方面,AI 编程能力明年可能达到“Stockfish 级”,人类将无法与 AI 竞争软件开发;未来 12 至 18 个月内,AI 将在各类工程和其他数字领域的能力水平将会“极为出色”。
人形机器人方面,马斯克预计未来 10 年全球人形机器人数量将超过 10 亿台,每台机器人的生产力至少相当于人类的 5 倍,人形机器人总体则有望使全球经济规模扩大 10 倍以上。
马斯克同时警告 AI 行业正面临电力供应短缺,并直言这已经不是一个遥远的问题。他预计,2027 年 AI 芯片可能面临至少 15 吉瓦的电力缺口,原因是 AI 芯片产量增速约为 40%-50%,而中国以外的电力增速约为 10%-20%,增长速度较快的曲线将压倒较慢的曲线。对于“其他国家”而言,建设大量电力,托管 AI 数据中心,并对其征税、收取合理费用将是“机遇”。(IT之家)
美国五角大楼部署定制版 ChatGPT 和 Grok AI 助手
IT之家 9 月 1 日消息,五角大楼本周开始将定制版 ChatGPT 和 Grok 人工智能助手加入其内网,让数百万军人和文职人员能够使用 AI 工具,处理日常非机密任务。
美国国防部本周在其 GenAI.mil 内网门户加入 OpenAI 开发的 ChatGPT Mil,以及 Starshield AI 开发的 Grok for Government。国防部希望为工作人员提供更多 AI 模型选择,根据具体工作需求选择合适的 AI 工具。
国防部官员表示,ChatGPT Mil 主要针对大量文档阅读和写作任务,工作人员可以使用该工具进行物流规划、处理日常事务等。Grok for Government 提供不同推理模式,主要针对供应链跟踪和研究工作。
IT之家从美国国防部官网了解到,上述所有模型收集的数据均会锁定在内网环境中,OpenAI 和 xAI 不会利用政府数据训练 AI 模型,并且两款模型均不允许用于战斗行动或实施目标锁定任务。(IT之家)
编程能力追赶 OpenAI 与 Anthropic:
谷歌 Gemini 3.8 Flash 最快当地时间周三上线,内部代号“Skimaki”
IT之家 9 月 2 日消息,据《华尔街日报》当地时间 9 月 1 日报道,谷歌即将发布一款编程能力大幅升级的新模型 Gemini 3.8 Flash,内部代号为“Skimaki”。该模型最早可能于当地时间周三上线。
在谷歌内部编程工具 Jetski 的对比测试中,工程师对 Gemini 3.8 Flash 的偏好程度超过了 Anthropic 的 Opus 模型。内部测试结果显示,Gemini 3.8 Flash 在编程方面显著缩小了谷歌与 Anthropic 和 OpenAI 之间的差距。
Gemini 3.8 Flash 的发布正值谷歌 DeepMind 经历重大人事调整之际。上月,DeepMind 联合创始人 Demis Hassabis 卸下日常管理职责,转任部门主席及 Alphabet 首席科学家。长期担任其副手的 Koray Kavukcuoglu 升任 DeepMind 高级副总裁,全面接手日常运营。Kavukcuoglu 已向员工强调,他希望加快执行速度。
此前谷歌在模型开发竞赛中遭遇了一系列挫折。自去年 11 月发布 Gemini 3.0 后,Gemini 系列在编程等关键性能上落后于 Anthropic 和 OpenAI 的旗舰模型。IT之家此前报道,包括 Character.AI 联合创始人 Noam Shazeer 和首席科学家 Jeff Dean 在内的多位知名研究人员今年夏天已相继离职。
Gemini 3.8 Flash 属于 Flash 系列,该系列设计上更小、更便宜、运行更快,但性能不及包含数万亿参数的“Pro”系列旗舰模型。
据称,谷歌最强大的“Pro”系列新模型发布已落后于计划数月,内部的 3.5 Pro 候选模型因相较于 Flash 系列提升不够显著而被放弃。下一代旗舰模型 Gemini 4 在预训练评估中表现良好,但尚未完成后训练。
为提升模型编程能力,谷歌今年以来已将更多研究时间和算力投入到强化学习环节。此外,该公司近期还招募了前 Thinking Machines Lab 联合创始人、OpenAI 前后训练负责人 Barret Zoph,出任研究副总裁,专注于强化学习与后训练领域。(IT之家)
商务合作
Cassie | 微信:18506490569
Ares | 微信:18606066421
Lina | 微信:13381020131
客服服务
Baijingjsz | 微信:baijingJSZ066
与负责人聊合作
白鲸出海 黄剑新 | 微信:kc20200
(添加请备注姓名、公司及职位)