Flowtify News

AI-curated topic updates and daily briefs

Important updates from public feeds, organized into topic timelines, live today briefs, and completed previous-day briefs.

AI 动态

人工智能、AI Agent、大模型、开源模型、AI 产品、模型服务与生态变化。

Today’s live brief

AI 动态今日快讯:Gemini 3.8 Flash 发布、Meta Muse Spark 1.3 登榜、司法部支持合理使用

今日 AI 领域迎来多项重磅发布:Google DeepMind 推出 Gemini 3.8 Flash 及网络安全版 Cyber;Meta 发布 Muse Spark 1.3,在 Artificial Analysis 智能指数中逼近 Claude 与 GPT;美国司法部首次就 AI 训练版权表态支持合理使用;Uber 在伦敦率先推出机器人出租车;Anthropic 开源电商智能体蓝图。此外,Perplexity 开源本地推理引擎 Lily,OpenAI Astra 发布在即但引发安全担忧。

Sep 307:01 AM
AI HOT — 全部 AI 动态AI curated

TechCrunch Disrupt 2026 公布 Builders Stage 议程,聚焦创业 scaling 策略

TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone Center 举行,Builders Stage 议程首次公布,涵盖 Gamma CEO Grant Lee、Google 产品 VP Robby Stein 等嘉宾,聚焦创业公司规模化策略。

  • TechCrunch Disrupt 2026 时间地点确定
  • Builders Stage 议程公布
Read source
Sep 307:00 AM
The VergeAI curated

Uber 率先在伦敦推出机器人出租车,击败 Waymo

Uber 在伦敦推出首个商业机器人出租车服务,成为该市首家提供此类服务的公司。车辆采用英国初创公司 Wayve 开发的自动驾驶技术,初期将配备安全驾驶员。这是 Uber 与 Wayve 多年布局英国市场的里程碑。

  • Uber 在伦敦推出首个商业机器人出租车服务
  • 采用 Wayve 自动驾驶技术,初期配备安全驾驶员
Read source
Sep 306:44 AM
AI HOT — 全部 AI 动态AI curated

Palo Alto Networks 以 5 亿美元收购 AI IT 服务台创企 Console

Palo Alto Networks 以 5 亿美元现金加股票收购成立两年的 AI 智能体 IT 服务台初创公司 Console,官方未披露条款。Console 曾融资 2900 万美元,出售前估值 1.57 亿美元。其智能体功能将并入 Cortex 平台,让安全团队用自然语言调查和解决告警。

  • 收购金额 5 亿美元,现金加股票
  • Console 智能体将并入 Cortex 平台
Read source
Sep 306:43 AM
AI HOT — 全部 AI 动态AI curated

Fable 5.1 对比 Fable 5 与 Opus 5:单图重建《魔戒》3D 场景实测

开发者 @thehypedotnews 使用 Three.js 让 Fable 5.1、Fable 5 和 Opus 5 分别从单张参考图程序化重建《魔戒》中的袋底洞、巴拉督尔和瑞文戴尔三个场景,全程通过 OpenRouter 运行,展示了不同模型在 3D 场景生成方面的能力差异。

  • 对比 Fable 5.1、Fable 5 和 Opus 5 的 3D 重建能力
  • 使用单张参考图重建《魔戒》场景
Read source
Sep 306:24 AM
AI HOT — 全部 AI 动态AI curated

TechCrunch Disrupt 2026 推出 Real World AI 舞台,聚焦数字与物理世界交融

TechCrunch Disrupt 2026 将推出新的 Real World AI 舞台,聚焦数字与物理世界的交汇及其持续融合。该舞台将包含 Nvidia、机器人与灭绝动物等元素,探讨 AI 在现实世界中的应用。

  • TechCrunch Disrupt 2026 新增 Real World AI 舞台
  • 聚焦数字与物理世界融合
Read source
Sep 306:23 AM
AI HOT — 全部 AI 动态AI curated

Ethan Mollick 引述法律备忘录案例,指出廉价低推理模型在法律基准上表现不佳

Ethan Mollick 引述 Prinz 对 AI 系统的法律基准测试结果,称最新模型表现很好,但更便宜、低推理能力的模型表现不佳。其引用的律师案例显示,一份由法律部门大量借助 AI 完成的备忘录格式精美,却在监管审批判断上得出完全错误的结论,还遗漏了两条导致交易被法律禁止的原因。

  • 廉价低推理模型在法律基准上表现不佳
  • AI 辅助的法律备忘录出现严重判断错误
Read source
Sep 306:22 AM
AI HOT — 全部 AI 动态AI curated

ProximalHQ 发布 FrontierSWE v2 超长程编码基准,Claude Fable 5.1 大幅领先

ProximalHQ 发布了 FrontierSWE v2 超长程编码基准,用于评估 AI 在复杂编码任务上的表现。结果显示 Claude Fable 5.1 在该基准上大幅领先其他模型,展示了其在长程编码任务中的优势。

  • FrontierSWE v2 是新的超长程编码基准
  • Claude Fable 5.1 大幅领先
Read source
Sep 306:22 AM
AI HOT — 全部 AI 动态AI curated

Boris Cherny 演示 Fable 5.1 让 Slack 中的 Claude Tag 更实用

Boris Cherny 演示 Fable 5.1 让 Slack 中的 Claude Tag 更实用,可从 metrics 电子表格和 Slack 其他数据临时搭建领导层汇报幻灯片,并在继续之前发现一份与数字不符的供应商报告并加以标出。Claude Tag 现已在 Team 和 Enterprise 套餐的 Slack 中提供。

  • Fable 5.1 增强 Slack 中 Claude Tag 的功能
  • 可临时搭建汇报幻灯片并发现数据不一致
Read source
Sep 306:20 AM
AI HOT — 全部 AI 动态AI curated

Broadcom 财报:AI 芯片收入预计 2027 年翻倍至 1150 亿美元

Broadcom 最新季度财报显示,AI 半导体收入达 167 亿美元,同比增长 221%,占总收入约 56%。公司预计 2027 年 AI 半导体收入达 1150 亿美元、2028 年达 2300 亿美元,连续两年翻倍;Q4 指引 AI 收入 217 亿美元,同比增长 236%。

  • AI 半导体收入同比增长 221%
  • 预计 2027 年 AI 收入达 1150 亿美元
Read source
Sep 306:13 AM
AI HOT — 全部 AI 动态AI curated

东锡 NLP 谈 AI 从 token 编号起步学语言与人类组合理解的差异

作者提出人类先学单个词再通过组合与经历理解复杂意义,例如从流、星、雨理解流星雨。AI 则先在庞大语料中建立 token 与编号的对应关系,再通过神经网络学习编号间的联系来逼近语言意义。作者认为 AI 语言的这种苍白感从起点就已注定。

  • 对比人类与 AI 语言学习方式
  • AI 从 token 编号起步
Read source
Sep 306:05 AM
AI HOT — 全部 AI 动态AI curated

FM-Bench 论文:让 15 个前沿模型运营足球俱乐部 20 年检验长时程决策能力

arXiv 论文 FM-Bench(Football Management Benchmark)让 15 个前沿模型在 20 个模拟赛季、约 340 到 400 个决策点的环境中管理足球俱乐部,涉及转会、合同、现金和投资,以检验模型的长时程决策能力。

  • FM-Bench 基准测试让 15 个前沿模型管理足球俱乐部 20 个赛季
  • 每个赛季包含约 340-400 个决策点
Read source
Sep 305:57 AM
AI HOT — 全部 AI 动态AI curated

Alexandr Wang 转发 muse spark 1.3 与 fable 5.1 同题对比测试

Alexandr Wang 引用 @notjazii 的对比测试并评价 muse spark 1.3 表现相当不错。同一提示词、最高推理档位下,muse spark 1.3 一分钟完成且费用几乎可忽略,而 fable 5.1 用了 70 分钟、花费 $13,凸显了 muse spark 1.3 在效率与成本上的优势。

  • muse spark 1.3 一分钟完成,费用极低
  • fable 5.1 耗时 70 分钟,花费 $13
Read source
Sep 305:42 AM
AI HOT — 全部 AI 动态AI curated

Meta Muse Spark 1.3 在 Artificial Analysis 智能指数得 62 分,价格远低于同级模型

Meta 的 Muse Spark 1.3 在 Artificial Analysis Intelligence Index 得 62 分,追平 Claude Fable 5,输入价格低 8 倍、输出价格低近 12 倍。评分还高于 GPT-5.6 Sol、Grok 4.6、Kimi K3 和 Gemini 3.8 Flash,Meta 进入前沿模型第一梯队。

  • Muse Spark 1.3 得分 62,追平 Claude Fable 5
  • 价格远低于同级模型:输入低 8 倍,输出低近 12 倍
Read source
Sep 305:39 AM
AI HOT — 全部 AI 动态AI curated

Meta 发布 Muse Spark 1.3,Intelligence Index 得 61-62 分逼近 Claude 与 GPT-5.6

Meta 发布 Muse Spark 1.3,这是五个月内第四个 Muse Spark 版本。其 max 变体(合作伙伴限时预览)在 Artificial Analysis Intelligence Index 上获得 62 分,逼近 Claude 与 GPT-5.6 的水平,显示出 Meta 在 AI 模型能力上的持续快速迭代。

  • Muse Spark 1.3 为五个月内第四个版本
  • max 变体在 Intelligence Index 得 62 分
Read source
Sep 305:39 AM
AI HOT — 精选AI curated

Meta 发布 Muse Spark 1.3,Intelligence Index 得 61-62 分逼近 Claude 与 GPT-5.6

Meta 发布 Muse Spark 1.3,为五个月内第四个 Muse Spark 版本。max 变体(合作伙伴限时预览)在 Artificial Analysis Intelligence Index 得 62 分,逼近 Claude 与 GPT-5.6,显示 Meta 在 AI 模型上的快速迭代。

  • Muse Spark 1.3 是五个月内第四个版本
  • max 变体得分 62,逼近 Claude 和 GPT-5.6
Read source
Sep 305:37 AM
AI HOT — 全部 AI 动态AI curated

Perplexity 开源本地推理引擎 Lily,支撑 Mac 应用混合计算功能

Perplexity 开源本地推理引擎 Lily,专为 Apple Silicon 上的 Qwen3.6-35B-A3B 优化,用于支撑 Mac 应用新推出的混合计算功能,避免端侧算力成为 Computer 任务瓶颈。

  • Perplexity 开源本地推理引擎 Lily
  • 针对 Apple Silicon 优化,支持 Qwen3.6-35B-A3B
Read source
Sep 305:29 AM
News Hacker | 极客洞察AI curated

Muse Spark 1.3 发布引发 AI 前沿竞争与 Meta 追赶讨论

Muse Spark 1.3 发布引发社区对 AI 前沿竞争格局的讨论,评论聚焦于 DeepSeek、OpenAI 与 Anthropic 不同技术路线对推理与编码能力的推进,以及 Meta 凭借算力与 Llama 4 能否重回前沿。讨论还涉及模型进步是否放缓、团队重组等话题。

  • Muse Spark 1.3 发布引发对 AI 竞争格局的讨论
  • 对比 DeepSeek、OpenAI、Anthropic 的技术路线
Read source
Sep 305:25 AM
AI HOT — 全部 AI 动态AI curated

Gemini 3.8 发布,作者指其节奏复制去年 2.5 Pro 到 3 的路径

Gemini 3.8 发布,作者称其表现非常亮眼。作者认为 Gemini 似乎在复制去年 2.5 Pro 到 3 的节奏,夏天后发力,到年底用 ultra 年票打折绑定用户,之后再拉半年。

  • Gemini 3.8 发布,表现亮眼
  • 作者认为其发布节奏与去年 2.5 Pro 到 3 类似
Read source
Sep 305:24 AM
News Hacker | 极客洞察AI curated

Fable 5.1 用地图数据生成可漫游的 3D Union Square

Fable 5.1 展示了将旧金山 Union Square 变成可漫游 3D 场景的能力,用户可沿街行走、查看店铺、穿过路口,甚至看到缆车和商店内部。讨论认为该场景可能基于 OpenStreetMap 和 USGS 3DEP 数据,再通过代码转换为 ThreeJS 模型,引发对“世界模型”定义的探讨。

  • Fable 5.1 生成可漫游的 3D 城市场景
  • 可能基于 OpenStreetMap 和 USGS 高程数据
Read source
Sep 305:16 AM
AI HOT — 全部 AI 动态AI curated

Alexandr Wang 称 Muse Spark 1.3 的编码智能体成绩被低估并给出安装命令

Meta 首席 AI 官 Alexandr Wang 表示 Muse Spark 1.3 的编码智能体成绩被低估,并给出了 muse code 的安装命令,暗示该模型在编码任务上的实际表现可能优于基准测试结果。

  • Alexandr Wang 认为 Muse Spark 1.3 编码成绩被低估
  • 提供了 muse code 安装命令
Read source
Sep 305:09 AM
News Hacker | 极客洞察AI curated

AI Agent 让重构更便宜,也更易迷路

讨论围绕 AI 编码代理是否会让代码重构消失展开。支持者认为 AI 能清理遗留代码,怀疑者指出其在大型代码库中可能漏读文件、钻入错误路径,导致代码复杂度超出人类理解。争论焦点从“能否写代码”转向“如何保证长期可维护性”。

  • AI 编码代理降低重构成本
  • 在大型代码库中可能迷失方向
Read source
Sep 305:06 AM
AI HOT — 全部 AI 动态AI curated

Ethan Mollick 对比 10 个月间两种 ChatGPT 智能体工作方式的构想

Ethan Mollick 发文指出两张图之间存在 10 个月的时间差,展示了两种关于 ChatGPT 智能体如何工作的构想。其中一张图显示了一个客服智能体流程图,包含越狱防护栏、分类智能体、if/else 分支,以及退货、挽留、信息咨询等下游智能体和幻觉防护栏。

  • Ethan Mollick 对比两种 ChatGPT 智能体构想
  • 展示客服智能体流程图,包含防护栏和分支
Read source
Sep 305:01 AM
AI HOT — 全部 AI 动态AI curated

SemiAnalysis 分析 Co-Packaged 光学趋势下光纤对准技术取舍

SemiAnalysis 发文分析行业转向 Co-Packaged 和 Near-Packaged Optics 后,光纤连接需直接落在 PIC 上,耦合精度要求微米级。主动对准难以支撑高光纤数量且不可拆卸,被动对准依靠机械结构可实现可重复连接,是未来趋势。

  • Co-Packaged 光学趋势要求光纤直接落在 PIC 上
  • 主动对准难以扩展且不可拆卸
Read source
Sep 305:00 AM
AI HOT — 全部 AI 动态AI curated

Meta 首席 AI 官转发 Muse Spark 1.3 一次生成整站实测

Meta 首席 AI 官 Alexandr Wang 转发用户 @JustinGorya 对 Muse Spark 1.3 的实测反馈。该用户称用简单提示词配合 2 个自定义技能,一次生成完整网站,认为模型有创造力、擅长前端。

  • Muse Spark 1.3 一次生成完整网站
  • 用户评价模型有创造力、擅长前端
Read source
Sep 305:00 AM
AI HOT — 全部 AI 动态AI curated

GitHub 播客解读 AI 开发新术语:loop engineering、Ralph loops、squads、harness 与 hill climbing

GitHub Podcast 一期节目配套文章由 Cassidy Williams 与 Marlene Mhangami 等解读当下 AI 开发常见新术语,包括 loop engineering、Ralph loops、squads、harness 与 hill climbing,帮助开发者理解最新概念。

  • GitHub 播客解读 AI 开发新术语
  • 涵盖 loop engineering、squads 等概念
Read source
Sep 304:59 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 上线 OpenCode Zen 免费使用

Meta 的 Muse Spark 1.3 模型已在 OpenCode Zen 平台上线,以 Contributor Free 档位提供,输入输出与缓存读取均免费。用户可免费体验该模型。

  • Muse Spark 1.3 在 OpenCode Zen 上线
  • 免费档位提供使用
Read source
Sep 304:50 AM
AI HOT — 全部 AI 动态AI curated

HarnessEvolve 论文:用参考轨迹实现可靠的智能体自我进化

DAIR.AI 推荐 arXiv 论文 HarnessEvolve,该工作指出自进化智能体存在三类失败:仅有终态反馈导致错误归因不清、智能体记住任务特定模式而非通用能力、无防护的更新会抹掉已有能力。

  • 自进化智能体存在三类失败模式
  • 提出用参考轨迹实现可靠进化
Read source
Sep 304:46 AM
AI HOT — 全部 AI 动态AI curated

Muse Spark 1.3 冲进 Artificial Analysis 智能指数第 3 名,跻身 Claude 与 GPT 之间

Muse Spark 1.3(max)在 Artificial Analysis Intelligence Index v4.11 中以 62 分升至第 3 名,是首个排名插在 Claude 和 GPT 之间的模型。引用者称其定价相比 Fable 更低,Alexandr Wang 转发并表示大家会喜欢这个模型。

  • Muse Spark 1.3 在智能指数中排名第 3
  • 首个排名位于 Claude 和 GPT 之间的模型
Read source
Sep 304:45 AM
AI HOT — 全部 AI 动态AI curated

Mostik 称潜空间桥接让 4B 模型接近 753B 模型表现

Mostik 称其潜空间桥接协议让前沿模型与 4B 边缘模型直接传递 hidden states,无需文本、双方均不微调;753B 模型读题、4B 模型作答时达到前沿模型约 80% 的准确率、速度快 20 倍,且比分数匹配的中型模型少用 2.5 倍算力。

  • 潜空间桥接协议实现模型间直接传递 hidden states
  • 4B 模型达到前沿模型 80% 准确率,速度快 20 倍
Read source
Sep 304:37 AM
AI HOT — 全部 AI 动态AI curated

Lutnick 表态信任 Anthropic,Tom Brown 亮相 G20 创新部长级会议

美国商务部长 Howard Lutnick 对 Axios 表示"我们信任 Anthropic",称该公司"做了我们要求的事",显示其在五角大楼争端后重回特朗普政府的支持阵营。Anthropic 联合创始人 Tom Brown 于周三在北卡罗来纳州与 Lutnick 共同出席 G20 创新部长级会议并承担重要角色,作者认为这体现了前沿 AI 公司需要在创始人层面开展技术外交。

  • 美国商务部长公开表示信任 Anthropic
  • Anthropic 联合创始人出席 G20 创新部长级会议
Read source
Flowtify — AI Reading, Knowledge & Creation Workspace