产品与创业

互联网产品、创业公司、增长、商业模式、效率工具和产品设计。

Jul 12, 2026

Flowtify 公开资讯日报 | 2026-07-12

昨日AI领域迎来重大突破:OpenAI GPT-5.6 Sol Ultra在一小时内证明了悬而未决50年的图论猜想,同时GPT-5.6在医疗评估中全面超越专科医生。苹果起诉OpenAI窃密,前员工一句“哈哈”成关键证据。腾讯发布Hy3模型,定位Agent向LLM,已接入微信10亿+用户。Meta发布Muse Spark 1.1,强化AI智能体任务能力。此外,特斯拉Cybercab细节披露、AI作弊引发教育界反思、纳德拉提出“反向信息悖论”等话题也备受关注。

Flowtify 公开资讯日报 | 2026-07-12

📌 昨日重点

  • OpenAI GPT-5.6 Sol Ultra 一小时证明50年图论猜想:模型通过64个并行子智能体,在不到一小时内生成了“循环双覆盖猜想”的完整证明,若通过验证将是LLM首次独立解决维基百科“未解决数学问题”列表中的难题。
  • 苹果起诉OpenAI窃密:指控前工程师Chang Liu离职后利用软件漏洞持续访问苹果内网,并向同事分享“哈哈,我发现我还能访问网络存储”,后者协助其获取更多机密。目前已有超400名苹果员工跳槽至OpenAI。
  • OpenAI发布GPT-5.6医疗评估:最小变体Luna在最低推理强度下即超越最高推理强度的GPT-5.5,成本低25倍;最大变体Sol树立新标杆。在20000次盲评中,所有GPT-5.6模型在准确性、沟通、完整性等五个维度均显著优于专科医生。
  • 腾讯发布Hy3模型:采用295B总参数、21B激活参数的MoE架构,定位Agent向LLM,内部WorkBuddy任务成功率从72%提升至90%,已规模化部署至微信10亿+用户。
  • Meta发布Muse Spark 1.1:多模态推理模型,重点提升AI智能体在规划、协同与执行方面的能力,支持最高100万token上下文。

📂 分主题观察

🧠 AI 模型与能力突破

  • OpenAI GPT-5.6系列发布,模型竞争全面升级,发布频率从季度缩短至双周。
  • 陶哲轩用AI编码代理将1999年Java教学Applet移植到JavaScript,AI还识别出原始代码中两个未知bug。
  • 布朗大学实验揭示AI作弊现象:开卷96分,闭卷48.6分,引发教育界反思。
  • AI模型发布频率加速,Testing Catalog指出本周是AI发布最密集的一周。

🏢 企业与行业动态

  • 苹果起诉OpenAI窃密,前员工一句“哈哈”成关键证据。
  • 特斯拉披露Cybercab更多细节:全新超高效动力总成、4680电池、低压电气架构等。
  • 特斯拉46天拆除Model S/X产线,为Optimus人形机器人量产铺路。
  • S&P Global因OpenAI信用风险下调Oracle评级。
  • 微软和Meta对CoreWeave与Nebius的1222亿美元承诺额剖析。

🛠️ 产品与工具

  • WorkBuddy团队万字复盘:从模型到可用Agent的Harness工程实践。
  • Google Maps改路线算法:全城车速提升2%。
  • Mindwalk:在代码库3D地图上回放编码代理会话。
  • FetchSandbox:能记录故障原因的API集成测试工具。
  • JustVibe:专为行动而生的搜索引擎。

🔒 安全与隐私

  • xAI Grok Build CLI被曝上传用户完整仓库数据,包括.env密钥文件。
  • 中国配音演员遭AI盗声,被平台反向验明正身。
  • Ghost Font:人类可读但AI无法识别的反AI字体。

🌐 行业观点与趋势

  • 纳德拉提出“反向信息悖论”:企业使用AI时需保护自身知识。
  • 宇树科技王兴兴:机器人将走向普通消费者,就像30年前的个人电脑。
  • AI底层瓶颈是电力:中国在供给与基建上具比较优势。
  • OpenAI和Anthropic CEO改口:AI净创造就业,而非岗位杀手。

🔭 值得继续关注

  1. GPT-5.6 Sol Ultra的数学证明验证:若通过验证,将是LLM首次独立解决维基百科“未解决数学问题”列表中的难题,对AI科研能力具有里程碑意义。
  2. 苹果诉OpenAI窃密案进展:案件涉及商业机密、员工跳槽等敏感话题,后续法律走向将影响AI行业人才流动与竞争格局。
  3. 特斯拉Cybercab量产与试乘:无方向盘、无踏板的全自动驾驶版本已在得州超级工厂启动量产,并向员工开放试乘,Robotaxi服务何时落地值得关注。
  4. AI教育影响持续发酵:布朗大学等案例揭示AI作弊对教育评估体系的冲击,未来考试形式与学术诚信机制可能面临重大变革。
  5. 腾讯Hy3模型实际表现:作为Agent向LLM,已接入微信10亿+用户,其在实际业务中的表现和用户反馈值得持续跟踪。