博客

介绍 Meta SAM 3D:单图 3D 重建

介绍 Meta SAM 3D:单图 3D 重建

Meta SAM 3D 为日常图像带来了人类水平的「常识」3D 理解——让任何人都能从一张普通照片中重建物体甚至完整的人体。

2026-05-19

Nano Banana Pro:AI 图像编辑工具

Nano Banana Pro:AI 图像编辑工具

Nano Banana Pro 现提供近乎完美的人物一致性、原生 4K 输出、无瑕疵的文字渲染以及完全的自然语言控制

2026-01-16

Anthropic 的 IPO 策略与展望

Anthropic 的 IPO 策略与展望

Anthropic 计划在 2026 年进行 IPO,估值超过 3000 亿美元,收入从 90 亿美元提升至 260 亿美元,专注安全的信任对决 OpenAI。

2025-12-04

OpenAI的Thrive合作伙伴关系与中国LLM如何重塑企业AI整合

OpenAI的Thrive合作伙伴关系与中国LLM如何重塑企业AI整合

OpenAI与Thrive Capital的战略合作正在推动AI整合进入传统行业,而中国的LLM如Qwen的兴起为企业AI提供了具成本效益的替代方案。Macaron AI作为一个以消费者为中心的AI平台,正通过提供个性化的数字助手来进军亚洲市场,服务于日常生活。

2025-12-03

从扩展到体验智能:Ilya Sutskever 的愿景与 Macaron 的方法

从扩展到体验智能:Ilya Sutskever 的愿景与 Macaron 的方法

Ilya Sutskever 从 AI 扩展转向研究,强调了对更智能算法和持续学习的需求。Macaron AI 采用这一理念,专注于体验智能,打造能够从现实世界经验中学习并随时间适应的 AI。

2025-12-03

ChatGPT 三周年纪念礼 – DeepSeek V3.2 系列挑战 GPT-5 和 Gemini

ChatGPT 三周年纪念礼 – DeepSeek V3.2 系列挑战 GPT-5 和 Gemini

DeepSeek V3.2 是一个开源 AI 模型,通过高级推理、编程和问题解决能力挑战 GPT-5 和 Gemini,提供高效性能。

2025-12-01

Kimi K2:开源LLM在推理上媲美ChatGPT-5.1和Claude 4.5

Kimi K2:开源LLM在推理上媲美ChatGPT-5.1和Claude 4.5

Kimi K2 Thinking 是一个拥有一万亿参数的开源LLM,专为高级推理和工具使用而打造。看看它与其他领先AI模型的比较。

2025-11-28

NVIDIA Blackwell Ultra 与 AI GPU 供应危机

NVIDIA Blackwell Ultra 与 AI GPU 供应危机

NVIDIA 最新的 Blackwell Ultra GPU 平台在 AI 领域掀起了风暴,以至于导致了严重的供应短缺。

2025-11-28

Notion AI「蓝图代理」:工作区自主代理的崛起

Notion AI「蓝图代理」:工作区自主代理的崛起

Notion 的 AI 代理做什么,为什么会走红,以及在实际工作流程中有多可靠。

2025-11-28

阿里巴巴新AI:30秒内构建应用的灵光

阿里巴巴新AI:30秒内构建应用的灵光

灵光是蚂蚁集团(阿里巴巴的金融科技部门)推出的一款新型多模态AI助手,可以在一分钟内将日常语言转换为可用的小型应用程序。

2025-11-28

从 Grok 1 到 Grok 5:xAI 的演变

从 Grok 1 到 Grok 5:xAI 的演变

Grok 的基础设施和模型能力如何从 Grok-1、2、3、4 演变而来,我们可以从即将推出的 Grok-5 中期待什么?

2025-11-28

DeepSeek-V4 MoE: The 1-Trillion Parameter Breakthrough

DeepSeek-V4 MoE: The 1-Trillion Parameter Breakthrough

DeepSeek-V4 has taken the AI community by storm as the largest open Mixture-of-Experts (MoE) language model to date.

2025-11-28

苹果智能 2.0:离线 LLM 和「场景记忆」

苹果智能 2.0:离线 LLM 和「场景记忆」

苹果的 iOS 19.2 更新通过设备上的 LLM 和全新的「场景记忆」功能,大幅增强了过去一年推出的「苹果智能」功能。

2025-11-28

全面技术对比:Claude Opus 4.5 vs. ChatGPT 5.1 vs. Google Gemini 3 Pro

全面技术对比:Claude Opus 4.5 vs. ChatGPT 5.1 vs. Google Gemini 3 Pro

这是对 Claude Opus 4.5、ChatGPT 5.1 和 Google Gemini 3 Pro 在关键维度上的技术对比,旨在了解它们之间的差异。

2025-11-25

Claude Opus 4.5:深入探索Anthropic的新前沿模型

Claude Opus 4.5:深入探索Anthropic的新前沿模型

深入分析Claude Opus 4.5,这是Anthropic最先进的大型语言模型:架构、训练、基准测试、安全性和对齐洞察。

2025-11-25

2025 AI 大战:Gemini 3、ChatGPT 5.1 和 Claude 4.5

2025 AI 大战:Gemini 3、ChatGPT 5.1 和 Claude 4.5

2025 年末呈现了迄今为止最激烈的 AI 对决:谷歌的 Gemini 3、OpenAI 的 GPT-5.1 和 Anthropic 的 Claude Sonnet 4.5。三者都提供前沿级别的性能,但风格和优势各异。

2025-11-24

GPT‑5.1‑Codex‑Max: OpenAI’s New Agentic Coding Powerhouse

GPT‑5.1‑Codex‑Max: OpenAI’s New Agentic Coding Powerhouse

OpenAI’s GPT‑5.1‑Codex‑Max is a new agentic coding model built for 24‑hour tasks, multi‑window compaction, and Windows support. See benchmarks, costs & use cases.

2025-11-21

Google Antigravity:Google 的代理优先编码平台揭秘

Google Antigravity:Google 的代理优先编码平台揭秘

深入探讨 Google 的编码代理——Antigravity,一个由自主代理编写、测试和协作的革命性 AI 集成开发环境。

2025-11-19

双子星 3 Pro:深入解析谷歌最先进的 AI 模型

双子星 3 Pro:深入解析谷歌最先进的 AI 模型

Macaron 分析谷歌的双子星 3 Pro —— 谷歌迄今为止最好的模型,超越其前代在所有主要 AI 基准上的表现。

2025-11-19

Macaron 比较:Gemini 3 vs ChatGPT-4 vs Claude 2

Macaron 比较:Gemini 3 vs ChatGPT-4 vs Claude 2

Google 的 Gemini 3 是 Google DeepMind 最新的多模态 AI 模型,代表了技术能力的重大飞跃。

2025-11-19

掌握 2025 年 LLM 后训练技巧:将模型从通才提升为专家

掌握 2025 年 LLM 后训练技巧:将模型从通才提升为专家

2025 年 LLM 后训练精通:SFT、RLHF、PEFT、LoRA。深入探讨 OpenAI 转型、Scale AI 持续学习,附图表。

2025-11-13

解锁 ChatGPT 5.1 的力量:OpenAI 最新 AI 突破的完整指南

解锁 ChatGPT 5.1 的力量:OpenAI 最新 AI 突破的完整指南

解锁 ChatGPT 5.1:OpenAI 2025 突破,Instant/Thinking 模式和8个特性。基准对比 Gemini 3/Claude 4.5,提升生产力,立即探索吧!

2025-11-13

ChatGPT 推出群聊:协作 AI 的新时代

ChatGPT 推出群聊:协作 AI 的新时代

OpenAI 的 ChatGPT 正在从一个单一聊天机器人演变为一个协作通信平台,推出群聊功能。

2025-11-12

Learn-to-Steer:NVIDIA 的数据驱动式文本生成图像扩散中的空间推理解决方案

Learn-to-Steer:NVIDIA 的数据驱动式文本生成图像扩散中的空间推理解决方案

Learn-to-Steer 是 NVIDIA 的一种新方法,通过直接从模型中学习来解决空间推理问题。

2025-11-10

为什么强化学习在 AI 的「下半场」中占据中心舞台

为什么强化学习在 AI 的「下半场」中占据中心舞台

强化学习将在 AI 演变中发挥重要作用——通过优化长期奖励来赢得任意任务的框架。

2025-11-10