博客

介紹 Meta SAM 3D:單張影像 3D 重建

介紹 Meta SAM 3D:單張影像 3D 重建

Meta SAM 3D 將人類的「常識」3D 理解帶入日常影像——讓任何人都能從單張普通照片中重建物體,甚至完整的人體。

2026-05-19

什麼是 GLM-4.7?特點、上下文窗口及最佳使用案例(2026 指南)

什麼是 GLM-4.7?特點、上下文窗口及最佳使用案例(2026 指南)

GLM-4.7 是 Zhipu 最新的旗艦模型,擁有 200K 的上下文和 128K 的輸出。了解其特點、定價,以及在編碼、代理和長文檔任務中使用的時機。

2026-01-16

Nano Banana Pro:AI 圖像編輯工具

Nano Banana Pro:AI 圖像編輯工具

Nano Banana Pro 現在提供近乎完美的角色一致性、原生 4K 輸出、完美的文字呈現,以及完全自然語言控制

2026-01-16

GLM-4.7 與 Claude Sonnet 的 Vibe Coding:誰生成的 UI 更好?

GLM-4.7 與 Claude Sonnet 的 Vibe Coding:誰生成的 UI 更好?

比較 GLM-4.7 和 Claude Sonnet 4.5 在「vibe coding」方面的表現——生成實際上看起來不錯的登陸頁面、React 組件和幻燈片。

2025-12-27

GLM-4.7 與 GPT-5 的編程代理比較:實用分析

GLM-4.7 與 GPT-5 的編程代理比較:實用分析

比較 GLM-4.7 和 GPT-5 在代理編程任務中的表現。查看基準數據、定價和多步驟代碼生成的實際性能。

2025-12-25

從靜態模型到自適應代理:Tinker 和 Mind Lab 的創新

從靜態模型到自適應代理:Tinker 和 Mind Lab 的創新

我們深入探討 Tinker 的新更新及其對構建下一代 AI 系統的戰略意義。

2025-12-12

GPT‑5.2:關鍵改進、與 Gemini 3 的基準比較及影響

GPT‑5.2:關鍵改進、與 Gemini 3 的基準比較及影響

GPT-5.2 是 5.1 的重大升級,提升了推理、速度和可靠性,直接挑戰 Google 的 Gemini。

2025-12-11

Mistral 的 Devstral 2:多極化 AI 世界中的開源編碼 AI

Mistral 的 Devstral 2:多極化 AI 世界中的開源編碼 AI

Devstral 2 是一個具有 256K 上下文、接近 SOTA 編碼能力且靈活自我部署的開源編碼模型。

2025-12-10

Anthropic 的 IPO 賭局及展望

Anthropic 的 IPO 賭局及展望

Anthropic 瞄準 2026 年以超過 3000 億美元估值進行 IPO,收入從 90 億美元增至 260 億美元,專注於安全的信任對決 OpenAI。

2025-12-04

OpenAI 與 Thrive 的合作夥伴關係及中國 LLM 如何重塑企業 AI 整合

OpenAI 與 Thrive 的合作夥伴關係及中國 LLM 如何重塑企業 AI 整合

OpenAI 與 Thrive Capital 的策略合作正推動 AI 融入傳統產業,而中國 LLM(如 Qwen)的興起則為企業 AI 提供了具成本效益的替代方案。Macaron AI 作為一個以消費者為中心的 AI 平台,正在透過提供個人化的數位助手來進軍亞洲市場,致力於日常生活的應用。

2025-12-03

從擴展到體驗智慧:Ilya Sutskever 的願景與 Macaron 的方法

從擴展到體驗智慧:Ilya Sutskever 的願景與 Macaron 的方法

Ilya Sutskever 從 AI 擴展轉向研究,強調需要更智能的算法和持續學習。Macaron AI 採用這一理念,專注於體驗智慧,創建能從現實經驗中學習並隨時間調整的 AI。

2025-12-03

ChatGPT 三週年紀念禮 – DeepSeek V3.2 系列挑戰 GPT-5 和 Gemini

ChatGPT 三週年紀念禮 – DeepSeek V3.2 系列挑戰 GPT-5 和 Gemini

DeepSeek V3.2 是一個開源 AI 模型,以先進的推理、編碼和解決問題能力挑戰 GPT-5 和 Gemini,提供高效能和高效益。

2025-12-01

Kimi K2:開源LLM在推理能力上與ChatGPT-5.1及Claude 4.5競爭

Kimi K2:開源LLM在推理能力上與ChatGPT-5.1及Claude 4.5競爭

Kimi K2 Thinking是一個擁有1兆參數的開源LLM,專為進階推理和工具使用而設計。看看它如何與其他領先的AI模型比較。

2025-11-28

NVIDIA Blackwell Ultra 與 AI GPU 供應短缺

NVIDIA Blackwell Ultra 與 AI GPU 供應短缺

NVIDIA 最新的 Blackwell Ultra GPU 平台在 AI 界引起轟動,以至於造成了嚴重的供應短缺。

2025-11-28

Notion AI「藍圖代理」:工作空間自主代理的崛起

Notion AI「藍圖代理」:工作空間自主代理的崛起

Notion 的 AI 代理做什麼、為什麼會成為熱潮、以及在實際工作流程中的可靠性如何。

2025-11-28

阿里巴巴的新 AI:Lingguang,30 秒內打造應用程式

阿里巴巴的新 AI:Lingguang,30 秒內打造應用程式

Lingguang 是螞蟻集團(阿里巴巴的金融科技部門)推出的新型多模態 AI 助理,能夠在不到一分鐘內將日常語言轉化為可運行的小型應用程式。

2025-11-28

從 Grok 1 到 Grok 5:xAI 的演進

從 Grok 1 到 Grok 5:xAI 的演進

Grok 的基礎架構和模型能力如何從 Grok-1、2、3 和 4 發展而來——以及我們可以從即將推出的 Grok-5 期待什麼?

2025-11-28

DeepSeek-V4 MoE:突破 1 兆參數的里程碑

DeepSeek-V4 MoE:突破 1 兆參數的里程碑

DeepSeek-V4 作為目前最大的開放式專家混合(MoE)語言模型,已經在 AI 社群中掀起熱潮。

2025-11-28

蘋果智能 2.0:離線 LLM 與「場景記憶」

蘋果智能 2.0:離線 LLM 與「場景記憶」

蘋果的 iOS 19.2 更新強化了過去一年推出的「蘋果智能」功能,新增了裝置上的 LLM 和全新的「場景記憶」能力。

2025-11-28

技術全面比較:Claude Opus 4.5 vs. ChatGPT 5.1 vs. Google Gemini 3 Pro

技術全面比較:Claude Opus 4.5 vs. ChatGPT 5.1 vs. Google Gemini 3 Pro

這是對 Claude Opus 4.5、ChatGPT 5.1 和 Google Gemini 3 Pro 在關鍵方面的技術比較,以了解它們如何相互比較。

2025-11-25

Claude Opus 4.5:深入探討Anthropic的新前沿模型

Claude Opus 4.5:深入探討Anthropic的新前沿模型

深入分析Claude Opus 4.5,Anthropic最先進的大型語言模型:架構、訓練、基準測試、安全性和對齊見解。

2025-11-25

2025 AI 大戰:雙子星 3、ChatGPT 5.1 與 Claude 4.5

2025 AI 大戰:雙子星 3、ChatGPT 5.1 與 Claude 4.5

2025 年底呈現了最激烈的 AI 對決:Google 的雙子星 3、OpenAI 的 GPT-5.1 和 Anthropic 的 Claude Sonnet 4.5。三者都提供前沿水準的性能,但風格、強項各有不同。

2025-11-24

GPT‑5.1‑Codex‑Max: OpenAI’s New Agentic Coding Powerhouse

GPT‑5.1‑Codex‑Max: OpenAI’s New Agentic Coding Powerhouse

OpenAI’s GPT‑5.1‑Codex‑Max is a new agentic coding model built for 24‑hour tasks, multi‑window compaction, and Windows support. See benchmarks, costs & use cases.

2025-11-21

Google Antigravity:深入了解 Google 的代理優先編碼平台

Google Antigravity:深入了解 Google 的代理優先編碼平台

深入探討 Google's Coding Agent - Antigravity,一個革命性的 AI IDE,讓自動代理能夠編碼、測試與合作。

2025-11-19

Gemini 3 Pro:深入探索 Google 最先進的 AI 模型

Gemini 3 Pro:深入探索 Google 最先進的 AI 模型

Macaron 分析 Google's Gemini 3 Pro —— 這是 Google 迄今為止打造的最佳模型,各大 AI 基準測試均超越前代。

2025-11-19