
Meta SAM 3D 为日常图像带来了人类水平的「常识」3D 理解——让任何人都能从一张普通照片中重建物体甚至完整的人体。
2026-05-19

Nano Banana Pro 现提供近乎完美的人物一致性、原生 4K 输出、无瑕疵的文字渲染以及完全的自然语言控制
2026-01-16

DeepSeek V3.2 是一个开源 AI 模型,通过高级推理、编程和问题解决能力挑战 GPT-5 和 Gemini,提供高效性能。
2025-12-01

Kimi K2 Thinking 是一个拥有一万亿参数的开源LLM,专为高级推理和工具使用而打造。看看它与其他领先AI模型的比较。
2025-11-28

NVIDIA 最新的 Blackwell Ultra GPU 平台在 AI 领域掀起了风暴,以至于导致了严重的供应短缺。
2025-11-28

Notion 的 AI 代理做什么,为什么会走红,以及在实际工作流程中有多可靠。
2025-11-28

灵光是蚂蚁集团(阿里巴巴的金融科技部门)推出的一款新型多模态AI助手,可以在一分钟内将日常语言转换为可用的小型应用程序。
2025-11-28

Grok 的基础设施和模型能力如何从 Grok-1、2、3、4 演变而来,我们可以从即将推出的 Grok-5 中期待什么?
2025-11-28

DeepSeek-V4 has taken the AI community by storm as the largest open Mixture-of-Experts (MoE) language model to date.
2025-11-28

苹果的 iOS 19.2 更新通过设备上的 LLM 和全新的「场景记忆」功能,大幅增强了过去一年推出的「苹果智能」功能。
2025-11-28

这是对 Claude Opus 4.5、ChatGPT 5.1 和 Google Gemini 3 Pro 在关键维度上的技术对比,旨在了解它们之间的差异。
2025-11-25

深入分析Claude Opus 4.5,这是Anthropic最先进的大型语言模型:架构、训练、基准测试、安全性和对齐洞察。
2025-11-25

2025 年末呈现了迄今为止最激烈的 AI 对决:谷歌的 Gemini 3、OpenAI 的 GPT-5.1 和 Anthropic 的 Claude Sonnet 4.5。三者都提供前沿级别的性能,但风格和优势各异。
2025-11-24

OpenAI’s GPT‑5.1‑Codex‑Max is a new agentic coding model built for 24‑hour tasks, multi‑window compaction, and Windows support. See benchmarks, costs & use cases.
2025-11-21

深入探讨 Google 的编码代理——Antigravity,一个由自主代理编写、测试和协作的革命性 AI 集成开发环境。
2025-11-19

Macaron 分析谷歌的双子星 3 Pro —— 谷歌迄今为止最好的模型,超越其前代在所有主要 AI 基准上的表现。
2025-11-19

Google 的 Gemini 3 是 Google DeepMind 最新的多模态 AI 模型,代表了技术能力的重大飞跃。
2025-11-19

2025 年 LLM 后训练精通:SFT、RLHF、PEFT、LoRA。深入探讨 OpenAI 转型、Scale AI 持续学习,附图表。
2025-11-13

解锁 ChatGPT 5.1:OpenAI 2025 突破,Instant/Thinking 模式和8个特性。基准对比 Gemini 3/Claude 4.5,提升生产力,立即探索吧!
2025-11-13

OpenAI 的 ChatGPT 正在从一个单一聊天机器人演变为一个协作通信平台,推出群聊功能。
2025-11-12

Learn-to-Steer 是 NVIDIA 的一种新方法,通过直接从模型中学习来解决空间推理问题。
2025-11-10

强化学习将在 AI 演变中发挥重要作用——通过优化长期奖励来赢得任意任务的框架。
2025-11-10

新发布的开源模型:Kimi K2 是一个突破性的开源大型语言模型(LLM),它推动了“自主”AI 的边界——不仅能聊天,还能思考和行动的模型。
2025-11-06

Grokipedia 的条目由 xAI 的大型语言模型 (LLM) Grok 生成,而非由人类志愿者撰写。
2025-10-29

OpenAI Realtime is a recently introduced platform that enables truly live, multimodal AI interactions.
2025-10-29