AI星图

新闻动态

2026年8月14日

AI Agent 框架横向评测:LangChain、LangGraph、n8n、Dify、CrewAI、Coze 的 MCP 集成能力对比

面向 MCP 集成场景,横向对比 LangChain、LangGraph、n8n、Dify、CrewAI、Coze 六款主流 Agent 框架的能力与适用人群,给出选型建议。
来源:各框架官方文档与 AIStarMap 工具数据
2026年6月9日

GPTZero 面向内容审核场景的能力结构与落地边界

GPTZero 是面向内容审核与学术诚信场景的 AI 文本检测工具,公开资料显示其已在教学与企业审核流程中形成一定规模应用。
来源:GPTZero 官方文档、AI 文本检测工具评测、学术诚信平台业相

Zed 功能拆解与适用场景梳理

Zed 是 Rust 构建的高性能 AI 代码编辑器,GPU 加速渲染极致流畅,原生内置 AI 对话/代码补全和实时多人协作,支持 Claude/GPT-4,2024 年开源,完全免费。
来源:Zed 官方文档

You.com 怎么用:AI 驱动的网络搜索引擎与搜索 API 平台

You.com 提供 AI 驱动的网络搜索引擎和企业级搜索 API,帮助 AI 应用获取实时网络信息,支持 RAG 管道集成,提供 Web、新闻、图片等多类搜索结果,是构建联网 AI 应用的核心数据接入层。
来源:You.com 官方文档

Zapier 功能拆解与适用场景梳理

Zapier 是无代码自动化平台,连接数千应用编排任务。本文梳理其功能、定价与应用场景。
来源:Zapier 官方文档

Writesonic 是什么:集 AI 内容生成、AI 对话和智能客服机器

Writesonic 是集 AI 内容生成、联网 AI 对话(Chatsonic)和无代码客服机器人(Botsonic)于一体的写作平台,80+ 写作模板覆盖 SEO 文章、广告文案、社媒内容,支持多语言创作。
来源:Writesonic 官方文档

一文看懂 Windsurf:Codeium 团队打造的 AI 原生

Windsurf 是 Codeium 团队推出的 AI 原生 IDE,核心 Cascade Agent 提供跨文件项目理解与自主任务执行。本文梳理其核心能力、Cascade、Plugin、定价方案与版本演进。
来源:Windsurf 官方文档
2025年9月23日

通义千问发布 Qwen3Guard:为中文大模型补上"安全护栏"

阿里通义千问 2025 年 9 月 23 日发布 Qwen3Guard,Qwen 家族首个安全护栏模型,基于 Qwen3 构建,针对安全分类任务微调,为提示词与回复提供精准安全检测,在主要安全基准上取得 SOTA,填补中文开源护栏模型空白。
来源:Qwen 官方博客
2026年6月23日

Qwen-AgentWorld 发布:首个原生语言世界模型,一个模型模拟七大领域

阿里通义千问 6 月 23 日发布 Qwen-AgentWorld——首个原生语言世界模型,能从预训练阶段引入环境理解目标,用单一模型覆盖 MCP、Search、Terminal 等七大领域智能体环境。
来源:通义千问官方
2026年6月17日

OpenAI 发布 LifeSciBench:专家撰写+专家评审的生命科学 AI 评测基准

OpenAI 发布 LifeSciBench,含 750 个专家撰写任务和 19020 个细粒度评分标准,科学评估 AI 在生命科学中的真实能力。
来源:OpenAI 官方 Blog

OpenAI 发布近乎自主的 AI 化学家:改进药物化学关键反应

OpenAI 研究人员开发出近乎自主的 AI 化学系统,在药物化学的关键有机反应中取得突破性改进。
来源:OpenAI 官方 Blog
2026年8月3日

OpenAI 发布 249 页论文:前沿推理模型单发攻克十大数学难题

OpenAI 7月31日发布 249 页研究合集,前沿推理模型在高等数学与理论计算机科学取得十项进展,并以约 2000 美元成本"单发"攻克一个著名开放数学问题。
来源:用户供稿

微软 MDASH 登顶 CyberGym 网安基准:95.95% 断层第一

8月2日,微软 MDASH 在 CyberGym 网安基准上以 95.95% 断层第一,大幅领先 GPT-5.5 Cyber(85.6%)与 Mythos 5(83.8%)。
来源:用户供稿
2026年6月16日

OpenAI 发布 Deployment Simulation:在模型发布前预测其真实行为

OpenAI 提出 Deployment Simulation 新方法,通过模拟真实部署环境在模型公开发布前预测其行为和潜在安全风险。
来源:OpenAI 官方 Blog
2026年7月29日

OpenAI 用"两项设置"把 ARC-AGI-3 得分翻三倍:基准评测遭遇信任危机

OpenAI 7 月 29 日发布研究报告,披露通过"两项设置"即可将模型在 ARC-AGI-3 基准上的得分提升至三倍,揭示评测结果与推理/解码设置强相关,提醒业界警惕"评测配置依赖"导致的成绩虚高。
来源:OpenAI 官方新闻(研究)
2026年7月7日

Meta 发布 Muse Image 与 Muse Video:补齐"理解 + 生成"多模态矩阵

Meta 7 月 7 日发布 Muse Image 与 Muse Video,分别面向图像与视频生成的 Muse 系列新模型,与 Muse Spark(多模态理解/推理)协同构成"理解 + 生成"多模态矩阵,延续"开源 + 前沿"双轨策略。
来源:Meta AI 官方博客
2026年6月29日

Meta 发布 Brain2Qwerty:不开颅,用脑电波打字

Meta 6 月 29 日发布 Brain2Qwerty 研究,展示一种无需侵入性手术、通过脑电波实现文字沟通的新路径:读取大脑活动信号并映射为键盘输入/文字,为渐冻症等运动障碍患者提供新的沟通可能,是脑机接口领域的重要进展。
来源:Meta AI 官方博客
2026年5月28日

ElevenLabs 发布 Dubbing v2:AI 配音冲击"影视本地化"主战场

ElevenLabs 5 月 28 日发布 Dubbing v2,在语音自然度、音色保真度、口型同步精度、情感一致性与长内容稳定性上全面升级,与 Eleven v3、Scribe v2 构成"识别-翻译-合成-同步"完整配音管线,加剧多语言内容全球化竞争。
来源:ElevenLabs 官方博客
2026年7月6日

Anthropic 可解释性突破:Claude 内部存在"全局工作空间"式思维

Anthropic 可解释性团队 7 月 6 日发布研究《A global workspace in language models》:Claude 内部浮现一个"心智工作空间",持有不出现在输出中的内部思考;为理解 LLM 推理机制提供新证据。
来源:Anthropic 官方研究
2026年2月2日

Eleven v3 正式可用:AI 语音进入"难辨真人"的新阶段

ElevenLabs 2 月 2 日宣布旗舰语音模型 Eleven v3 正式可用(GA),在语音自然度、情感表现、多语言能力与稳定性上达到新水平,与 Scribe v2、Dubbing v2、Music v2 构成完整音频技术栈,是"最逼真 AI 语音"的技术底座。
来源:ElevenLabs 官方博客