暂无搜索历史
过去两年,中国大模型行业最热衷做两件事:发布新榜单,然后寻找“中国版 OpenAI”。
Anthropic 发布 Claude Opus 5,定位旗舰级通用模型,在编码、知识工作和智能体任务上提升能力,并通过成本优化降低高强度使用门槛。
Opus 5 发布了。在多项公开基准上跑分上,它的性能接近、甚至领先于 Fable 5,API 价格却只有一半,官方定位却低一档。听起来有点像营销的话术,但我感...
和 AI 打交道时间久了,我有种感觉:AI 真正难的不是“会不会做”,而是“做完以后,我们敢不敢相信它”。
一场内部网络安全测试,最终演变成了对 Hugging Face 生产环境的真实入侵。
今年世界人工智能大会( WAIC )最热闹的是机器人,但我认为,最重要的信号恰恰是模型正在退到幕后。
当然,这句话要先加点边界。这里不是说 K3 自己训练了自己,也不是说 AI 已经进入什么自动自我进化。K3 参与的是研发过程中的优化环节,而不是架构设计或模型训...
如果把这项任务交给早期的 AI 编程助手,它大概率会给出几段示例代码,然后把剩下的工作还给程序员。但新一代 Coding Agent (编程智能体)的目标完全不...
Moonshot AI 推出 Kimi K3,外媒称其为目前最大开放权重模型之一,在前端代码、智能体任务和成本效率上接近头部闭源模型,进一步放大中国开源模型的全...
当你在 Codex 里让智能体连续改十几个文件,进度条卡在第七步不动;或者让 ChatGPT 帮你读一堆材料,迟迟等不到第一个字——你感受到的,往往不只是“模型...
过去一周使用 Codex(OpenAI 的编程 Agent)和 ChatGPT Work 的用户,大概率都遇到了一件稀罕事:额度还没见底,OpenAI 就给重置...
更值得注意的是,这并非一周的偶然波动。中国模型的周调用量已经连续 11 周在该平台超过美国模型。
假设现在是 2027 年的一个工作日早上。你打开电脑,不是先开邮箱,也不是先找昨晚的会议纪要,而是先打开一个 AI 窗口,对它说:“帮我整理昨天会议纪要,把待办...
GPT-5.6 上周发布了。我觉得最值得关注的不是又多了一组“更强模型”,而是 OpenAI 正把模型、工具与工作上下文收拢到同一个入口。
OpenAI 推出 GPT-5.6 Sol、Terra、Luna 三档模型,面向高强度推理、通用知识工作和低成本调用,进一步强化编码、科研、多模态和智能体任务能...
Anthropic 本周的一篇关于 J 空间(J-Space)的论文,引起了业内广泛关注。
【核心判断】企业智能体不是花钱“买”来的,而是靠改数据、改流程、改权责“改”出来的。企业数字化底子有多厚,AI 的真实价值就有多大。
导读 卡普炮轰的,不只是 OpenAI、Anthropic 的 token 账单,而是企业 AI 最难回答的一笔账:调用越多,为什么业务结果不一定越好?
微软宣布启动 Frontier Company 业务,计划投入25亿美元,并向客户嵌入6000名行业和工程专家。重点不只是销售模型,而是把AI系统的选择、部署、...
导语:近日,Anthropic 推出 Claude Science。官方定位是科研工作台:把研究者常用的软件、数据源和计算资源接进同一个环境;“可审计产物”则是...
暂未填写公司和职称
暂未填写学校和专业
暂未填写个人网址