首页
AI技术追踪
Daily Paper
SQBench
沙丘智库
关于沙丘
关于沙丘
专栏文章
评测方法
更新日志
首页
AI技术追踪
Daily Paper
SQBench
沙丘智库
关于沙丘
关于沙丘
专栏文章
评测方法
更新日志
更新日志
跟踪 SQBench、模型评测和沙丘社区内容的最新发布。
全部
模型评测
公告
社区洞察
2026-09-16
模型评测 · 9月16日
Qwen3.8-Max (Xhigh)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
模型评测 · 9月16日
Qwen3.8-Flash (Xhigh)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
社区洞察 · 9月16日
“DeepSeek V4.1 Flash真的超越V4 Pro了吗?”发布
完全替代V4 Pro ?
2026-09-15
社区洞察 · 9月15日
“本周AI技术跟踪:失效信息将影响Agent记忆可靠性(W37)”发布
识别和解读本周值得关注的技术变化
模型评测 · 9月15日
DeepSeek-V4-Pro-0813 (Max)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
2026-09-14
社区洞察 · 9月14日
“研究精选:13份报告,聚焦企业AI的成本、落地与组织能力”发布
涵盖AI编程、智能体治理、企业本体、交付模式与创新实践
模型评测 · 9月14日
DeepSeek-V4.1-Flash (Max)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
2026-09-11
社区洞察 · 9月11日
“英伟达给AI加上长期记忆,Agent要拼的不只是智商了”发布
英伟达近期公开了一项基于NemoClaw的记忆型Agent实践
2026-09-10
社区洞察 · 9月10日
“大厂的本体是一回事吗?”发布
本体到底是一种新产品,还是知识图谱换了个名字?
2026-09-09
社区洞察 · 9月9日
“海外AI Coding Agent产品定价研究:Claude Code、Codex、Cursor和GitHub Copilot”发布
定价模式正从固定席位费转向按量计费
2026-09-08
社区洞察 · 9月8日
“Palantir交付模式研究:竞争优势、运行机制与中国企业启示”发布
Palantir真正的护城河可能不是软件
2026-09-06
模型评测 · 9月6日
GPT-6 Astra (Max)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
2026-09-04
模型评测 · 9月4日
Claude Fable 5.1 (Max)评测结果上线
实战能力、可靠度、成本与模型分析页面已更新
2026-09-03
社区洞察 · 9月3日
“企业Harness实践深度调研:技术成熟度、实践分化与建设路径”发布
企业Harness,进入兑现期
2026-08-31
社区洞察 · 8月31日
“测试智能体驱动质量工程范式革新,腾讯、小红书、58同城实践案例”发布
腾讯、小红书、58同城等头部企业测试智能体落地实践
2026-08-25
社区洞察 · 8月25日
“Data Agent如何企业级落地?邮储银行、恒丰银行、得物、淘宝等实践案例”发布
告别传统BI:Data Agent驱动企业数据分析范式革新
2026-08-20
社区洞察 · 8月20日
“车企安全运营进入Agent时代,蔚来、理想、智己等落地实践”发布
蔚来、理想汽车、智己汽车等车企大模型安全运营技术实践
2026-08-13
社区洞察 · 8月13日
“RCA Agent市场洞察:从辅助诊断走向生产闭环”发布
RCA Agent重构企业故障排查,快手、趣丸等企业落地实践
2026-08-04
社区洞察 · 8月4日
“企业级Coding Agent Harness工程建设指南”发布
沙丘智库《企业级Coding Agent Harness工程建设指南》正式发布
2026-07-23
社区洞察 · 7月23日
“2026年中国Data Agent全景图发布:从问数走向全流程数据智能”发布
沙丘智库《2026年中国Data Agent主流厂商市场指南》正式发布
上一页
第 2 / 4 页
下一页