- 一起港湾 (17GW.com) 论坛发帖须知 (1篇回复)
- 全球最强模型Fable5.1发布#Anthropic这次更新Claude Fable 5.1与Mythos 5.1,把重心放在编程和科学能力上,这点我还挺看好。 (0篇回复)
- Anthropic深夜发布:Claude Fable 5.1、Claude Mythos 5.1,性能全面碾压前代 (0篇回复)
- Harness 的评测榜单 FrontierHarness v1.0 (0篇回复)
- Google 发了 Gemini 3.8 Flash,跑分表上 14 项拿了 8 个第一,编程和 Agent 能力大幅提升,价格只有 Opus 5 的 15%。看起来很猛,但我觉得最值得聊的,恰恰是它"没赢"的那几项。 (0篇回复)
- AI 的演进:从规则执行到自主行动 (0篇回复)
- 🚨对比测评:神秘模型 Ox Alpha 性能封神! (0篇回复)
- Grok 4.6 刚刚在 MedAgentBench 上排名第一......这是现实世界代理医疗保健任务最有趣的基准之一 (0篇回复)
- DeepSeek V4 Pro 正式版测评来了,SuperCLUE 综合总榜第2。 (0篇回复)
- 24 人团队,撬动 AI 芯片格局,Taalas 被 AMD 收购背后,是算力战场的转向。 (0篇回复)
- LLM-as-a-Verifier 不断突破性价比的极限! (0篇回复)
- 阿里巴巴刚刚发布了它所缺少的那一块拼图 它叫 OpenSandbox。 (0篇回复)
- 三星开始让AI造芯片了:一个月的工作压缩到两天,Exynos研发迎来新变量 (0篇回复)
- #DeepSeekHarness发布# 【DeepSeek Harness 真正狠的地方,是它没有"核心"】 (0篇回复)
- 黄仁勋9大预言!3年后机器人满街跑,AI将重塑世界。 (0篇回复)
- Antrophic is now the front runner of AI Boom (0篇回复)
- 最近一次使用ChatGPT 5.5 Pro的体验 标题平平无奇,内容却让整个数学圈坐不住了。 (0篇回复)
- 索尼 AI 发布的一段视频显示 (0篇回复)
- Token消耗榜挺有意思的… (0篇回复)
- 【AIGC日报】2026.4.12 | 今日要闻速览 (0篇回复)
- 据传 Anthropic 正在测试一个代号为「Conway」的突破性新项目,一个“永远在线”的 AI Agent (0篇回复)