本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?
本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?随着Agent走向真实工作,后训练和数据正在成为提升智能的关键。
搜索
随着Agent走向真实工作,后训练和数据正在成为提升智能的关键。
预计半年内,ChatGPT的下一代模型将能监视你的屏幕、记录每一次会议与通话,并完整掌握关于你生活的全部上下文。
疾病的发生往往牵动多个生物层次。DNA 突变可能影响 RNA 转录和蛋白质合成,继而改变细胞、组织和器官,最终表现为患者的症状。
最近,葬AI和我们的朋友钟经纬、正阳一起,推出了懂模帝这个产品,现在任何人都可以登陆 fuckai.md 去看各种各样的benchmark。
美国当地时间8月16日,Stripe以超过70亿美元的价格收购OpenRouter。
近期,白马资本(Armaro Capital)在北京举行开业庆祝暨交流活动。这家起步于纽约的美元风险投资母基金,也由此进一步开启在中国及亚洲市场的布局。
就在刚刚,Anthropic的护城河被踩碎了。
毫无疑问,四月份发布的生图模型 GPT-Image-2,现在依然是当之无愧的 AI 生图之王。
义父不愧是义父!
OpenAI接连放大招!今天,一条OpenAI内部Slack消息爆出,ChatGPT将迎来一次「史诗级」的性能大换血。从硬核测试数据来看,这次ChatGPT前端性能的优化幅度,夸张到近乎「不真实」:应用加载速度直接飙升94%,堆内存增长减少87.8%,整体内存占用砍掉41.2%。
太猛了,DeepSeek Harness 截至当前已经 112 k 的 Star 了,而这距发布仅仅过去三天。而且还在以惊人的速度增长...DeepSeek Harness 的核心就是:一切皆插件。说个不确切的比喻,有点 Agent 时代的 Obsidian 感觉了,自由度太高了。
据路透社 8 月 14 日独家报道,苹果已经针对中国市场训练了一款大型语言模型。三名知情人士透露,这款模型由苹果与阿里巴巴共同开发,阿里还为模型训练提供了支持。苹果和阿里均未回应置评请求。 随着新 iPhone 已经进入发布倒计时,中国用户也不免再次关心起这个问题:国行 Apple Intelligence 到底能不能用?
DeepSeek-v4-pro-0813 正式上线,两极分化的口碑却让人摸不着头脑。一边,是疯狂刷屏的评测夯爆了:多项 Agent 测试逼近 Fable 5,被认为是又一次前沿模型的“核弹级”更新;另一边,却是不少深夜忠实开发者直摇头:吐槽涨价、模型能力不及预期,实测体感甚至不如之前的小模型……
DeepSeek Harness这下真快被网友「插成万物」了。小黑鲸上线还没多久,单单在GitHub上打着dsh-plugin标签的公开仓库,就已经冲到了700+个???有人给它装浏览器、长期记忆、数据库和任务管理;有人嫌DeepSeek不会看图,现场接了个视觉模型进去。
距离十月,已不到两个月。而华尔街,正在等待一声可能改写科技史的钟响。如果一切按计划推进,今年秋天,人类资本市场将迎来一个前所未有的庞然大物——Anthropic。2万亿美元,AI史上最大IPO倒计时。
只做AI代码审美国AI代码审查与管理工具商CodeRabbit宣布完成1.43亿美元(约合人民币10.3亿元)C轮融资。Crunchbase显示,截至发稿,CodeRabbit一共完成了6轮融资,累计融资额达2.31亿美元(约合人民币16.6亿元)。查赛道,也能跑出一个独角兽! CodeRabbit,估值已超15亿美元(约合人民币108亿元)。 美国AI代码审查与管理工具商Cod
万能的开发者老哥,已经光速搓出水印移除skill。没想到吧?你有张良计,我有过墙梯。项目名称也很直给,就叫watermarks-remover(水印移除器)。嚯!原来大家都在闷声发大财啊(doge)
最新访谈中,奥特曼给出了一个罕见的评价:「他可能是AI历史上最重要、却不太为人所知的研究者。」这个人就是Alec Radford,真·GPT之父。你可能没听过他,但你大概率用过他发明的东西。
近日,清华大学智能产业研究院(AIR)与加州大学伯克利分校(BAIR)团队合作提出了一种全新的预测范式 ODEWorld,其建立在连续的“物理时间流”(Physical-Time Flow, PT-Flow)之上。与传统方法直接预测下一帧是什么不同,ODEWorld 试图学习的是:世界究竟怎样从当前状态连续地变化到未来状态。
Anthropic 的增长速度,又一次超过了自己的预测。据彭博看到的投资者文件,Anthropic 今年第二季度初步营收超过 115 亿美元,较去年同期的 7.87 亿美元增长超过 14 倍;相比今年第一季度的 47.3 亿美元,也增长了一倍以上。
2020 年,他去 MIT 面试教授岗位,做了一场关于用 GPT 做推理的报告。结果,面试委员会大部分教授把这个方向斥为「无稽之谈」(nonsense)。这哥们直接贴脸开大,将这段经历写进了个人主页,并附上了当年的报告介绍和幻灯片链接。
OpenAI研究员roon说得更绝:「我不写代码了,100%都是GPT完成的」。如今,另一位大佬在深度体验Claude Code和Codex之后,直呼「5年后,人类不再写代码了」!
此刻,DeepSeek Harness 的 GitHub 仓库显示 10.50 万个 Star、10033 次 Fork。距离发布仅 45 小时。当然,热度不意味着胜利。值得关注的是开发者具体在拿它做什么。人们开始拿 DSH 做完全相反的事——有人跑实测,有人报 Bug,有人造插件,也有人质疑“为什么还要再做一个 Harness”。
就在刚刚,Anthropic发了一篇博客。核心信息就是:各位,别再烧冤枉token了,我们都看不下去了!为此,官方详细列举了六条省钱心法,先贴为敬:1. 任务做完就/clear。修完一个bug就清掉当前对话,别让上一个任务读过的文件和命令输出拖进下一个任务里,白白占着上下文。
万象智维的会议室里,一字铺开了市面上主流的AI硬件。CEO王拓为告诉《智能涌现》,最近他们在讨论,一个AI硬件应该被设计成什么样的形态。
原本质朴得和 AI 毫不相关的婴儿睡眠用品,却靠 AI 成功出海。听起来十分符合 AI 时代的叙事,但这个 4 人小团队具体是如何做到的,依然让我们很好奇。以下内容为白鲸出海等多家机构与孙翔的对话汇总,白鲸出海稍作整理。
DT商业观察最近观察到,不少品牌让AI越过物料生产和投放优化的“浅水区”,到生意更深处,参与需求发现、产品定义、人群判断、投放调整,甚至经营决策。今年的小红书种草大赏上,首次增设「AI应用创新」赛道,本身也是一个信号。越来越多品牌和小红书,开始共同探索AI进入品牌生意环节之后的更多可能。
AI算力竞赛的天平,正在向电力倾斜。这一判断,在乌兰察布出现了一个具体样本:8月6日,远景科技集团在这里宣布「远景乌兰察布星河基地」正式投产,园区内全球最大的AI算力超级单体同步亮相。
背后由清华大学、北京大学等一众机构支持的 Agent Memory Leaderboard(中文名「记忆之巅排行榜」)放出了首期成绩,目前该项目上榜 Huggingface Spaces Trending 首屏。
最近来自斯坦福大学、CMU、MIT、UT Austin 等高校和科研机构的研究人员联合发布了全球首个系统提示词库 System Prompt Index(systempromptindex.ai),其中汇集了来自 Claude、ChatGPT 等 400 多款 AI 产品的 1000 余个系统提示词,是目前全球规模最大的 AI 系统提示词库。