AGI Watch Active
GitHub
N
AI Nerd Hub

The Daily AI Command Center

Real-time model benchmarks, pricing matrices, and community pulses. Caught up in 60 seconds.

🔍
Limit:
Modality:
97.3
#1
OpenAI: GPT-5.6 Luna Pro Logo
OpenAI: GPT-5.6 Luna Pro
97.3
#2
OpenAI: GPT-5.6 Luna Pro (batch) Logo
OpenAI: GPT-5.6 Luna Pro (batch)
97.3
#3
OpenAI: GPT-5.6 Luna Logo
OpenAI: GPT-5.6 Luna
97.3
#4
OpenAI: GPT-5.6 Luna (batch) Logo
OpenAI: GPT-5.6 Luna (batch)
97.3
#5
OpenAI: GPT-5.6 Terra Pro Logo
OpenAI: GPT-5.6 Terra Pro
97.3
#6
OpenAI: GPT-5.6 Terra Pro (batch) Logo
OpenAI: GPT-5.6 Terra Pro (batch)
97.3
#7
OpenAI: GPT-5.6 Terra Logo
OpenAI: GPT-5.6 Terra
97.3
#8
OpenAI: GPT-5.6 Terra (batch) Logo
OpenAI: GPT-5.6 Terra (batch)
97.3
#9
OpenAI: GPT-5.6 Sol Pro Logo
OpenAI: GPT-5.6 Sol Pro
97.3
#10
OpenAI: GPT-5.6 Sol Pro (batch) Logo
OpenAI: GPT-5.6 Sol Pro (batch)
97.3
#11
OpenAI: GPT-5.6 Sol Logo
OpenAI: GPT-5.6 Sol
97.3
#12
OpenAI: GPT-5.6 Sol (batch) Logo
OpenAI: GPT-5.6 Sol (batch)
97.3
#13
OpenAI: GPT-5.5 Pro Logo
OpenAI: GPT-5.5 Pro
97.3
#14
OpenAI: GPT-5.5 Pro (batch) Logo
OpenAI: GPT-5.5 Pro (batch)
97.3
#15
OpenAI: GPT-5.5 Logo
OpenAI: GPT-5.5
97.3
#16
OpenAI: GPT-5.5 (batch) Logo
OpenAI: GPT-5.5 (batch)
97.3
#17
OpenAI: GPT-5.4 Image 2 Logo
OpenAI: GPT-5.4 Image 2
97.3
#18
OpenAI: GPT-5.4 Nano Logo
OpenAI: GPT-5.4 Nano
97.3
#19
OpenAI: GPT-5.4 Nano (batch) Logo
OpenAI: GPT-5.4 Nano (batch)
97.3
#20
OpenAI: GPT-5.4 Mini Logo
OpenAI: GPT-5.4 Mini
Showing 20 of 442 modelsShowing text-relevant models only

🔥 This Morning2026-09-15

  • OpenAI: GPT-5.6 Luna Pro scores 97.3% CCI, maintaining a leading position in capability benchmarks.
  • Trending paper "Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation" gains significant traction with 141 Hugging Face community upvotes.
  • Community focus shifts to: "Airfoil" trending across Developer and Hacker forums.
Updated: 06:00 UTC

💬 Social Pulse SentimentAI Synthesized

Scaling laws & hardware limits17%
Open source & local LLMs32%
Agentic platforms & code automation27%
Safety, ethics & regulatory policies24%

📄 Trending Research Papers (No Abstracts)

Digests →
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and EvaluationBy Koutian Wu, Junjie Zhou, Ergan Shang, Jiayu Wang, Pengqian Han, Junkai Wang, Wanghan Xu
▲ 141
💬 4
DataFlex-RL: An Evaluation Platform for RLVR Data PoliciesBy Hao Liang, Mingrui Chen, Hengyi Feng, Meiyi Qiang, Wentao Zhang
▲ 101
💬 8
Feyospace-v1: How the Cyber Mercury Seven Trained Frontier Cyber ModelsBy Zongjie Li, Alan Z. W, John Nicolas J, Walter H. F, Scott Donald L, Gordon Y. P, Deke X Jr
▲ 75
💬 1
SAS: Simple Attention Sparsification via End-to-End Optimization of Context RankingBy Zhiwei Li, Lei Zhu, Hao Gu, Xiang Hu, Yan Wang, Haitao Mi, Sirui Han, Leo Liang, Zhijiang Guo
▲ 51
💬 2
▲ 50
💬 1
Memory as Plans: World-Action Modeling with Memory-Grounded PlanningBy Sizhe Zhao, Haozhe Xie, Weiyu Zhao, Chenchu Zhang, Huan Wang, Chenyang Wang, Qinglin Liu, Shengping Zhang
▲ 38
💬 9
FreeFlow: A Bias-free Hierarchical Transformer for Optical Flow EstimationBy Vladislav Bargatin, Alexander Yakovenko, Khaled Abud, Dmitriy Vatolin
▲ 34
💬 3
Beyond Solver Verdicts: Generative Reward Models for AutoformalizationBy Vikash Singh, Debargha Ganguly, Aman Goel, Ali Torkamani, Xiaoxue Han, Joseph Lilien, Ferhat Erata, Vipin Chaudhary
▲ 33
💬 7
Negative Self-Distillation: Learning to Reason by Avoiding FlawsBy Rongcan Pei, Zhepei Wei, Shuyao Xu, Xinyu Zhu, Wei-Lin Chen, Yu Meng
▲ 33
💬 1
Vidu S2: Real-Time Interactive, Editable, and Spatial Video GenerationBy Jintao Zhang, Kai Jiang, Jintao Chen, Xu Wang, Deyuan Liu, Jungang Li, Dechuang Chen, Ming Lin, Jingjiang Zhou, Haopeng Jin, Qi Jia, Xiaohang Wang, Yaole Wang, Zhanqiang Zhang, Ran Li, Zhengkun Huang, Shuyue Xiong, Yuji Wang, Zikun Dai, Hui He, Yang Luo, Mang Ning, Weiqi Feng, Chengyang Ye, Xinyue Lin, Min Zhao, Hongzhou Zhu, Hengkai Tan, Zeyuan Wang, Chendong Xiang, Kaiwen Zheng, Zhijie Deng, Fan Bao, Jianfei Chen, Jun Zhu
▲ 32
💬 0
COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill OptimizationBy Pingchen Lu, Xiangyi Wang, Xiang Li, Jie Mao, Zikun Qu, Junfeng Luo, Yao Shu, Bryan Kian Hsiang Low, Zhongxiang Dai
▲ 31
💬 2
StepAudio 3 Gen Technical ReportBy Bin Lin, Bo Zhao, Boyang Wang, Boyang Zhang, Boyong Wu, Chao Yan, Chen Geng, Chen Wu, Cheng Yi, Chengli Feng, Chenglin Zhu, DanNi Wan, Daxin Jiang, Dongqing Pang, Fei Tian, Feng Tian, Future Li, Gang Yu, Guanglong Yang, Jia Peng, Jiahao Song, Jiamin Fan, Jiangjie Zhen, Jianzheng Gao, Jun Chen, Li Xie, Lifang Zhang, Lingli Ji, Liying Shi, Lun Cai, Min Xu, Na Wang, Peilin Li, Peng Yang, Pengfei Tan, Qingjian Lin, Ruijie Xiong, Runze Li, Shenghua Hu, Shi Qiu, Siqi Tu, Siyi Zhou, Tianjiao Deng, Wanying Lu, Weiming Niu, Wen Sun, WenWen Qu, Xiangyu Zhang, Xianwei Zhang, XiaoSu Su, Xing Chen, Xinyu Liu, Xuerui Yang, Yang Li, Yang Yang, Yechang Huang, Yibo Zhu, Yifan Zhang, Yiyang Xu, Yu Fu, Yu Luo, Yu Zhou, Yumang Wang, Yunzhou Ju, Yuxiang Yang, Zekai Liu, Zengwei Yao, Zhenwei Mou, Zheqi Dai, Zhiyue Wu, Zichao Zhou
▲ 29
💬 0
ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMsBy Yizhan Li, Jianxin You, Mengyang Xiong, Yinhuan Chen, Zicheng Zhao, Dekun Wu, Dongqing Zhang, Bang Liu
▲ 28
💬 9
AGI Watch:~0y 0d 0h 0m 0s
85% ProbTimeline →

🤖 Top AI Agents

View Directory →
#1Cursorcoding
$20/month★ 4.8
#2AutoGPTautonomous
Free/OSS★ 3.8
#3Aidercoding
Free/OSS (BYOK)★ 4.6

🛠️ Top Tools and Packages

View Directory →
#1Ollamalocal-execution
181.0k★+1200
#2vLLMinference-engine
91.8k★+320
#3Unslothfine-tuning
76.2k★+890